تیتربرتر: گوگل از سالها قبل بهدنبال دسترسی به ظرفیت کامل هوش مصنوعی است و جدیدترین فناوری این شرکت AudioPaLM نام دارد؛ مدلی که میتواند با دقت بسیار بالا گوش دهد، حرف بزند یا ترجمه کند.
محققان گوگل، AudioPaLM را بهعنوان مدل زبان جدید معرفی کردهاند که میتواند با دقت شگفتانگیزی به صحبتهای دیگران گوش داده و آنها را به زبانهای دیگر ترجمه کند. این مدل از معماری چندوجهی بهره میبرد و نقاط قوت دو مدل کنونی یعنی PaLM-2 و AudioLM را ترکیب میکند.
AudioLM در حفظ اطلاعاتی مثل هویت و لحن صحبت گوینده بسیار عالی عمل میکند. با ترکیب این دو مدل زبانی، مدل جدید AudioPaLM به دست آمد که از تخصص زبانی PaLM-2 نیز بهره میبرد تا درک کاملی از متن و گفتار داشته باشد.
بهنوشتهی گیزموچاینا، AudioPaLM از واژگان مشترکی بهره میبرد که میتواند گفتار و متن را با استفاده از تعداد محدودی نشانههای مجزا، نشان دهد؛ این قابلیت به مدل اجازه میدهد کارهایی مثل تشخیص گفتار، تبدیل متن به گفتار و ترجمهی گفتار به گفتار را با معماری و فرایند آموزشی واحد، ارائه دهد.
AudioPaLM از سیستمهای موجود در ترجمهی گفتار بهتر عمل میکند و حتی میتواند ترجمهی گفتار به نوشتار را با ترکیبهای زبانیای که قبلاً هرگز با آنها مواجه نشده، انجام دهد. این هوش مصنوعی جدید میتواند صداها را براساس اعلانهای گفتاری کوتاه، بین زبانها انتقال دهد و صداهای متمایزی را به زبانهای مختلف ضبط و بازتولید کند.
هوش مصنوعی جادو نیست و برای جاسوسی از شما به کار گرفته میشود
طی نشست فناوری بلومبرگ که روز جمعه برگزار شد، چندین کارشناس، توضیحاتی درمورد نمای فریبندهی هوش مصنوعی ارائه دادند. متخصصان میگویند این فناوری بههیچوجه جادو نیست و در پس چهرهی ظاهراً بیضرر، عموم مردم را غافلگیر خواهد کرد و علاوهبراین توضیحاتی درمورد اینکه هوش مصنوعی تا چه حد میتواند مزاحم باشد ارائه دادند.
الکس هانا، مدیر تحقیقات مؤسسهی تحقیقات هوش مصنوعی توزیعشده (Distributed AI Research Institute) که افراد دیگری مثل سم آلتمن از OpenAI و عماد موستاک از Stability AI نیز در آن حضور دارند، از پنهان کردن این واقعیت که فعالیت محصولات هوش مصنوعی به نیروی کار انسانی نیاز دارد، انتقاد کرد.
هانا میگوید: «براساس گزارشها، میدانیم ارتشی از کارگران وجود دارند که در پشتصحنهی ابزارهای هوش مصنوعی، کارهایی مثل حاشیهنویسی و کار برچسبزدن را انجام میدهند. درحالیکه برچسبزدن با نیروی کار انسانی انجام میشود، آلتمن و موستاک میگویند این کارها بهطور خودکار انجام میشوند.»
بیشتر بخوانید:
بهنوشتهی فیوچریسم، مردیث ویتاکر بهعنوان رئیس بنیاد توسعهدهندهی پیامرسان سیگنال، نگرانیهایی درمورد حریم خصوصی مطرح کرد و این موضوع را بهعنوان نقطهضعف چتباتهایی مثل ChatGPT در نظر گرفت.
ویتاکر میگوید: «میتوانم بگویم شاید برخی افراد کاربر هوش مصنوعی هستند اما درواقع این فناوری از اکثر مردم سوءاستفاده میکند.»
ویتاکر برای توضیح بیشتر فردی را مثال میزند که درخواست وام بانکی او رد میشود. در این شرایط شاید شخص موردنظر نداند وامدهی از طرف بانک شامل سیستمهایی است که احتمالاً از برخی APIهای مایکروسافت نیز پشتیبانی کرده و اعتبار افراد را براساس محتوای موجود در فضای مجازی، ارزیابی میکند.
ویتاکر در ادامهی توضیحاتش اعلام میکند مدلهای هوش مصنوعی بهعنوان فناوری نظارتی عمومی نیز عمل میکنند. این ابزارها ما را ازطریق مجموعه دادههای بسیار عظیم جمعآوریشده از سایر انسانها، زیر نظر دارند؛ دادههایی که ازطریق میلیاردها صفحهی وب به دست آمدهاند و امکان دارد اطلاعات مربوط به هرکسی که تاکنون از اینترنت استفاده کرده در آن موجود باشد.
ویتاکر میگوید: «نیازی نیست دادههای جمعآوریشده از طرف هوش مصنوعی درمورد هر شخص کاملاً درست باشند یا دقیقاً نشان دهند شما چه کسی هستید و کجا زندگی میکنید، اما چنین سطح بزرگی از اطلاعات، قدرتی باورنکردنی است که در دستان شرکتهای فعال در حوزهی هوش مصنوعی قرار دارد.»


























































