OpenAI та Google: майбутнє ШІ – за голосом, а не текстом

Майбутнє спілкування з ШІ: Від текстових команд до природного голосу

Провідні технологічні гіганти, такі як OpenAI та Google, активно інвестують у розвиток передових голосових систем, що мають на меті зробити їх основним інтерфейсом для взаємодії з наступним поколінням штучного інтелекту. Про це повідомляє видання Financial Times.

 Джерело зображення: Marwan Ahmed / unsplash.com

Джерело зображення: Marwan Ahmed / unsplash.com

Компанії OpenAI та Google доклали колосальних зусиль, щоб їхні системи штучного інтелекту звучали не як бездушні роботи, а як співрозмовники, здатні глибоко розуміти запити та контекст розмови. Ці інноваційні функції вже здобули значну популярність серед користувачів та бізнесу. Вони стали справжнім проривом порівняно з традиційними голосовими помічниками, які працювали за схемою “мова → текст → текстова відповідь → озвучка”. Новітні моделі обробляють та генерують мовлення безпосередньо, що мінімізує затримки, робить тон розмови природнішим, а також зберігає контекст бесіди.

Нова ера взаємодії: Голос як ключовий інструмент

Розробники переконані, що зі зростанням можливостей систем ШІ — від простої відповіді на запитання до виконання складних, тривалих завдань — голосове спілкування стане набагато ефективнішим та природнішим, ніж введення запитів у текстовому форматі.

Однак, існують і певні виклики. Серед них — можливі затримки у відповідях, відфільтровування фонового шуму та психологічний дискомфорт від розмов з машиною у громадських місцях.

Попри це, тенденція очевидна: користувачі сервісів Google зі штучним інтелектом стали вдвічі частіше використовувати голосовий інтерфейс з початку року, а тривалість розмов зросла в середньому у п’ять разів порівняно з текстовими переписками. В OpenAI, щотижнева аудиторія користувачів голосового режиму ChatGPT перевищує 150 мільйонів осіб. Навіть інженери Microsoft активно застосовують голосовий інтерфейс для управління завданнями програмування за допомогою ШІ на платформі GitHub.

Переваги для розробників та стартапів

Представники OpenAI також відзначають зручність голосового інтерфейсу для вирішення складних завдань програмування. Сандро Джанелла (Sandro Gianella) з OpenAI поділився своїм досвідом: «Коли я пишу код, я часто переходжу до вирішення задачі голосом. Під час розмови я краще висловлюю свої наміри, очікування, обмеження, непевності та те, як має виглядати ідеальний результат».

Цей тренд вже підхопили стартапи Кремнієвої долини. Вони активно інвестують у розробку інноваційних мікрофонних систем та рішень для звукоізоляції офісних приміщень, щоб забезпечити чисте сприйняття голосових команд ШІ. На ринку з’являються пристрої нового покоління. OpenAI також готує власний гаджет з інтегрованим голосовим помічником, який буде оснащений камерою, мікрофоном та динаміком. А стартап Sandbar з Нью-Йорка представив розумне кільце, що дозволяє віддавати команди ШІ, реагуючи виключно на голос власника.

Порада від Soft Portal:

Ці розробки відкривають нові горизонти у взаємодії з технологіями. Голосові інтерфейси роблять штучний інтелект більш доступним та інтуїтивно зрозумілим, спрощуючи виконання завдань як для звичайних користувачів, так і для професіоналів у сфері програмування та інших галузях.

No votes yet.
Please wait...

Leave a Reply

Your email address will not be published. Required fields are marked *