OpenAI різко посилює фокус на аудіо та голосовій взаємодії. Компанія перебудовує свої команди й моделі, готуючись до запуску персонального пристрою, де звук стане головним інтерфейсом, а екран – необов’язковим.
За останні два місяці OpenAI об’єднала кілька інженерних, продуктових і дослідницьких команд для масштабного оновлення аудіомоделей. Мета значно ширша, ніж просто «зробити ChatGPT приємнішим на слух». Усередині компанії ці зміни пов’язують із підготовкою до презентації нового персонального пристрою з акцентом на аудіо, яку очікують приблизно за рік.
Такий крок добре вписується у загальний вектор індустрії. Технологічні компанії дедалі частіше уявляють майбутнє без постійної прив’язаності до екранів, де голос і слух стають основними каналами взаємодії з цифровим світом.
Meta вже показала, як це може виглядати на практиці. Її смартокуляри Ray-Ban отримали функцію з масивом із п’яти мікрофонів, яка допомагає вирізняти голоси у шумному середовищі. По суті, обличчя користувача перетворюється на спрямований слуховий пристрій.
Google у червні почала експериментувати з Audio Overviews – функцією, що перетворює результати пошуку на розмовні аудіорезюме. Tesla пішла ще далі, інтегруючи чат-бота Grok від xAI у свої автомобілі. Йдеться про голосового асистента, який може підтримувати природний діалог і керувати всім – від навігації до клімат-контролю.
На цьому тлі OpenAI не виглядає винятком. Поряд із гігантами ринку з’являються й стартапи, які роблять ставку на аудіо як на універсальний інтерфейс. Формати різні, успіх – неоднорідний, але логіка спільна: взаємодія з технологіями поступово виходить за межі екрана.
За наявною інформацією, нова аудіомодель OpenAI, реліз якої очікують на початку 2026 року, має звучати значно природніше за нинішні рішення. Вона зможе реагувати на перебивання, як живий співрозмовник, і навіть говорити одночасно з користувачем – те, чого теперішні моделі не вміють.
Паралельно в компанії нібито розглядають створення цілої лінійки пристроїв. Це можуть бути окуляри або «розумні» динаміки без екранів, які позиціонуються не просто як інструменти, а як постійні компаньйони.
У цій стратегії простежується і вплив дизайнерського підходу. Після того як OpenAI у травні придбала компанію LoveFrom за 6,5 мільярда доларів, до апаратного напряму приєднався колишній головний дизайнер Apple Джоні Айв. Як зазначається, він давно вважає зменшення залежності від гаджетів однією зі своїх ключових цілей і бачить в аудіо-першому дизайні шанс виправити помилки попередніх поколінь споживчих пристроїв.
Якщо ці плани реалізуються, голос може стати не доповненням до інтерфейсу, а його основою – у домі, в автомобілі і навіть просто на обличчі користувача.








Коментарі