Financial Times пишет, что Google и OpenAI делают ставку на то, что… — Битубитех от Яндекса — TG.ME

Financial Times пишет, что Google и OpenAI делают ставку на то, что через несколько лет говорить с ИИ станет привычнее, чем печатать. То есть клавиатура постепенно превращается из основного интерфейса в переходный.

👀 Что случилось? 

OpenAI в июле 2026-го выпустила семейство голосовых моделей GPT-Live — первое крупное обновление голосового движка за два года. Модели способны «слушать» и «говорить» одновременно, обрабатывая речь напрямую, без перевода в текст. Голосовым режимом ChatGPT уже пользуются свыше 150 млн человек в неделю. По данным СМИ, компания также разрабатывает собственное устройство — умную колонку с камерой, микрофоном и динамиком.

Google развивает голосовой режим в своих продуктах и AI Mode в поиске: голос и изображения теперь задействованы в каждом шестом запросе в США. За год число пользователей голосового режима удвоилось, а разговоры в среднем стали в 5 раз длиннее переписки. В компании делают ставку на «живую», спонтанную манеру речи моделей, чтобы пользователи быстрее привыкали общаться голосом.

Meta, запрещенная в РФ, делает голос основным интерфейсом для своих носимых устройств — в первую очередь AI-очков, где говорить намного удобнее, чем печатать. Ставка на голос здесь встроена в общую стратегию по продвижению умных гаджетов как повседневного канала связи с ИИ. 

Параллельно растёт и рынок голосовых стартапов: в I квартале 2026 года они привлекли около $7 млрд против менее $1 млрд годом ранее. На этом фоне активно развиваются диктофоны, голосовые кольца и другие гаджеты для постоянного взаимодействия с ИИ. 


👉 Почему именно сейчас?

Раньше голосовые ассистенты работали в три этапа: речь → текст → обработка → снова речь. В процессе возникали задержки, потеря контекста и «механические» ответы. Новые модели обрабатывают речь напрямую, без промежуточного перевода в текст, учитывая интонации и паузы. В результате разговор с ИИ стал более осмысленным и релевантным.

🔍 В чём плюс для бизнеса?

Ниже порог входа. Не нужно уметь формулировать промпт — можно просто объяснить ИИ задачу, как коллеге. Голос точнее передаёт контекст. Устно проще описать ограничения, ошибку и ожидаемый результат.

Растёт удержание пользователя. Как только ассистент встраивается в ежедневную рутину, переключиться на другую платформу становится сложнее. Это значит, что ценность голосового канала как точки контакта с клиентом становится выше.

📌 Какие есть риски?

🔴 Пока качество распознавания нестабильное. Например, голосовые ассистенты пока ещё неидеально работают в шумной среде. 

🔴 Когда пользователи слышат уверенно звучащую речь, то воспринимают её менее критично, чем письменную. Это может быть особенно критично в финансах, праве, медицине.

🔴 «Прослушка» 24/7 ставит под угрозу приватность и безопасность чувствительных данных. 


📷 Что делать?

Закладывать голосовой интерфейс в продукт с самого начала, тестируя голосовые сценарии в техподдержке, онбординге, работе с документами и кодом. Это особенно актуально для клиентского сервиса, здравоохранения, недвижимости, гостеприимства — там, где голос наиболее органичен.

Подписывайтесь 👉 @yab2btech и поддержите наш канал по ссылке.
❤10👍6👀5
August 18, 2026 1.4K 6