LIVE
Новость

Почему OpenAI и Google делают ставку на естественный синтез речи в новых ИИ-моделях

OpenAI и Google одновременно сфокусировались на голосовом направлении, сообщает Crypto Briefing: компании обновляют свои речевые модели, чтобы они звучали менее роботизированно и больше походили на стиль общения коллег по работе.

Яков Новиков·обновлено 10 августа 2026 г.

Почему OpenAI и Google делают ставку на естественный синтез речи в новых ИИ-моделях

Сдвиг подтверждается и в русскоязычном сегменте — по данным prospect.com.ru, обе корпорации пришли к выводу, что развитие ИИ теперь идёт через голосовой интерфейс, а не через текст. Для рынка разговорных систем это сигнал смены приоритетов в распределении инженерных ресурсов крупнейших вендоров.

Что меняется в продуктовом флоу

Голосовые ассистенты исторически проигрывали текстовым по метрикам успешного завершения диалога: пользователи прерывали сессии на этапе уточнения, не дожидались ответа, фиксировали высокую latency. Апгрейды моделей OpenAI и Google, как отмечается в заголовках профильных источников, нацелены на сокращение этого разрыва — натуральность интонации и просодии напрямую влияет на то, готов ли пользователь довести голосовой сценарий до целевого действия. Для продакт-менеджеров разговорных систем это означает пересмотр edge-кейсов: чем убедительнее звучит синтез, тем выше ожидания к распознаванию намерений и удержанию контекста при длинных диалогах.

Что отслеживать дальше

Поскольку первоисточники пока доступны только в виде заголовков и кратких анонсов, конкретных технических параметров — архитектуры моделей, метрик MOS, изменений в latency — в открытых публикациях не приводится. Практический следующий шаг: дождаться развёрнутых материалов с подтверждёнными цифрами и проверить, как обновлённые голосовые движки поведут себя на собственных тестовых сценариях — особенно в кейсах, где ранее фиксировались галлюцинации или обрывы диалога.