OpenAI запустила GPT-Live-1 — голосовой ИИ, который разговаривает как человек
Новое поколение голосового взаимодействия
OpenAI объявила о запуске GPT-Live — нового поколения голосовых моделей, которые делают общение с искусственным интеллектом более похожим на естественный разговор. Как заявляют разработчики, это самая умная голосовая модель в истории компании. 
Полнодуплексная архитектура
В отличие от предыдущих решений, GPT-Live-1 работает на основе полнодуплексной архитектуры. Это означает, что система может слушать и говорить одновременно. Модель непрерывно обрабатывает входящие данные, одновременно генерируя ответы. Такой подход позволяет принимать решения о взаимодействии много раз в секунду: говорить, продолжать слушать, делать паузу, прерывать или вызывать инструменты.
«Это означает, что она может говорить и слушать одновременно... Она способна непрерывно обрабатывать поток входных данных и также непрерывно и одновременно с этим выдавать поток выходных данных», — пояснил Атти Элети, руководитель отдела продуктов OpenAI.
Естественное общение и интеллект
GPT-Live-1 способен показывать, что внимательно слушает, используя фразы вроде «угу», «да» или «понял». Модель не перебивает пользователя, выжидая паузы и корректно реагируя на естественные вспышки тишины или фоновые шумы. Если вопрос требует глубоких рассуждений, поиска в интернете или выполнения сложных задач, GPT-Live-1 передает его в фоновом режиме модели GPT-5.5, продолжая поддерживать ход беседы.
Версии и доступность
8 июля 2026 года компания начала развертывание двух версий GPT-Live. GPT-Live-1 доступен для пользователей ChatGPT с подписками Go, Plus и Pro в приложениях на iOS и Android, а также в веб-версии. GPT-Live-1 mini предназначен для бесплатных пользователей.
Разработчики сообщают, что в будущем модели станут доступными через API. По мере выпуска новых передовых моделей, такие как GPT-5.5, система будет постоянно обновляться, поддерживая последние достижения в области искусственного интеллекта. 
Полнодуплексная архитектура открывает новые возможности для перевода в реальном времени: теперь система может переводить речь одновременно с ее прослушиванием, не ожидая завершения реплики пользователя. 