Голос, который слушает и говорит одновременно
8 июля 2026 года OpenAI представила GPT-Live — новое поколение голосовых моделей с full-duplex архитектурой: модель одновременно слушает и говорит. В разговоре возможны короткие подтверждения вроде «угу» или «да», быстрый обмен репликами и паузы, когда пользователь обдумывает ответ. Для поиска, более глубокого рассуждения и сложных задач GPT-Live делегирует работу топовой модели в фоне и возвращает результат прямо в живой диалог — на запуске за это отвечает GPT-5.5.

Отличие от прежней архитектуры
Вместо каскадного конвейера «речь в текст → языковая модель → текст в речь» или пошагового режима Advanced Voice Mode, непрерывная full-duplex архитектура принимает решения много раз в секунду: говорить, слушать, прерваться, вызвать инструмент. Отдельно выделен слой делегирования — живое общение не блокируется фоновой работой модели.
Доступные варианты и качество
На старте доступны два варианта: GPT-Live-1 и GPT-Live-1 mini, раскатка идёт глобально для ChatGPT. Доступ через API заявлен как «скоро», с формой ожидания. В прямых сравнениях с участием людей продолжительностью 5–10 минут оба варианта предпочтительнее Advanced Voice Mode по общему впечатлению, естественности передачи очереди говорящего, обработке прерываний и плавности разговора. GPT-Live-1 существенно сильнее AVM на бенчмарках GPQA, BrowseComp и внутреннем τ³-Voice Telecom.
Масштаб использования и безопасность
Более 150 миллионов человек в неделю используют голосовой режим и функцию диктовки. Новые возможности: обновлённые 9 голосов, уровни Instant, Medium и High, лучшая устойчивость к шуму, естественное ожидание при паузах, визуальные карточки для погоды, акций, спорта и другой информации. По-прежнему работают поиск, память, изображения и загрузка файлов. По безопасности: аудио-нативные и синтетические оценки на темы самоповреждения, психоза и мании, эмоциональной зависимости, насилия и сексуального контента, тестирование red team, управление разговором и его остановка в реальном времени, родительский контроль для подростков, только заранее заданные голоса без имитации реальных людей. 31 июля 2026 года в поддерживаемое аудио добавили водяной знак SynthID и инструмент проверки подлинности. Доступ — на iOS, Android и ChatGPT.com; GPT-Live-1 по умолчанию для тарифов Go, Plus и Pro, mini — для Free. На запуске нет поддержки голоса с видео или демонстрацией экрана — эти режимы пока сохраняются в старых версиях Standard и Advanced Voice.
Бенчмарки и цены на старте
На бенчмарке GPQA — научные рассуждения уровня выпускников — GPT-Live-1 в режиме High набрал 84,2% против 45,3% у Advanced Voice Mode, почти двукратный рост. На BrowseComp, бенчмарке агентного веб-поиска, разрыв ещё больше: 75,2% против 0,7% у предыдущей архитектуры.
По доступу и цене: бесплатный тариф ChatGPT получает GPT-Live-1 mini без доплат, а полная модель GPT-Live-1 включена в тарифы Go ($8 в месяц), Plus ($20 в месяц) и Pro (от $100 в месяц) — без отдельной подписки за голос, платы за сообщение или пакетов кредитов. Для API дата и цены пока не объявлены: OpenAI собирает заявки через форму ожидания.
Бенчмарк | Advanced Voice Mode | GPT-Live-1 (High) |
|---|---|---|
GPQA | 45,3% | 84,2% |
BrowseComp | 0,7% | 75,2% |
Официальные источники
Факты проверены 2 августа 2026 г.














