Новости

OpenAI показала GPT-Live: голосовой ИИ, который слушает и говорит одновременно

Из голосового режима ChatGPT убрали детектор конца реплики — модель работает в полном дуплексе, поэтому паузы перестали быть заметными.

Дэми Авалонов основатель NeiroAI обновлено 8 августа 2026 1 мин чтения
OpenAI показала GPT-Live: голосовой ИИ, который слушает и говорит одновременно

OpenAI опубликовала разбор GPT-Live — третьего поколения своей голосовой системы, которое уже работает в ChatGPT Voice. Главное изменение архитектурное: из звукового тракта убрали детектор конца реплики.

Почему это заметно на слух

Раньше голосовые ассистенты работали по очереди: маленькая модель-детектор угадывала, договорил ли человек, и только потом за дело бралась большая языковая модель. Ошибка в любую сторону портила разговор — либо ассистент перебивал на середине фразы, либо отвечал с задержкой.

Голосовая модель GPT-Live работает в полном дуплексе: слушает и говорит одновременно, поэтому отдельный детектор ей не нужен. Когда для ответа требуется серьёзное рассуждение или вызов инструментов, система обращается к старшим моделям вроде GPT-5.5 — по отдельному асинхронному пути, не прерывая разговор.

Что это значит на практике

Для пользователя разница не в качестве текста, а в ритме: разговор перестаёт быть обменом репликами через паузу. На этой же архитектуре построены новые возможности десктопного приложения ChatGPT — управление компьютером голосом и координация агентов.

Для тех, кто делает собственные голосовые сценарии, важна ещё одна деталь: OpenAI отделила голосовой тракт от логики приложения, так что поведение сервиса можно менять, не задевая отзывчивость. Систему разрабатывали шесть месяцев, публикация — инженерный разбор, а не анонс новой подписки.

Ограничения доступа из России не изменились: официально ChatGPT в РФ по-прежнему недоступен. Что умеет сервис и сколько стоит — в карточке Chat GPT.

Источник: OpenAI

Упомянутые инструменты

Не пропускать важное

Заведите кабинет: добавьте нейросети, которыми пользуетесь, — и получайте только то, что касается именно их. Цены, тарифы, доступность из России, письмо перед списанием. Бесплатно.

Создать кабинет Войти

Читать дальше

Новости вчера ElevenLabs выпустила Eleven v4 и Turbo-версию с задержкой около 100 мс ElevenLabs обновила флагманскую линейку синтеза речи: Eleven v4 даёт более выразительный звук и точнее клонирует голос на 90+ языках, а Eleven v4… Новости 29 сентября 2026 Hcompany открыла веса ИИ-агента Holo4 — управляет экраном, кодом и API одной моделью Стартап Hcompany выложил в открытый доступ веса ИИ-агентов Holo4 — моделей, которые управляют компьютером через экран, код, MCP-серверы и API без переобучения… Новости 28 сентября 2026 GitHub добавил Copilot локальные песочницы: агент не тронет файлы и сеть без разрешения GitHub включил в приложение Copilot локальные песочницы: агент по умолчанию не сможет трогать файлы, сеть и учётные данные вне заданных разработчиком правил.… Новости 28 сентября 2026 Google добавила в Gemini 3.8 Live анимированные аватары — с синхронизацией на 97 языков Google выпустила надстройку Live Avatar для голосовой модели Gemini 3.8 Live: реалистичный анимированный собеседник с синхронизацией губ и мимики на 97 языках.…