toolcall.
Инструменты8 июл. 2026 г., 12:00 UTCОбновлено 1 ч назад

OpenAI делает голос более агентным через GPT-Live

Новая голосовая архитектура слушает и отвечает непрерывно, а сложные задачи отдаёт frontier-моделям в фоне.

Редакционная иллюстрация AI-интерфейсов для запуска голосового агента

OpenAI 8 июля представила GPT-Live — новую версию голосового опыта в ChatGPT. Компания подаёт это как переход от пошагового voice assistant к более непрерывному разговору.

Что изменилось #

GPT-Live построен на full-duplex interaction: система может слушать и говорить одновременно, решать, когда сделать паузу, и естественнее обрабатывать перебивания. OpenAI говорит, что голосовой слой может сохранять разговорный поток, пока более сложный вопрос уходит в сильную frontier-модель в фоне.

Rollout начинается с GPT-Live-1 и GPT-Live-1 mini для пользователей ChatGPT; API обещают позже. Также ChatGPT Voice сможет показывать визуальные карточки по некоторым темам прямо во время разговора.

Почему это важно #

Голос становится интерфейсом для агентов, а не просто удобным микрофоном для чата. Если делегирование сработает, пользователь сможет просить о более сложной работе, не превращая живой разговор в ожидание ответа. Это важно для поддержки, обучения, hands-free задач и сценариев, где человек не может всё время смотреть в экран.

Источники

Упоминаются

agentsdeveloper-tools