toolcall.
Инструменты13 сент. 2026 г., 20:31 UTC

OpenAI вывела GPT-Live-1 для голосовых агентов в API

Full-duplex модель может слушать и говорить одновременно, обрабатывать перебивания и передавать сложные задачи backend-моделям.

OpenAI выпустила GPT-Live-1 в API, открыв разработчикам доступ к full-duplex голосовой модели для приложений, телефонных агентов и бизнес-процессов.

Практическое отличие в архитектуре. Вместо связки speech-to-text, reasoning-модели и text-to-speech GPT-Live-1 обрабатывает слушание и речь в одной модели. OpenAI говорит, что это улучшает работу с перебиваниями, паузами, фоновым шумом и длинными сессиями.

Модель также может передавать более сложное рассуждение и tool calls backend-моделям или сторонним системам. То есть голосовой агент может продолжать разговор, пока другая модель занимается расписанием, поддержкой, поиском данных или сложной задачей.

OpenAI утверждает, что в ранних тестах со Speak количество перебиваний снизилось почти на 80% по сравнению с прежними turn-based системами. Компания также заявляет, что GPT-Live-1 улучшает результат Full Duplex Bench на 30 процентных пунктов относительно GPT-Realtime-2.1 и поддерживает телефонные сценарии для поддержки, бронирований и других голосовых процессов.

Для разработчиков релиз важен потому, что голосовые агенты переходят от демо к продакшену. Сложность уже не только в естественной речи, а в том, чтобы оставаться отзывчивыми, пока за разговором работают инструменты, память и бизнес-системы.

Источники

Упоминаются

APIagentsdeveloper-toolsopenaivoice-ai