OpenAI запускает GPT-Live-1 в API для голосовых приложений
Что произошло: OpenAI запустила модель GPT‑Live‑1 в API — естественный голосовой модель для приложений и бизнес-процессов, способная одновременно слушать и говорить.
Суть: GPT‑Live‑1 объединяет распознавание и синтез речи в одной модели, избавляя от задержек и хрупких переходов между STT, LLM и TTS. Она умеет обрабатывать перебивания, делегировать рассуждения и вызовы инструментов бэкенд-моделям, а также настраивать тон, темп и стиль общения через системный промпт. В ранних тестах Speak перебивания сократились почти на 80% по сравнению с предыдущими turn-based системами, а Full Duplex Bench улучшился на 30 п.п. относительно GPT‑Realtime‑2.1. Модель доступна в API по цене $0.05 за минуту для фронтенд-голосового слоя.