OpenAI представила GPT-Live с архитектурой Full-Duplex
D@data_secretsAI-инженер
1 месOpenAI выпустила GPT-Live — голосовой режим нового поколения с поддержкой Full-Duplex для естественного общения в реальном времени.
OpenAI выпустили GPT-Live – голосовой режим нового поколения
(Вообще-то релиз случился еще вчера, но Grok-4.5 немного его затмил)
Итак, что мы имеем:
— Модель научили слушать и говорить одновременно. Даже в Advanced Voice Mode это был все еще обмен репликами по очереди, но теперь общение ощущается как живой разговор (особенно, если вы говорите с моделью по английски). Мы потестили на синхронном переводе, и звучит действительно хорошо.
— Архитектуру заменили на Full-Duplex. Это значит, что вместо последовательности «юзер -> обработка -> ответ» модель теперь слушает, обновляется и думает одновременно. В частности, раз в несколько секунд она принимает решение: продолжать слушать, перебить,
вызвать инструмент и тд.
— Если запрос сложный, система умеет перенаправлять вопрос GPT-5.5 (при этом разговор естественно поддерживается, пока ответ подготавливается).
Новый режим (+ новые голоса) можно попробовать уже сегодня. На бесплатный тариф раскатывают GPT-Live-1 mini, остальным уже должна быть доступна GPT-Live-1.
Видео и демонстрации экрана пока нет, и некоторые языки звучат с заметным акцентом, но разработчики обещают все это постепенно исправить.
https://openai.com/index/introducing-gpt-live/
Кратко (AI)
OpenAI анонсировала GPT-Live, новый голосовой режим с архитектурой Full-Duplex, позволяющий модели слушать и говорить одновременно. Система способна перебивать пользователя, вызывать инструменты и перенаправлять сложные запросы на GPT-5.5, обеспечивая более естественный диалог.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖