OpenAI запускает GPT-Live с более естественными диалогами и умным голосом ChatGPT [Видео]
Опубликовано , автор Shalom Levytam
OpenAI представила GPT-Live — голосовые модели нового поколения, созданные для того, чтобы общение с ChatGPT стало гораздо больше похоже на живой разговор. Система, которая начинает развертываться по всему миру сегодня, использует архитектуру полнодуплексной связи, способную слушать и говорить одновременно, не дожидаясь, пока каждый собеседник закончит фразу, что делает беседу более естественной.
В отличие от предыдущих пошаговых или каскадных моделей, GPT-Live непрерывно обрабатывает входящие данные во время генерации ответа, многократно в секунду принимая решения о том, следует ли говорить, молчать, сделать паузу, перебить или продолжать слушать. По заявлению OpenAI, это позволяет ассистенту естественным образом реагировать на ваши слова фразами вроде «угу» или «понятно», выдерживать паузу вместо того, чтобы слишком быстро вступать в разговор, и лучше концентрироваться на вашем голосе в шумной обстановке. Компания также полностью переработала все девять встроенных голосов ChatGPT для новой системы.
GPT-Live также является самой умной голосовой моделью OpenAI на сегодняшний день. Для сложных вопросов, требующих поиска в Интернете или более глубоких рассуждений, она незаметно для пользователя делегирует задачи новейшей передовой модели — в настоящее время это GPT-5.5 — и возвращает результаты в диалог по готовности. Пока задача выполняется, модель может продолжать свободную беседу. На момент запуска GPT-Live-1 станет голосовой моделью по умолчанию для подписчиков Go, Plus и Pro, в то время как более компактная версия GPT-Live-1 mini будет обеспечивать работу функции ChatGPT Voice для пользователей бесплатной версии.
Новый интерфейс также поддерживает наглядные карточки с прогнозом погоды, котировками акций и спортивными результатами, позволяет осуществлять синхронный перевод и сохраняет поддержку поиска, памяти, изображений и загрузки файлов прямо во время разговора. В OpenAI отмечают, что GPT-Live создана для общения, а не для имитации голоса, и включает специальные средства защиты для пользователей-подростков, защиту от вредоносного контента и системы, способные вмешиваться в режиме реального времени при обнаружении небезопасных ответов.
Запуск происходит на фоне того, как Apple расширяет поддержку сторонних голосовых ассистентов. Apple добавила поддержку CarPlay для разговорных ИИ-приложений, таких как ChatGPT и Gemini, в iOS 26.4, позволив этим приложениям интегрироваться с бортовым интерфейсом автомобиля. На момент запуска GPT-Live пока не поддерживает голосовое общение с использованием видео или демонстрации экрана в ChatGPT, однако эти функции остаются доступными в прежних режимах Standard и Advanced Voice, пока OpenAI работает над их интеграцией в GPT-Live.
Ознакомьтесь с видео ниже, чтобы узнать подробности…