OpenAI объявила о запуске GPT-Live — нового поколения голосовых моделей для ChatGPT Voice. Компания позиционирует ее как самую продвинутую голосовую модель OpenAI на данный момент: она умеет одновременно слушать пользователя и говорить, а сложные задачи передает более мощной модели GPT-5.5 в фоновом режиме.

Раскатка уже началась по всему миру для пользователей ChatGPT на iOS, Android и ChatGPT.com. При этом доступ через API пока не открыт, хотя OpenAI заявляет, что планирует добавить его в ближайшее время.

Что изменилось в голосовом режиме ChatGPT

Вместе с запуском OpenAI представила две модели: GPT-Live-1 и GPT-Live-1 mini. Они стали базой для обновленного режима ChatGPT Voice — голосовой функции внутри чата, где можно говорить с ИИ, читать ответы, переключаться на текстовый ввод и просматривать историю диалога.

Ключевое отличие GPT-Live — полнодуплексная архитектура. Это означает, что модель может воспринимать речь собеседника и формировать ответ одновременно, а не ждать полной паузы в разговоре. За счет этого диалог становится ближе к обычному человеческому общению.

  • модель может начинать отвечать без длинной паузы после фразы пользователя;
  • поддерживает короткие сигналы вовлеченности вроде «угу» или «да»;
  • умеет быстро обмениваться репликами или, наоборот, выдерживать паузу, если собеседнику нужно время подумать.

По данным OpenAI, именно эти особенности делают ChatGPT Voice более естественным в использовании и приближают формат общения с ИИ к реальному разговору.

Как GPT-Live работает со сложными запросами

Если запрос требует поиска в интернете, более глубокого рассуждения или сложной обработки, GPT-Live передает его в фоновом режиме более продвинутой модели. На старте для этого используется GPT-5.5.

При этом разговор не прерывается: голосовая модель может продолжать общение, пока фоновая система обрабатывает задачу. Когда результат готов, ответ возвращается в текущий диалог. OpenAI уточняет, что в будущем будет обновлять фоновую модель по мере выхода новых флагманских систем.

Какие версии и где доступны

Запуск распределен по тарифам ChatGPT:

  • GPT-Live-1 — модель по умолчанию в ChatGPT Voice для планов Go, Plus и Pro;
  • GPT-Live-1 mini — версия по умолчанию для бесплатного плана Free.

Сервис уже разворачивается глобально на мобильных платформах и в веб-версии. API-доступа пока нет, поэтому напрямую встроить GPT-Live в собственные продукты, колл-центры, чат-боты или маркетинговые сценарии через OpenAI API сейчас нельзя.

Голоса и языки

Пользователям доступны девять голосовых режимов с разной манерой общения: Arbor, Vale, Ember, Juniper, Sol, Breeze, Maple, Spruce и Cove. Они различаются по тону — от более энергичного и разговорного до спокойного и лаконичного.

OpenAI также отмечает, что GPT-Live оптимизирована для ряда самых популярных языков в ChatGPT. Для части других языков возможны иностранный акцент и менее естественная беглость речи. Компания обещает дорабатывать качество мультиязычного опыта.

Что это значит для российского рынка

Для российских маркетологов, агентств и владельцев бизнеса новость важна прежде всего как сигнал о дальнейшем смещении интерфейсов в сторону голосового общения с ИИ. Даже если GPT-Live пока недоступна через API, сам подход OpenAI показывает, каким будет следующий этап пользовательского поведения: меньше формальных запросов, больше живых диалогов, уточнений и многосоставных вопросов в одном сеансе.

Это влияет на работу с контентом и поиском в Google и Яндексе. Если аудитория привыкает формулировать запросы голосом, растет значение разговорных формулировок, длинных хвостов, страниц с прямыми ответами и контента, который хорошо закрывает уточняющие вопросы. Для SEO это дополнительный аргумент в пользу проработки FAQ-блоков, естественного языка и сценариев, где пользователь задает вопрос не «ключом», а обычной фразой.

Для PPC-специалистов и контент-команд это также ориентир на новые форматы креативов и посадочных страниц: пользователи все чаще ожидают не просто выдачу информации, а диалоговую помощь, быстрые пояснения и пошаговые ответы.

На практике запуск GPT-Live пока важнее как продуктовый ориентир, чем как готовый канал внедрения. Но бизнесу, который работает с поддержкой, продажами, обучающим контентом и сложными консультациями, уже стоит учитывать, что голосовые ИИ-интерфейсы становятся заметно ближе к естественному разговору.

Вывод: OpenAI сделала ChatGPT Voice более «живым» и приблизила голосовое общение с ИИ к обычному диалогу. Для рынка это сигнал готовить контент, сценарии коммуникации и пользовательский опыт к росту разговорных и голосовых форматов — в том числе в экосистемах Google и Яндекса.

Совет эксперта Analito

Проверьте, как ваш контент отвечает на разговорные и длинные голосовые запросы: добавьте FAQ-блоки, естественные формулировки вопросов и короткие прямые ответы на ключевых страницах.

Если работаете с SEO под Яндекс и Google, расширьте семантику фразами из живой речи, а не только короткими ключами. Особенно это важно для услуг, обучения, медицины, финансов и B2B с длинным циклом выбора.

Для команд поддержки и продаж стоит заранее описать сценарии, где голосовой ИИ сможет быть полезен: консультации, первичный брифинг, ответы на типовые вопросы, навигация по продукту. Когда API-доступ появится, такие сценарии будет проще быстро протестировать.

Частые вопросы

Можно ли уже подключить GPT-Live в свой сервис через API?

Пока нет. OpenAI сообщила, что API-доступ еще не открыт, но его планируют запустить позже.

Чем GPT-Live отличается от обычного голосового режима?

Главное отличие — одновременное восприятие речи и генерация ответа. За счет этого диалог идет без длинных пауз и больше похож на живой разговор.

Почему эта новость важна SEO-специалистам и маркетологам в России?

Она показывает сдвиг к разговорным и голосовым сценариям поиска и взаимодействия с ИИ. Это усиливает значение контента, который отвечает на естественные вопросы пользователей и хорошо закрывает уточняющие интенты.