Анонс легко создаёт впечатление, что модель уже доступна, хотя разработчики ещё не могут вызывать её из своего кода. С GPT-Live-1 ситуация именно такая: на публичной странице OpenAI для API по-прежнему предлагают оставить контакты, чтобы получить уведомление о доступности модели, тогда как для документированного Realtime API уже опубликованы тарифы. Вывод простой: не закладывайте GPT-Live-1 в продакшен-бюджет и не начинайте интеграцию, пока OpenAI не опубликует идентификатор модели, endpoint, документацию и тарифную сетку.
Короткий ответ
В проверенных мной материалах OpenAI GPT-Live-1 не представлен как общедоступный API для разработчиков. Страница GPT-Live-1 API у OpenAI — это форма для уведомлений, а не справочник API: на ней нет endpoint, идентификатора модели, цен, лимитов или даты запуска.
Это не доказывает, что частного доступа не существует. Но публичный разработчик не может считать пост в соцсетях или голосовой режим ChatGPT полноценным контрактом вызываемого API.
Если голосовое приложение нужно запустить в продакшен уже сейчас:
| Задача | Практичный выбор |
|---|---|
| Запустить документированный realtime-голосовой API сейчас | GPT-Realtime-2.1 |
| Снизить расходы на аудио и текстовые токены | GPT-Realtime-2.1 mini |
| Подготовить прототип к будущей смене модели | Вынести идентификатор модели и цены в конфигурацию |
| Нужен именно GPT-Live-1 | Подписаться на уведомления; не обещать дату запуска |
Цена GPT-Live-1 для API пока не опубликована
На проверенной странице OpenAI сказано: «Подпишитесь, чтобы получить уведомление, когда GPT‑Live‑1 станет доступен в API». При этом там нет цены за минуту, стоимости аудиотокенов и текстовых токенов, минимального платежа или лимитов использования. Поэтому честный ответ о цене GPT-Live-1 для API — неизвестно. Это точно не $0.05 за минуту и не любая оценка, скопированная из тарифов другой realtime-модели.
Подписка ChatGPT относится к другому продукту. Тариф Plus или Pro может включать голосовой режим для пользователей, но автоматически не предоставляет кредиты API. Считайте подписку и расходы на API отдельными статьями бюджета.
Что можно купить и собрать уже сегодня
На документированной странице модели GPT-Realtime опубликованы тарифы, зависящие от количества токенов. Ниже приведены ставки из материалов исследования для актуального семейства Realtime; перед запуском ещё раз проверьте официальную страницу, поскольку цены могут меняться.
| Модель | Текстовый ввод / кэшированный ввод | Текстовый вывод | Аудиоввод / кэшированный ввод | Аудиовывод | Контекст / макс. вывод |
|---|---|---|---|---|---|
| GPT-Realtime-2.1 | $4 / $0.40 за 1M | $24 за 1M | $32 / $0.40 за 1M | $64 за 1M | 128k / 32k |
| GPT-Realtime-2.1 mini | $0.60 / $0.06 за 1M | $2.40 за 1M | $10 / $0.30 за 1M | $20 за 1M | 128k / 32k |
Согласно изученным материалам о статусе API, обе модели принимают текст, аудио и изображения, а на выходе выдают текст и аудио; поддержка видео не заявлена. Стандартная модель безопаснее, если важны сложное рассуждение или вызов инструментов. Mini стоит выбирать, когда цена и задержка важнее максимальных возможностей.
Ключевой момент в биллинге: входящие и исходящие данные считаются отдельно. Пятиминутный разговор не означает автоматически пять минут пользовательского аудио плюс пять минут аудио ассистента. Измеряйте фактическое время речи каждой стороны.
Соберите бюджет, устойчивый к смене модели
Пока для GPT-Live-1 нет тарифной сетки, используйте сценарную модель, а не выдуманную усреднённую цену:
monthly exposure = sessions
× measured billable usage per session
× provider rate
× retry and tool-call factors
В каждом пилоте фиксируйте следующие показатели:
- Секунды речи пользователя и ассистента — раздельно.
- Токены текстового ввода, кэшированного ввода и текстового вывода.
- Ходы диалога, вызовы инструментов, неудачные вызовы, повторы и переподключения.
- Продолжительность сессии, периоды тишины, брошенные сессии и пиковое число одновременных подключений.
- Трафик на запасные сценарии — например, текстовый режим или более компактную модель.
Для предварительного расчёта можно взять 500 минут входящего и 500 минут исходящего аудио, но конверсию аудиотокенов в минуты обязательно пометить как допущение. Точный бюджет нужно строить по данным об использовании, которые возвращает API, а не по универсальному пересчёту минут в калькуляторе.
До запуска пилота установите жёсткий лимит длительности сессии, ограничение на вызовы инструментов, уведомление о расходах и аварийный выключатель. После обрыва сети голосовой агент может переподключиться и продолжить расходовать ресурсы, не решив задачу клиента, поэтому формулировка «разумное использование» не заменяет финансовый контроль.
FAQ о GPT-Live-1 API
Форма уведомлений даёт доступ к GPT-Live-1 API?
Нет. Публичная форма собирает контактные и деловые данные, чтобы OpenAI мог уведомить заинтересованных разработчиков. В ней нет API-ключа, идентификатора модели, endpoint, договора с тарифами или гарантированного участия в бета-тестировании.
Можно оплатить API через ChatGPT Plus или Pro?
Нет. Подписка ChatGPT и использование API оплачиваются отдельно. Пользовательский тариф выбирают для продукта ChatGPT, а вызовы API закладывают в бюджет по тарифам API.
GPT-Live-Transcribe — это то же самое, что GPT-Live-1?
Нет. Модель транскрибации переводит речь в текст. GPT-Live-1 обозначает разговорный голосовой сценарий. Цена минуты транскрибации неприменима к полнодуплексному агенту, который слушает, рассуждает, говорит и при необходимости вызывает инструменты.
Команде ждать или использовать Realtime уже сейчас?
Для продакшена уже сейчас используйте GPT-Realtime-2.1 или его вариант mini. Если модель взаимодействия GPT-Live-1 стратегически важна, спрячьте конфигурацию модели за адаптером. Тогда последующий переход потребует изменить настройки, а не переписывать всё приложение.
«Гораздо эффективнее надиктовать тот же промпт прямо в рабочем окне ChatGPT». — @pranavkrn, описывая замеченное им ограничение вызова инструментов голосом; оригинальный пост. Это пользовательский отзыв о работе ChatGPT, а не свидетельство существования недокументированного API.
Практическое решение
Самый понятный путь — запустить продукт на документированной модели Realtime, собирать данные по всем категориям, влияющим на стоимость, и оставить GPT-Live-1 в конфигурации как взаимозаменяемую целевую модель. Ждать имеет смысл только тогда, когда конкретное полнодуплексное поведение GPT-Live-1 — жёсткое требование продукта. В остальных случаях неопубликованные цена и endpoint создают вполне предотвратимые риски для сроков запуска и маржинальности.