AIREITER
openaiText Chat

GPT-6 Luna

Запускайте GPT-6 Luna онлайн и через API для суммаризации, извлечения данных и классификации за 30% от официальных тарифов OpenAI за токены. Контекст 1M токенов.

Входные TokenВводВыводЧтение кэшаСоздание кэша
≤ 271,999$0.03 za 1 mln tokenov$0.15 za 1 mln tokenov$0.003 za 1 mln tokenov$0.0375 za 1 mln tokenov
> 271,999$0.06 za 1 mln tokenov$0.225 za 1 mln tokenov$0.006 za 1 mln tokenov$0.075 za 1 mln tokenov

Цены за миллион токенов. Тариф применяется ко всему запросу по общему числу входных токенов, включая чтение и запись кэша.

Запустить через API

ВВОД

ВЫВОД

Example
Generated in
10.6 seconds
Входные Token
494
Выходные Token
204
Tokens per second
19.25 tokens / second
Time to first token
-

Сведения о модели

Используйте тот же ключ модели в Playground, запросах API и внутренних рабочих процессах.

ID модели
gpt-6-luna
Провайдер
openai
Протокол
OpenAI Chat Completions
Окно контекста
1,050,000 токенов
Максимальный вывод
128,000 токенов

Что можно делать с GPT-6 Luna

GPT-6 Luna — это быстрый и доступный уровень в семействе GPT-6. Есть четыре особенности, которые меняют подход к проектированию решений на ее основе, и ни одна из них не упоминается в маркетинговых материалах.

Выходные токены стоят в 5 раз дороже входных

$0,03 за 1M входных токенов против $0,15 за 1M выходных. Длинные промпты почти бесплатны; длинные ответы — нет. Ограничение максимального количества токенов ответа снижает расходы значительно сильнее, чем сокращение промпта.

Окно 1M с резким скачком цены на 272K

Контекстное окно составляет 1 050 000 токенов, но превышение 272K входных токенов пересчитывает весь запрос по тарифу 2x за вход и 1,5x за выход — а не только излишек. Промпт на 280K токенов стоит дороже, чем два по 140K.

Модель рассуждает перед тем, как ответить

В наших тестах первый потоковый токен появлялся через 5,0–5,6 секунды при общем времени ответа 7,2–7,4 секунды. Стриминг не скрывает эту задержку. Если вам нужно быстрее вывести текст на экран, снизьте уровень рассуждений (reasoning effort), а не лимит токенов ответа.

Структурированный вывод сохраняется без схемы

При запросе простым текстом четырех именованных полей в формате JSON модель вернула именно эти четыре ключа в блоке кода без схемы, вызова функций и повторных попыток. Пример выше — это оригинальный неотредактированный ответ.

Цены на GPT-6 Luna

AIReiter предлагает GPT-6 Luna по цене 30% от официальных тарифов API OpenAI. Тарифы ниже проверены по прайс-листу OpenAI от 23 сентября 2026 года; актуальные цены за токен указаны над песочницей.
01

Входные токены

$0,03 за 1M токенов против официальных $0,10 у OpenAI.

02

Выходные токены

$0,15 за 1M токенов против официальных $0,50 у OpenAI.

03

Чтение кэшированного ввода

$0,003 за 1M токенов против официальных $0,01 у OpenAI.

04

Тариф для длинного контекста

Для запросов объемом более 272K входных токенов действует надбавка OpenAI: 2x на вход и 1,5x на выход.

Сценарии использования GPT-6 Luna

Luna оправдывает себя везде, где главным ограничением является стоимость обработки одной записи. Приведенные ниже цифры взяты из тестового запуска в плейграунде: 494 входящих и 204 исходящих токена на один тикет.
01

Маршрутизация обращений в поддержку за $0,05 за 1 000 тикетов

Краткое содержание плюс критичность, область продукта, затронутая версия и приоритет — в рамках одного вызова на тикет. Бэклог в 50 000 тикетов обрабатывается примерно за $2,30.

02

Пакетное обогащение данных с кэшированным префиксом

Пакетные задачи повторяют одни и те же инструкции для каждой строки. Сохраняйте этот префикс побайтово идентичным, и повторяющаяся часть будет считываться по $0,003 за 1M вместо $0,03 — это в десять раз дешевле стоимости ввода для всего прогона.

03

Основной уровень за маршрутизатором

Отправляйте все запросы в Luna и эскалируйте только те, которые не прошли проверку. Поскольку Sol стоит примерно в 20 раз дороже, маршрутизатор, направляющий 95% трафика на Luna, обходится примерно в одну десятую стоимости пайплайна только на Sol — при этом 5% эскалированных запросов составят половину оставшегося счета.

04

Целые документы ниже порога в 272K

Отчеты, стенограммы и договоры помещаются в окно 1M, однако лучше удерживать объем запроса в пределах 272K входных токенов, чтобы избежать двойной наценки. Разделение на части ниже этого порога обычно обходится дешевле, чем один большой запрос.

Как использовать GPT-6 Luna

Luna создана для больших объемов данных, поэтому тестируйте ее так, как будете использовать в проде: на реальной записи и с теми настройками, которые можете позволить себе в масштабе.

01

Вставьте одну реальную запись

Используйте реальный тикет, расшифровку или документ вместо тестового промпта. Слабое место Luna — это неструктурированные входные данные, а не сложность логических рассуждений.

02

Оптимизируйте в сторону уменьшения

Начните с низкого уровня рассуждений (reasoning effort) и жесткого ограничения max completion tokens. Исходящие токены стоят в 5 раз дороже входящих, поэтому лимит вывода — это главный рычаг управления расходами.

03

Умножьте количество токенов

Возьмите данные об использовании токенов под ответом, умножьте на ваш ежедневный объем, и вы получите ежемесячную стоимость еще до написания кода интеграции.

Разработка с помощью GPT-6 Luna API

При пакетной интеграции важен не первый вызов, а десятитысячный: стоимость одной записи, поведение кэша и обработка ошибок в отдельной строке.

Простая замена ID модели

Укажите gpt-6-luna в существующем OpenAI-совместимом клиенте и больше ничего не меняйте. Стриминг, системные промпты и вывод в формате JSON работают точно так же, как и в оригинале.

Кэширование префиксов приносит реальную выгоду

Пакетные задачи повторяют одни и те же инструкции для каждой строки. Чтение из кэша стоит $0.003 за 1M токенов против $0.03 за новые входящие данные, поэтому стоит выстроить стабильный префикс промпта.

Учет затрат на каждый ответ

Каждый ответ содержит отчет о входящих, исходящих токенах, чтении из кэша и списанных кредитах, что позволяет пайплайну логировать юнит-экономику для каждой записи, а не узнавать ее постфактум из счета.

Переход на GPT-6 Sol без перенастройки инфраструктуры

Sol и Luna используют один эндпоинт, один ключ и общий баланс, поэтому перенаправление сложной строки на флагманскую модель требует лишь смены ID модели, а не отдельной интеграции.

GPT-6 Luna против GPT-6 Sol против GPT-5.6 Luna

Одна и та же задача для тикета службы поддержки — суммаризация плюс извлечение четырех полей, измеренная на AIReiter 23 сентября 2026 г.: 494 входящих и 204 исходящих токена, время выполнения 10.6 секунды на Luna. Модели отличаются по цене примерно в двадцать раз, а не по способности справиться с этой задачей.
01

GPT-6 Luna — около $0.05 за 1 000 тикетов

$0.03 за входящие и $0.15 за исходящие токены за 1M на AIReiter против официальных $0.10 и $0.50 от OpenAI. Самый доступный уровень GPT-6, который делает автоматизацию обработки записей экономически выгодной.

02

GPT-6 Sol — около $0.91 за 1 000 тикетов

$0.60 за входящие и $3.00 за исходящие токены за 1M, что примерно в 20 раз дороже Luna. Оправдано, когда задаче требуются флагманские рассуждения; излишне, когда задача сводится к извлечению данных, с которым Luna уже справляется отлично.

03

GPT-5.6 Luna — предыдущее поколение

Официальные $0.20 за входящие и $1.20 за исходящие токены за 1M. GPT-6 Luna вдвое снижает официальную стоимость ввода и более чем вдвое — стоимость вывода в том же сегменте экономичных моделей.

04

Как выбрать

Прогоните самую сложную запись через обе модели в плейграунде выше. Если ответ Luna вас устроит, 20-кратная разница в цене означает, что Sol должна доказать свою ценность на конкретной задаче, а не просто полагаться на репутацию.

Часто задаваемые вопросы о GPT-6 Luna

Частые вопросы об онлайн-playground, ценах и доступе через API.

/ 01

Когда стоит выбрать GPT-6 Luna?

Выбирайте Luna для больших объемов четко поставленных задач, таких как суммаризация, извлечение данных и классификация. Переходите на GPT-6 Sol только тогда, когда задаче требуются флагманские аналитические способности.

/ 02

Сколько стоит GPT-6 Luna на AIReiter?

AIReiter берет 30% от официальных тарифов OpenAI: $0.03 за 1 млн входных токенов и $0.15 за 1 млн выходных токенов по сравнению с официальными $0.10 и $0.50. Чтение кэшированного ввода стоит $0.003 за 1 млн.

/ 03

Чем GPT-6 Luna отличается от GPT-5.6 Luna?

GPT-6 Luna — это более новое поколение в том же экономичном сегменте, при этом официальная цена за ввод в два раза ниже, а за вывод — в пять раз ниже, чем у GPT-5.6 Luna.

/ 04

Каков размер контекстного окна?

GPT-6 Luna поддерживает около 1 млн входных токенов и до 128 тыс. выходных токенов. Запросы объемом более 272 тыс. входных токенов тарифицируются с коэффициентом 2x для ввода и 1.5x для вывода, согласно правилам самой OpenAI.

/ 05

Насколько быстра GPT-6 Luna?

На AIReiter запрос на суммаризацию и извлечение данных из тикета техподдержки объемом 494 токена вернул 204 выходных токена за 10.6 секунды без стриминга и за 7.2–7.4 секунды со стримингом. Обратите внимание, что Luna сначала рассуждает, прежде чем ответить: получение первого токена в потоке занимало от 5.0 до 5.6 секунды в различных тестах, поэтому основное ожидание происходит до появления какого-либо текста. Уменьшите параметр reasoning effort, если вам нужно, чтобы ответ начинал формироваться быстрее.

/ 06

Сколько стоит обработка 1 000 записей в GPT-6 Luna?

Если взять тот же тестовый запрос — 494 входных и 204 выходных токена, — стоимость составит около $0.05 за 1 000 тикетов по тарифам AIReiter. Тот же объем работы на GPT-6 Sol обойдется примерно в $0.91 за 1 000 тикетов.

/ 07

Можно ли обращаться к GPT-6 Luna через API?

Да. Следуйте инструкциям в документации API и используйте идентификатор модели gpt-6-luna с эндпоинтом, совместимым с OpenAI.