Что можно делать с GPT-6 Luna
GPT-6 Luna — это быстрый и доступный уровень в семействе GPT-6. Есть четыре особенности, которые меняют подход к проектированию решений на ее основе, и ни одна из них не упоминается в маркетинговых материалах.
Выходные токены стоят в 5 раз дороже входных
$0,03 за 1M входных токенов против $0,15 за 1M выходных. Длинные промпты почти бесплатны; длинные ответы — нет. Ограничение максимального количества токенов ответа снижает расходы значительно сильнее, чем сокращение промпта.
Окно 1M с резким скачком цены на 272K
Контекстное окно составляет 1 050 000 токенов, но превышение 272K входных токенов пересчитывает весь запрос по тарифу 2x за вход и 1,5x за выход — а не только излишек. Промпт на 280K токенов стоит дороже, чем два по 140K.
Модель рассуждает перед тем, как ответить
В наших тестах первый потоковый токен появлялся через 5,0–5,6 секунды при общем времени ответа 7,2–7,4 секунды. Стриминг не скрывает эту задержку. Если вам нужно быстрее вывести текст на экран, снизьте уровень рассуждений (reasoning effort), а не лимит токенов ответа.
Структурированный вывод сохраняется без схемы
При запросе простым текстом четырех именованных полей в формате JSON модель вернула именно эти четыре ключа в блоке кода без схемы, вызова функций и повторных попыток. Пример выше — это оригинальный неотредактированный ответ.
Цены на GPT-6 Luna
Входные токены
$0,03 за 1M токенов против официальных $0,10 у OpenAI.
Выходные токены
$0,15 за 1M токенов против официальных $0,50 у OpenAI.
Чтение кэшированного ввода
$0,003 за 1M токенов против официальных $0,01 у OpenAI.
Тариф для длинного контекста
Для запросов объемом более 272K входных токенов действует надбавка OpenAI: 2x на вход и 1,5x на выход.
Сценарии использования GPT-6 Luna
Маршрутизация обращений в поддержку за $0,05 за 1 000 тикетов
Краткое содержание плюс критичность, область продукта, затронутая версия и приоритет — в рамках одного вызова на тикет. Бэклог в 50 000 тикетов обрабатывается примерно за $2,30.
Пакетное обогащение данных с кэшированным префиксом
Пакетные задачи повторяют одни и те же инструкции для каждой строки. Сохраняйте этот префикс побайтово идентичным, и повторяющаяся часть будет считываться по $0,003 за 1M вместо $0,03 — это в десять раз дешевле стоимости ввода для всего прогона.
Основной уровень за маршрутизатором
Отправляйте все запросы в Luna и эскалируйте только те, которые не прошли проверку. Поскольку Sol стоит примерно в 20 раз дороже, маршрутизатор, направляющий 95% трафика на Luna, обходится примерно в одну десятую стоимости пайплайна только на Sol — при этом 5% эскалированных запросов составят половину оставшегося счета.
Целые документы ниже порога в 272K
Отчеты, стенограммы и договоры помещаются в окно 1M, однако лучше удерживать объем запроса в пределах 272K входных токенов, чтобы избежать двойной наценки. Разделение на части ниже этого порога обычно обходится дешевле, чем один большой запрос.
Как использовать GPT-6 Luna
Luna создана для больших объемов данных, поэтому тестируйте ее так, как будете использовать в проде: на реальной записи и с теми настройками, которые можете позволить себе в масштабе.
Вставьте одну реальную запись
Используйте реальный тикет, расшифровку или документ вместо тестового промпта. Слабое место Luna — это неструктурированные входные данные, а не сложность логических рассуждений.
Оптимизируйте в сторону уменьшения
Начните с низкого уровня рассуждений (reasoning effort) и жесткого ограничения max completion tokens. Исходящие токены стоят в 5 раз дороже входящих, поэтому лимит вывода — это главный рычаг управления расходами.
Умножьте количество токенов
Возьмите данные об использовании токенов под ответом, умножьте на ваш ежедневный объем, и вы получите ежемесячную стоимость еще до написания кода интеграции.
Разработка с помощью GPT-6 Luna API
При пакетной интеграции важен не первый вызов, а десятитысячный: стоимость одной записи, поведение кэша и обработка ошибок в отдельной строке.
Простая замена ID модели
Укажите gpt-6-luna в существующем OpenAI-совместимом клиенте и больше ничего не меняйте. Стриминг, системные промпты и вывод в формате JSON работают точно так же, как и в оригинале.
Кэширование префиксов приносит реальную выгоду
Пакетные задачи повторяют одни и те же инструкции для каждой строки. Чтение из кэша стоит $0.003 за 1M токенов против $0.03 за новые входящие данные, поэтому стоит выстроить стабильный префикс промпта.
Учет затрат на каждый ответ
Каждый ответ содержит отчет о входящих, исходящих токенах, чтении из кэша и списанных кредитах, что позволяет пайплайну логировать юнит-экономику для каждой записи, а не узнавать ее постфактум из счета.
Переход на GPT-6 Sol без перенастройки инфраструктуры
Sol и Luna используют один эндпоинт, один ключ и общий баланс, поэтому перенаправление сложной строки на флагманскую модель требует лишь смены ID модели, а не отдельной интеграции.
GPT-6 Luna против GPT-6 Sol против GPT-5.6 Luna
GPT-6 Luna — около $0.05 за 1 000 тикетов
$0.03 за входящие и $0.15 за исходящие токены за 1M на AIReiter против официальных $0.10 и $0.50 от OpenAI. Самый доступный уровень GPT-6, который делает автоматизацию обработки записей экономически выгодной.
GPT-6 Sol — около $0.91 за 1 000 тикетов
$0.60 за входящие и $3.00 за исходящие токены за 1M, что примерно в 20 раз дороже Luna. Оправдано, когда задаче требуются флагманские рассуждения; излишне, когда задача сводится к извлечению данных, с которым Luna уже справляется отлично.
GPT-5.6 Luna — предыдущее поколение
Официальные $0.20 за входящие и $1.20 за исходящие токены за 1M. GPT-6 Luna вдвое снижает официальную стоимость ввода и более чем вдвое — стоимость вывода в том же сегменте экономичных моделей.
Как выбрать
Прогоните самую сложную запись через обе модели в плейграунде выше. Если ответ Luna вас устроит, 20-кратная разница в цене означает, что Sol должна доказать свою ценность на конкретной задаче, а не просто полагаться на репутацию.
Часто задаваемые вопросы о GPT-6 Luna
Частые вопросы об онлайн-playground, ценах и доступе через API.
/ 01Когда стоит выбрать GPT-6 Luna?
Выбирайте Luna для больших объемов четко поставленных задач, таких как суммаризация, извлечение данных и классификация. Переходите на GPT-6 Sol только тогда, когда задаче требуются флагманские аналитические способности.
/ 02Сколько стоит GPT-6 Luna на AIReiter?
AIReiter берет 30% от официальных тарифов OpenAI: $0.03 за 1 млн входных токенов и $0.15 за 1 млн выходных токенов по сравнению с официальными $0.10 и $0.50. Чтение кэшированного ввода стоит $0.003 за 1 млн.
/ 03Чем GPT-6 Luna отличается от GPT-5.6 Luna?
GPT-6 Luna — это более новое поколение в том же экономичном сегменте, при этом официальная цена за ввод в два раза ниже, а за вывод — в пять раз ниже, чем у GPT-5.6 Luna.
/ 04Каков размер контекстного окна?
GPT-6 Luna поддерживает около 1 млн входных токенов и до 128 тыс. выходных токенов. Запросы объемом более 272 тыс. входных токенов тарифицируются с коэффициентом 2x для ввода и 1.5x для вывода, согласно правилам самой OpenAI.
/ 05Насколько быстра GPT-6 Luna?
На AIReiter запрос на суммаризацию и извлечение данных из тикета техподдержки объемом 494 токена вернул 204 выходных токена за 10.6 секунды без стриминга и за 7.2–7.4 секунды со стримингом. Обратите внимание, что Luna сначала рассуждает, прежде чем ответить: получение первого токена в потоке занимало от 5.0 до 5.6 секунды в различных тестах, поэтому основное ожидание происходит до появления какого-либо текста. Уменьшите параметр reasoning effort, если вам нужно, чтобы ответ начинал формироваться быстрее.
/ 06Сколько стоит обработка 1 000 записей в GPT-6 Luna?
Если взять тот же тестовый запрос — 494 входных и 204 выходных токена, — стоимость составит около $0.05 за 1 000 тикетов по тарифам AIReiter. Тот же объем работы на GPT-6 Sol обойдется примерно в $0.91 за 1 000 тикетов.
/ 07Можно ли обращаться к GPT-6 Luna через API?
Да. Следуйте инструкциям в документации API и используйте идентификатор модели gpt-6-luna с эндпоинтом, совместимым с OpenAI.