AIREITER

Gemini 3.7 Flash API: цены, характеристики и результаты тестов

Последнее обновление: 2026-08-13 18:51:50

13 августа 2026 года Google выпустила Gemini 3.7 Flash — по заявлению компании, самую сильную Flash-модель для кодовых агентов и многошаговой работы с инструментами. Главный результат — 65.3% в DeepSWE v1.1 против 49.0% у 3.6 Flash. На старте API стоит $0.75 за миллион входных токенов и $3.75 за миллион выходных, то есть ровно вдвое дешевле стандартных тарифов 3.6 Flash. Однако льготные цены, по имеющимся данным, действуют лишь до конца 2026 года: в январе 2027 года они вырастут до $1.50/$7.50. На оценку модели по сниженной ставке остаётся примерно четыре месяца.

Тарифы Gemini 3.7 Flash: скидка до конца 2026 года

Согласно анонсу Google DeepMind, который подтверждают сообщения сообщества и результаты индексированного поиска, Gemini 3.7 Flash стоит $0.75 за миллион входных токенов и $3.75 за миллион выходных. Для сравнения, стандартный тариф Gemini 3.6 Flash — $1.50/M за вход и $7.50/M за выход (AgentPedia). Вводная цена 3.7 Flash соответствует уровню Batch/Flex у 3.6 Flash, но доступна при стандартной пропускной способности.

В сообщениях сообщества отмечают важную деталь мелким шрифтом: вводный тариф действует до 31 декабря 2026 года, после чего цены вернутся к $1.50/M за входные и $7.50/M за выходные токены. Один пользователь Reddit обратил внимание, что «примечание к отображаемым ценам удваивает стоимость через четыре месяца» (r/GeminiAI).

ТарифВход ($/M токенов)Выход ($/M токенов)Примечание
3.7 Flash, вводный тариф (авг.–дек. 2026)$0.75$3.75По данным сообщества; в январе 2027 года цена удвоится
3.7 Flash, стандартный тариф (с янв. 2027)$1.50$7.50Как у стандартного 3.6 Flash
3.6 Flash, стандартный тариф$1.50$7.50Текущая цена GA
3.6 Flash Batch/Flex$0.75$3.75Уровень с меньшей пропускной способностью
3.5 Flash-Lite, стандартный тариф$0.30$2.50Самый дешёвый уровень Gemini Flash
Сравнительная диаграмма цен Gemini Flash API

В стоимость выходных токенов уже включены thinking tokens. Контекстное кеширование на стандартном тарифе добавляет $0.15/M токенов — исходя из опубликованных ставок 3.6 Flash через AgentPedia. За grounding через Google Search и Maps взимается отдельная плата. Модель сохраняет контекстное окно в 1M токенов и максимум 64K выходных токенов, как у 3.6 Flash, поэтому существующие API-вызовы не должны ломаться из-за изменения лимитов контекста.

Что изменилось в бенчмарках

По данным Google, основной прирост пришёлся на программную инженерию, написание кода и обработку документов. Приведённые ниже результаты взяты из анонса Google, опубликованного в сообщениях сообщества 13 августа 2026 года.

БенчмаркGemini 3.7 FlashGemini 3.6 FlashРазница
DeepSWE v1.165.3%49.0%+16.3 п.п.
FrontierCode 1.1 Main43.6%34.4%+9.2 п.п.
WebDev Arena (Elo)1,5881,538+50 Elo
Обработка документов GDP.pdf34.0%22.0%+12.0 п.п.
AutomationBench30.4%~17%+13 п.п.
Извлечение данных из длинного контекста97%——
Сравнительная диаграмма результатов Gemini 3.7 Flash и 3.6 Flash в бенчмарках

Самый заметный показатель — DeepSWE: рост с 49% до 65.3%, или на 33% относительно прежнего результата. Этот тест проверяет работу с программными репозиториями: изменения в нескольких файлах, запуск тестов и навигацию по кодовой базе. Впрочем, на Reddit нет единого мнения, подтвердятся ли эти цифры в продакшене. Один пользователь сформулировал позицию так: «Считайте результат натренированным под бенчмарки, пока не доказано обратное» (r/GeminiAI). Другие участники отметили, что 3.6 Flash в сравнении использовала thinking на уровне high, тогда как у некоторых конкурентов стоял medium, что завышает результаты. Зато 97% в извлечении информации из длинного контекста вызвали реальный интерес у разработчиков: это важно, когда нужно найти нужный код в большой кодовой базе.

Цена на фоне моделей для программирования

Первые пользователи Reddit сразу начали сравнивать соотношение цены и качества у 3.7 Flash с более дешёвыми альтернативами. Картина неоднозначная: модель показывает сильные результаты, но обходится заметно дороже бюджетных решений для кода.

Один комментатор в обсуждении бенчмарков оценил стоимость Gemini 3.7 Flash примерно в 8 раз выше, чем у GPT-5.6 Luna, по метрике Artificial Analysis cost-per-task, хотя результаты Luna в тестах почти идентичны. Другой пользователь написал, что Gemini 3.7 Flash раньше была примерно в 13 раз дороже DeepSeek V4 Flash, хотя цена DeepSeek с тех пор выросла. Тот же комментатор резюмировал без обиняков: Gemini 3.7 Flash стоит «более чем на 300% дороже» Luna при «почти тех же» результатах (r/GeminiAI).

Контраргумент тоже есть: по сообщениям пользователей, Luna чаще галлюцинирует, а в рассуждениях DeepSeek V4 Flash «допускает много ошибок». Впрочем, это лишь отдельные наблюдения.

Зато 3.7 Flash хвалят за скорость. Пользователи сообщают, что большинство ответов приходит за 3–6 секунд; самый долгий зафиксированный ответ — в тесте творческого письма — занял около минуты. Несколько комментаторов назвали модель «молниеносно быстрой».

Характеристики, доступность и API

Судя по параметрам из обсуждений сообщества и документации 3.6 Flash, Gemini 3.7 Flash сохраняет те же ограничения контекста и набор возможностей, что и 3.6 Flash.

ХарактеристикаЗначение
Контекстное окно1,048,576 токенов (1M)
Максимальный вывод65,536 токенов (64K)
Уровни thinkingLow, Medium, High
МодальностиТекст, изображения, видео, аудио, PDF (вход); текст (выход)
Граница знанийМарт 2026 года (3.6 Flash; для 3.7 Flash не подтверждена)
Цена кешированных входных данных$0.15/M токенов (стандартный тариф, выведено из данных 3.6 Flash)

Где доступна модель:

  • Gemini API / Google AI Studio — доступ для разработчиков
  • Gemini app — запуск для потребителей
  • Gemini Spark — доступна подписчикам Google AI Pro и Google AI Ultra
  • Vertex AI — ожидается по тому же сценарию доступности, что и 3.6 Flash

Ожидаемый ID модели в API — gemini-3.7-flash, по аналогии со схемой именования Google для 3.6 Flash. Перед развёртыванием проверьте точную строку в документации Google AI for Developers и закрепите её, а не полагайтесь на алиасы вроде gemini-flash-latest.

Стоит ли переходить с 3.6 Flash

Решение зависит от типа нагрузки и от того, насколько критично для вас повышение цены в январе 2027 года.

Переходите, если приложение использует кодовых агентов, многошаговые цепочки работы с инструментами или интенсивно обрабатывает документы. Рост DeepSWE с 49% до 65.3% достаточно велик, чтобы заметно увеличить число агентных циклов, успешно завершающихся с первой попытки. А сниженная стартовая цена позволяет протестировать модель дешевле. Команды, уже работающие с 3.6 Flash, могут сменить ID модели за feature flag без пересмотра предположений о размере контекстного окна.

Подождите, если у вас высоконагруженная классификация, маршрутизация или извлечение данных, с которыми уже справляется Flash-Lite за $0.30/$2.50. Даже вводный тариф 3.7 Flash в 2.5 раза выше по входным токенам, чем у Flash-Lite, а январское удвоение только увеличит разрыв.

Заложите повышение цены в бюджет. С января 2027 года рассчитывайте на $1.50/$7.50, а не на текущий вводный тариф. Если экономика продукта сходится только при $0.75/$3.75, через четыре месяца модель станет вдвое дороже.

FAQ

Тариф Gemini 3.7 Flash $0.75/$3.75 останется навсегда?

Нет. По данным сообщества, это вводная цена, действующая до 31 декабря 2026 года. С января 2027 года тарифы, как сообщается, удвоятся до $1.50/M за входные и $7.50/M за выходные токены — то есть сравняются со стандартными ценами 3.6 Flash.

Gemini 3.7 Flash доступна в Vertex AI?

На момент запуска доступность в Vertex AI независимо не подтверждена. Gemini 3.6 Flash была доступна через Vertex AI на этапе GA, поэтому ожидается, что 3.7 Flash пойдёт по тому же пути. Актуальный список моделей стоит проверить в консоли Google Cloud.

Как 3.7 Flash соотносится с Gemini 3.1 Pro?

Пользователи Reddit сообщают, что 3.7 Flash сопоставима с моделями Pro-уровня или превосходит их в отдельных агентных и кодовых бенчмарках, особенно в агентном анализе документов. Для циклов кодовых агентов при вводной цене 3.7 Flash даёт лучшее соотношение цены и качества; для сложных рассуждений и планирования Pro остаётся более сильным выбором.

Thinking tokens оплачиваются отдельно?

Нет. Thinking tokens тарифицируются как выходные токены по стандартной выходной ставке ($3.75/M в период действия вводной цены). Режим high пропорционально повышает расходы на выходные токены, поэтому для высоконагруженных задач, где дополнительное рассуждение не требуется, выбирайте medium или low.