AIREITER

Цены на API Mistral Large 4: что на самом деле дает публичный preview

Последнее обновление: 2026-10-06 18:56:18

Миллион токенов контекста и цена $0.68 за вход делают Mistral Large 4 необычно дешевым вариантом для модели с триллионом параметров. Но это пока публичный preview: срок действия скидки не указан, лимиты у разных шлюзов не совпадают с заявленными характеристиками, а условия будущего open-weight релиза еще не опубликованы.

Коротко: стоит ли пробовать

Mistral Large 4 уже имеет смысл тестировать, если вам нужен недорогой API с длинным контекстом для документов, репозиториев кода или сценариев с вызовом инструментов. Но воспринимать preview как стабильную замену для собственного развертывания или как доказанного лидера в кодинговых бенчмарках пока рано.

ЗадачаРешение
Проверить работу с длинными документами или большими кодовыми базами через APIПопробуйте сейчас, одновременно отслеживая попадания в кэш и стоимость вывода
Нужна предсказуемая цена на длительный срокПодождите или закладывайте повышенный тариф: $1.36 за вход и $4.18 за выход
Нужно приватное развертываниеДождитесь весов, лицензии, вариантов квантования и рекомендаций по запуску
Нужен лучший результат в задачах программированияНе выбирайте модель только по цифрам из анонса; прогоните один и тот же тестовый набор на своих задачах

Речь идет о выборе публичного preview API, а не об окончательной оценке модели. Mistral объявила о preview 6 октября 2026 года и сообщает, что веса планируется выпустить к концу октября. (Анонс Mistral)

Что доступно 6 октября

Mistral Large 4 доступна как API в режиме публичного preview через Mistral Studio. Mistral описывает ее как нативно мультимодальную mixture-of-experts модель с 1.05 триллиона параметров всего и 49 миллиардами активных параметров на токен. В официальном анонсе также заявлены вызов функций, структурированный вывод, ответы на вопросы по документам, пакетная обработка, агенты и встроенные инструменты.

Модель также указана на OpenRouter под именем mistralai/mistral-large-4-0, поэтому доступ через OpenRouter — уже не просто слух со дня запуска. Лимиты, задержка, биллинг и правила переключения на запасного провайдера могут отличаться в зависимости от маршрута.

API уже работает, но скачиваемые веса и финальная лицензия пока не опубликованы. Термин «open weight» не следует автоматически трактовать как полноценный open source без ограничений для коммерческого использования — сначала Mistral должна опубликовать карточку модели и условия лицензии.

Почему у модели две цены

Текущие тарифы preview, указанные в документации Mistral, выглядят привлекательно:

Тип токеновТариф previewВозможный тариф после preview, указанный в материалах запуска
Вход$0.68 / 1M токенов$1.36 / 1M токенов
Вход из кэша$0.07 / 1M токенов$0.14 / 1M токенов
Выход$2.09 / 1M токенов$4.18 / 1M токенов

В каталоге Vercel и на других страницах доступа к модели сниженные значения представлены как 50%-ная цена на период preview, однако дата окончания акции не указана. Поэтому $0.68 и $2.09 стоит воспринимать как текущий тариф, а не как бессрочные условия.

Для нагрузки с 500,000 некэшированных входных токенов и 100,000 выходных токенов счет в режиме preview составит около $0.55: $0.34 за вход плюс $0.209 за выход. Если входные данные берутся из кэша, сумма будет около $0.244: $0.035 за кэшированный вход плюс $0.209 за выход. Перед переносом production-трафика оцените повторное использование кэша, объем вывода и то, насколько долго продержится скидка.

Контекст и возможности зависят от маршрута

В документации Mistral для модели заявлено окно контекста на 1 миллион токенов. Но это характеристика самой модели, а не обязательный лимит, который будет доступен через каждый шлюз.

Страница AI Gateway от Vercel сейчас указывает общее окно контекста 524K и максимальный объем вывода 262K для своего провайдера Mistral. Там же указаны 0.9 секунды до первого токена на уровне P50, скорость 38 токенов в секунду и показатель попаданий в кэш 74% по данным трафика шлюза.

Mistral Large 4 gateway pricing and provider metrics

Это показатели конкретного маршрута, а не универсальные гарантии модели. На странице описаны прием изображений, вызов инструментов, совместимые с OpenAI API Chat Completions и Responses, а также доступ к Messages API, совместимый с Anthropic. Идентификатор модели у шлюза — mistral/mistral-large-4, тогда как у OpenRouter используется ID с указанием провайдера.

Перед интеграцией проверьте общее окно контекста конечной точки, ограничение на вывод, учет изображений и токенов, поведение инструментов, правила кэширования, маршрутизацию между провайдерами и условия переключения на запасной маршрут. Заявленный 1M помогает составить короткий список кандидатов, но для расчета параметров приложения этого недостаточно.

Что можно заключить из бенчмарков

Анализ запуска от TechsCurrent приводит показатели Mistral: 61.7% в DeepSWE v1.1, 28.3% в Terminal-Bench 4 и 59.9% в AutomationBench. В сравнении CellCog DeepSeek V4.1 Flash получает 74.2 в DeepSWE, а Mistral Large 4 — 61.7; при этом показатель Mistral в AutomationBench выше значений в сравнительной таблице. Это данные от вендора и сигналы из разных источников, а не результаты одного стандартизированного рейтинга.

Перед тем как использовать модель в production-агентах, проведите фиксированную проверку:

  1. Используйте один и тот же репозиторий, промпт, набор инструментов и тайм-аут для Mistral Large 4 и текущей модели.
  2. Измеряйте выполнение задач, ошибки в аргументах инструментов, повторные попытки, задержку, количество выходных токенов и стоимость.
  3. Добавьте задачи на поиск в длинном контексте, где ответ находится в середине и ближе к концу входных данных.
  4. Повторите тест с кэшированным и некэшированным контекстом.
  5. Отделяйте результаты preview от результатов будущего релиза весов.

Кому уже стоит ее попробовать

Командам, которые работают через API и регулярно отправляют большой контекст: Mistral Large 4 уже стоит протестировать. Тариф $0.07 за кэшированный вход может заметно повлиять на расходы, если агент постоянно отправляет один и тот же префикс с политиками, репозиторием или документом. На время эксперимента установите лимит расходов: более высокий тариф остается вполне возможным.

Командам, создающим системы для работы с изображениями и документами: Проверьте обработку изображений и извлечение данных на том маршруте, который планируете использовать в production. Модель поддерживает изображения, но лимиты файлов и детали биллинга зависят от конкретного маршрута и требуют отдельной проверки.

Командам, разрабатывающим кодинговых агентов: Рассматривайте модель как кандидата, а не как автоматического победителя. Доступные результаты бенчмарков неоднозначны, а реальная надежность определяется вызовами инструментов, повторными попытками и долей успешно завершенных задач.

Командам с повышенными требованиями к приватности или собственным развертыванием: Дождитесь весов и лицензии. 49 миллиардов активных параметров не означают, что полный чекпойнт будет небольшим: всю модель все равно придется хранить и запускать. Требования к оборудованию, квантование, пропускная способность и права на распространение пока не определены.

FAQ по API Mistral Large 4

Mistral Large 4 уже стала open source?

Нет. На момент запуска финальная лицензия и скачиваемые веса отсутствовали. Mistral планировала выпустить веса к концу октября 2026 года, но сам статус «open weight» еще не определяет права на коммерческое использование или распространение.

Цена $0.68 будет постоянной?

Дата окончания действия тарифа не указана. Для тестов закладывайте текущие $0.68 за вход и $2.09 за выход, но финансовую модель стройте с учетом $1.36 и $4.18.

Размер контекста — 1M или 524K?

Mistral указывает для модели контекст на 1M токенов, а Vercel — общий контекст 524K для своего маршрута через шлюз. Уточните лимит для конкретного провайдера и формата API, который будете вызывать.

Модель уже есть на OpenRouter?

Да, OpenRouter сейчас указывает mistralai/mistral-large-4-0. Перед развертыванием проверьте актуальную страницу: маршрутизация preview может измениться.

Модель умеет работать с изображениями и инструментами?

Официальная документация и материалы шлюза описывают поддержку изображений и вызова инструментов. На выбранном маршруте проверьте формат запросов, лимиты изображений, подсчет токенов и поведение при некорректных вызовах инструментов.

Стоит ли запускать ее на своих серверах после выхода весов?

Не автоматически. Сначала дождитесь информации о лицензии, форматах чекпойнтов, вариантах квантования, требованиях к памяти, пропускной способности и эталонной конфигурации для запуска.

Какой тест провести следующим

До перенаправления реального трафика соберите оценку из 20 задач: пять задач на поиск в длинном контексте, пять изменений в коде, пять вопросов по изображениям и документам и пять задач с вызовом инструментов. Логируйте долю успеха, повторные попытки, время до первого токена, общую задержку, входные, кэшированные и выходные токены, а также фактическую стоимость одной успешно выполненной задачи.

Источники: документация Mistral по модели, анонс Mistral, Vercel AI Gateway, страница модели на OpenRouter, TechsCurrent, CellCog.