AIREITER
MinimaxText Chat

MiniMax M3

Используйте MiniMax M3 для анализа документов с длинным контекстом, проверки памяти агента, рабочих процессов с знаниями и автоматизации текстовых задач в продакшене.

ВводОфициально $1.20 za 1 mln tokenovAIReiter $0.36 za 1 mln tokenovВыводОфициально $4.80 za 1 mln tokenovAIReiter $1.44 za 1 mln tokenovЧтение кэшаОфициально $0.24 za 1 mln tokenovAIReiter $0.072 za 1 mln tokenov
Запустить через API

ВВОД

ВЫВОД

Example
Generated in
42.7 seconds
Входные Token
134
Выходные Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Сведения о модели

Используйте тот же ключ модели в Playground, запросах API и внутренних рабочих процессах.

ID модели
minimax-m3
Провайдер
Minimax
Протокол
Anthropic Messages
Окно контекста
1,000,000 токенов
Максимальный вывод
131,072 токенов
Входные Token
36 credits / 1 млн токенов
Выходные Token
144 credits / 1 млн токенов
Чтение кэша
7.2 credits / 1 млн токенов
Запись кэша
-

Маршрут с длинным контекстом для документов и памяти агента

MiniMax M3 полезен, когда в одном запросе нужно удерживать больше материалов: наборы политик, исследовательские подборки, история встреч или длинная память агента.

MiniMax M3 API cover

Стоит ли выбирать MiniMax M3?

Позиционируйте его как практичную модель с длинным контекстом для команд, работающих с большим количеством документов, и для агентных workflow, которым нужна непрерывность.

Выбирайте его, когда

Вам нужен анализ длинных документов, проверка памяти, синтез базы знаний или более доступный маршрут с длинным контекстом перед переходом на флагманскую модель.

Используйте другую модель, когда

Задача — короткий чат-ход, простое извлечение данных или рискованное рассуждение по коду, для которого нужна более специализированная кодовая модель.

Протокол публичного API

Вызовите POST https://aireiter.com/api/v1/messages с моделью "minimax-m3". Потоковая передача поддерживается через тот же endpoint, совместимый с Messages.

Использование токенов и кэша

Стоимость рассчитывается на основе использования входных данных, чтения из кэша и выходных данных. Для длинных промптов поля cache-read важны, потому что повторно используемый контекст может существенно менять стоимость.

Продакшн-нагрузки MiniMax M3

Лучше всего подходит для длинных входных данных, где важны непрерывность и качество суммаризации.
01

Пакеты документов

Проверяйте политики, отчёты, расшифровки и исследовательские заметки, сохраняя видимыми междокументные ссылки.

02

Память агента

Изучайте длинную историю, вызовы инструментов и обновления состояния, чтобы объяснить, почему агент принял то или иное решение.

03

Рабочие процессы с знаниями

Превращайте длинные внутренние материалы в сводки, брифы, требования и списки действий.

04

Длинный контекст с учётом стоимости

Оцените, достаточно ли практичной модели с длинным контекстом, прежде чем использовать более дорогой флагманский маршрут.

Как MiniMax M3 вписывается в ваш стек моделей

Не направляйте каждый запрос к самой новой модели. Выбирайте самую дешёвую модель, которая всё ещё проходит ваш уровень качества, а затем резервируйте более глубокие модели для ошибок или задач с высоким риском.

Для быстрых пакетных задач

Используйте Doubao или DeepSeek V4 Flash для небольших быстрых задач; MiniMax M3 предназначен для входных данных с большим объёмом контекста.

Для более глубокого рассуждения

Используйте GLM 5.2 или DeepSeek V4 Pro, когда глубина рассуждения важнее размера контекста.

Для длинного контекста

Сравните MiniMax M3 с Kimi K2.7 Code, когда рабочая нагрузка сочетает документы, код и трассировки агента.

Для внедрения в продакшене

Отслеживайте использование cache-read при повторяющихся длинных префиксах; именно здесь рабочие процессы с длинным контекстом могут стать более экономичными.

Вопросы по API MiniMax M3

Вопросы, которые разработчики обычно проверяют перед переводом текстовой модели с тестирования в playground на production API-трафик.

/ 01

Какой ID модели мне следует отправлять для MiniMax M3?

Используйте "minimax-m3" в теле API-запроса. Внутренний ключ БД используется только для маршрутизации AIReiter.

/ 02

Какой endpoint следует использовать для MiniMax M3?

Используйте POST https://aireiter.com/api/v1/messages для публичных API-вызовов. Сохраняйте аутентификацию x-api-key / Authorization согласованной с вашей настройкой API-ключа AIReiter.

/ 03

Поддерживает ли MiniMax M3 потоковую передачу?

Да. Отправьте stream=true и читайте события, отправляемые сервером, пока сообщение не завершится. При отладке проблем с аутентификацией или ID модели сначала протестируйте режим без потоковой передачи.

/ 04

Как подтвердить биллинг токенов и cache для MiniMax M3?

Проверьте объект usage, возвращаемый API. Поля input, output и cache-read token — это источник истины для расчётов; один лишь повторяющийся prompt не доказывает попадание в cache.

/ 05

Нужно ли мне всегда задавать max_tokens для MiniMax M3?

Устанавливайте max_tokens в соответствии с ожидаемой длиной summary. Длинный input не всегда требует большого output, но для задач проверки нужно достаточно места для выводов и доказательств.