AIREITER
XiaomiText Chat

MiMo V2.6 Pro

Доступ к Xiaomi MiMo V2.6 Pro с контекстом 1M. Разреженная архитектура MoE на 1,02 трлн параметров (42 млрд активных). Нативное омнимодальное мышление с текстом, изображениями, видео и аудио для сложного кодинга и агентов.

ВводAIReiter $0.435 za 1 mln tokenovВыводAIReiter $0.87 za 1 mln tokenov
Запустить через API

ВВОД

ВЫВОД

Example
Generated in
42.7 seconds
Входные Token
134
Выходные Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Сведения о модели

Используйте тот же ключ модели в Playground, запросах API и внутренних рабочих процессах.

ID модели
mimo-v2.6-pro
Провайдер
Xiaomi
Протокол
OpenAI Chat Completions
Окно контекста
1,048,576 токенов
Максимальный вывод
131,072 токенов
Входные Token
43.5 credits / 1 млн токенов
Выходные Token
87 credits / 1 млн токенов
Чтение кэша
-
Запись кэша
-

Флагманская мультимодальная архитектура MoE Xiaomi на 1,02 трлн параметров

MiMo-V2.6-Pro — флагманская мультимодальная модель Xiaomi с открытыми весами под лицензией MIT, сочетающая разреженную MoE на 1,02 трлн параметров с обширным контекстным окном в 1 048 576 токенов.

Динамическая разреженная MoE (42 млрд активных параметров)

Благодаря динамической активации 42 млрд параметров на токен из 1,02 трлн общих, Pro обеспечивает передовой уровень рассуждений, сохраняя экономичность инференса.

Нативный контекст на 1 048 576 токенов

Загружайте целые репозитории ПО, многочасовые аудиозаписи, сотни исследовательских документов или подробные многошаговые логи агентов в одном запросе без разбиения на фрагменты.

Нативное омнимодальное восприятие

Единая мультимодальная архитектура нативно преобразует текст, изображения высокого разрешения, кадры длинных видео и речь в высокоточный, логически обоснованный текст.

Лимит вывода до 128K токенов

Генерируйте полноценные сквозные приложения, комплексные архитектурные спецификации и сложные планы рефакторинга множества файлов за один непрерывный сеанс генерации.

Создано для сложной программной инженерии и автономных агентов

Масштабно оптимизировано для многошаговых цепочек рассуждений, многофайловых кодовых баз и автономного выполнения с использованием внешних инструментов.

Интеллектуальный анализ кода на уровне репозитория

Анализируйте зависимости в сложных структурах каталогов, выявляйте трудноуловимые ошибки многопоточности и памяти и создавайте проверенные патчи с наборами регрессионных модульных тестов.

Устойчивое многошаговое планирование агентов

Поддерживает согласованное операционное состояние в длительных циклах вызова инструментов, разбивая неоднозначные инструкции на детерминированные проверяемые цепочки выполнения.

Нативный движок адаптивного мышления

Встроенный режим глубокого мышления исследует различные дедуктивные цепочки и валидирует промежуточные гипотезы перед синтезом ответов, сводя к минимуму галлюцинации в сложных пограничных случаях.

Детерминированный вызов инструментов и соблюдение схем

Поддерживает function calling в стиле OpenAI и вывод по JSON Schema в запросе Chat Completions.

Стратегия выбора моделей: когда использовать Pro, а когда Flash

Обе модели V2.6 обладают одинаковым контекстным окном в 1M токенов и возможностью мультимодальной обработки данных. Подбирайте вычислительный уровень под профиль вашей задачи.
01

Выбирайте MiMo V2.6 Pro

Проектирование системной архитектуры, сложный рефакторинг репозиториев, критически важные автономные агенты и ответственные аналитические задачи, где точность важнее скорости.

02

Выбирайте MiMo V2.6 Flash

Высокопроизводительная обработка данных, параллельные цепочки субагентов, интерактивные ассистенты реального времени, автоматическая генерация тестов и непрерывная фоновая индексация примерно за 1/3 стоимости.

03

Бесшовное переключение моделей

Легко переключайтесь между Pro и Flash, просто изменяя параметр model на mimo-v2.6-pro или mimo-v2.6-flash без изменения полезной нагрузки запроса, схем или определений инструментов.

04

Прозрачные расчеты за токены

Тарификация строго по фактическим тарифам за токены ($0,435 вход / $0,87 выход за 1 млн токенов) без штрафных коэффициентов за длинный контекст или скрытых комиссий платформы.

Быстрый старт: вызов через OpenAI-совместимый API

Интегрируйте MiMo V2.6 Pro в любой существующий клиент OpenAI SDK или стек LangChain/LlamaIndex за считанные секунды.

01

Укажите базовый URL AIReiter

Укажите базовый URL https://aireiter.com/api/v1 и передайте ваш API-ключ AIReiter. Используйте официальные библиотеки OpenAI без необходимости устанавливать сторонние SDK.

02

Отправьте запрос Chat Completion

POST https://aireiter.com/api/v1/chat/completions Authorization: Bearer $AIREITER_API_KEY Content-Type: application/json { "model": "mimo-v2.6-pro", "messages": [ {"role": "user", "content": "Проанализируй этот план миграции архитектуры на предмет состояния гонки (race conditions)."} ], "temperature": 0.2 }

03

Продакшн-стриминг и вызов инструментов (Tool Calling)

Включите stream: true для потокового вывода текста в реальном времени и передавайте стандартные массивы tools для автоматического вызова функций. Токены рассуждений (reasoning tokens) передаются плавно в потоке.

Технический FAQ и руководство по интеграции

Технические характеристики, мультимодальные возможности и руководство по интеграции MiMo V2.6 Pro.

/ 01

Каков размер контекстного окна и максимальная длина генерации?

MiMo V2.6 Pro оснащена нативным контекстным окном в 1 048 576 токенов (1M) и поддерживает генерацию до 131 072 токенов (128K) в одном ответе.

/ 02

Какие модальности входных данных поддерживает API?

API принимает текст, URL-адреса изображений/base64, аудиофайлы и видеоролики в стандартных сообщениях Chat Completions, возвращая структурированный текст.

/ 03

Как работает режим рассуждений (thinking mode) в MiMo V2.6 Pro?

Режим рассуждений включен по умолчанию для обеспечения строгого пошагового анализа. Чтобы настроить или отключить его для задач, чувствительных к задержке, укажите параметры thinking в теле запроса.

/ 04

Какой официальный идентификатор модели в API?

Укажите mimo-v2.6-pro в поле model вашего запроса Chat Completions.

/ 05

Как AIReiter выполняет расчет и тарификацию токенов?

Списание средств осуществляется с точностью до токена на основе фактической длины промпта и ответа, без повышающих коэффициентов за длинный контекст и без платы за простой.