AIREITER
XiaomiText Chat

MiMo V2.6 Pro

Accede a Xiaomi MiMo V2.6 Pro con contexto de 1M. MoE disperso de 1.02T con 42B de parámetros activos. Razonamiento omnimodal nativo en texto, imagen, video y audio para programación compleja y agentes.

EntradaAIReiter $0.435 por 1 M de tokensSalidaAIReiter $0.87 por 1 M de tokens
Ejecutar con API

ENTRADA

SALIDA

Example
Generated in
42.7 seconds
Token de entrada
134
Token de salida
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Detalles del modelo

Usa la misma clave de modelo en Playground, solicitudes API y flujos de trabajo internos.

ID del modelo
mimo-v2.6-pro
Proveedor
Xiaomi
Protocolo
OpenAI Chat Completions
Ventana de contexto
1,048,576 tokens
Salida máxima
131,072 tokens
Token de entrada
43.5 créditos / 1 M de tokens
Token de salida
87 créditos / 1 M de tokens
Lectura de caché
-
Escritura de caché
-

Arquitectura MoE multimodal insignia de 1.02T de Xiaomi

MiMo-V2.6-Pro es el modelo multimodal de pesos abiertos insignia de Xiaomi bajo licencia MIT, que combina un MoE disperso de 1,02 billones de parámetros con una amplia ventana de contexto de 1.048.576 tokens.

MoE disperso dinámico (42B activos)

Con 42 mil millones de parámetros activados dinámicamente por token de un total de 1,02 billones, Pro logra un rendimiento de razonamiento de vanguardia manteniendo una economía de inferencia eficiente.

Contexto nativo de 1.048.576 tokens

Ingiere repositorios completos de software, grabaciones de audio de varias horas, cientos de documentos de investigación o trazas profundas de agentes en múltiples turnos en una sola solicitud sin división de contexto.

Percepción omnimodal nativa

Una arquitectura multimodal unificada procesa de forma nativa texto, imágenes de alta resolución, fotogramas de video de larga duración y audio hablado en texto de alta precisión y fundamentado lógicamente.

Límite de salida de 128K tokens

Genera aplicaciones exhaustivas de extremo a extremo, especificaciones arquitectónicas completas y planes complejos de refactorización de múltiples archivos en una sola generación ininterrumpida.

Diseñado para ingeniería de software compleja y agentes autónomos

Ampliamente optimizado para trayectorias de razonamiento en múltiples pasos, bases de código de múltiples archivos y ejecución autónoma asistida por herramientas.

Inteligencia de código a escala de repositorio

Analiza dependencias en árboles de directorios complejos, aísla esquivos errores de concurrencia y memoria, y genera parches verificados junto con suites de pruebas unitarias de regresión.

Planificación persistente de agentes en múltiples pasos

Mantiene un estado operativo coherente a lo largo de bucles prolongados de uso de herramientas en múltiples pasos, descomponiendo instrucciones ambiguas en secuencias de ejecución deterministas y verificables.

Motor de razonamiento adaptativo nativo

El modo de pensamiento profundo integrado explora múltiples vías deductivas y valida hipótesis intermedias antes de sintetizar respuestas, minimizando las alucinaciones en casos extremos complejos.

Uso determinista de herramientas y cumplimiento de esquemas

Admite llamadas a funciones (function calling) al estilo de OpenAI y salida JSON Schema en la solicitud de Chat Completions.

Estrategia de flota: cuándo elegir Pro vs. Flash

Ambos modelos V2.6 cuentan con la misma ventana de contexto de 1M y procesamiento multimodal. Adapta tu nivel de cómputo al perfil de la tarea.
01

Elige MiMo V2.6 Pro

Diseño de arquitectura de sistemas, refactorización compleja de repositorios, agentes autónomos para misiones críticas y tareas analíticas de alto impacto donde la precisión prevalece sobre la velocidad.

02

Elige MiMo V2.6 Flash

Procesamiento de alto rendimiento, ramificación paralela de subagentes, asistentes interactivos en tiempo real, generación automatizada de pruebas e indexación continua en segundo plano a ~1/3 del costo.

03

Cambio de modelo sin fricciones

Alterna entre Pro y Flash sin problemas cambiando model a mimo-v2.6-pro o mimo-v2.6-flash sin modificar los payloads de solicitud, esquemas o definiciones de herramientas.

04

Liquidación transparente de tokens

Facturado estrictamente a tarifas de tokens en tiempo real ($0.435 entrada / $0.87 salida por 1M de tokens) sin penalizaciones por contexto largo ni recargos ocultos de plataforma.

Inicio rápido: llamada mediante API compatible con OpenAI

Integra MiMo V2.6 Pro en cualquier cliente SDK de OpenAI o stack de LangChain/LlamaIndex existente en cuestión de segundos.

01

Apunta la URL base a AIReiter

Configura tu URL base en https://aireiter.com/api/v1 y proporciona tu clave de API de AIReiter. Utiliza las bibliotecas oficiales de OpenAI sin SDK personalizados de proveedores.

02

Enviar una solicitud de Chat Completion

POST https://aireiter.com/api/v1/chat/completions Authorization: Bearer $AIREITER_API_KEY Content-Type: application/json { "model": "mimo-v2.6-pro", "messages": [ {"role": "user", "content": "Analiza este plan de migración arquitectónica en busca de condiciones de carrera."} ], "temperature": 0.2 }

03

Streaming en producción y Tool Calling

Habilita stream: true para obtener una salida en tiempo real estilo máquina de escribir, y pasa arrays estándar de tools para llamadas automáticas a funciones. Los tokens de razonamiento se transmiten fluidamente.

Preguntas frecuentes técnicas y guía de integración

Especificaciones técnicas, capacidades multimodales y guía de integración para MiMo V2.6 Pro.

/ 01

¿Cuál es la ventana de contexto y la longitud máxima de generación?

MiMo V2.6 Pro cuenta con una ventana de contexto nativa de 1.048.576 tokens (1M) y admite hasta 131.072 tokens (128K) en una única generación de respuesta.

/ 02

¿Qué modalidades de entrada admite la API?

La API acepta texto, URL/base64 de imágenes, archivos de audio y clips de vídeo dentro de los mensajes estándar de Chat Completions, devolviendo texto enriquecido y estructurado.

/ 03

¿Cómo funciona el modo de pensamiento en MiMo V2.6 Pro?

El modo de pensamiento está habilitado de forma predeterminada para garantizar un razonamiento riguroso paso a paso. Para ajustarlo o desactivarlo en tareas sensibles a la latencia, especifica los parámetros de thinking en el payload de la solicitud.

/ 04

¿Cuál es el identificador oficial del modelo en la API?

Pasa mimo-v2.6-pro en el campo model de tu solicitud de Chat Completions.

/ 05

¿Cómo gestiona AIReiter la liquidación de tokens?

El uso se factura con precisión al token según la longitud real del prompt y de la respuesta, sin multiplicadores por tramos de contexto largo ni costes por inactividad.