AIREITER
xiaomiText Chat

MiMo V2.6 Pro

Acesse o Xiaomi MiMo V2.6 Pro com contexto de 1M. MoE esparso de 1,02T com 42B de parâmetros ativos. Raciocínio omnimodal nativo em texto, imagem, vídeo e áudio para programação complexa e agentes.

EntradaAIReiter $0.435 por 1 milhao de tokensSaídaAIReiter $0.87 por 1 milhao de tokens
Executar com API

ENTRADA

SAÍDA

Example
Generated in
42.7 seconds
Token de entrada
134
Token de saída
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Detalhes do modelo

Use a mesma chave de modelo no Playground, nas solicitações da API e nos fluxos de trabalho internos.

ID do modelo
mimo-v2.6-pro
Provedor
xiaomi
Protocolo
OpenAI Chat Completions
Janela de contexto
1,048,576 tokens
Saída máxima
131,072 tokens
Token de entrada
43.5 créditos / 1 mi de tokens
Token de saída
87 créditos / 1 mi de tokens
Leitura de cache
-
Gravação de cache
-

Arquitetura MoE multimodal topo de linha de 1,02T da Xiaomi

O MiMo-V2.6-Pro é o principal modelo multimodal de pesos abertos da Xiaomi sob a licença MIT, combinando um MoE esparso de 1,02 trilhão de parâmetros com uma ampla janela de contexto de 1.048.576 tokens.

MoE esparso dinâmico (42B ativos)

Com 42 bilhões de parâmetros ativados dinamicamente por token de um total de 1,02 trilhão, o Pro alcança um desempenho de raciocínio de ponta, mantendo uma economia de inferência eficiente.

Contexto nativo de 1.048.576 tokens

Processe repositórios de software completos, gravações de áudio de várias horas, centenas de documentos de pesquisa ou rastreamentos profundos de agentes em múltiplos turnos em uma única requisição, sem divisão de contexto.

Percepção omnimodal nativa

Uma arquitetura multimodal unificada processa nativamente texto, imagens de alta resolução, quadros de vídeo longos e áudio falado em texto de alta precisão e logicamente fundamentado.

Limite de saída de 128K tokens

Gere aplicações completas de ponta a ponta, especificações arquiteturais abrangentes e planos complexos de refatoração de múltiplos arquivos em uma única geração ininterrupta.

Projetado para engenharia de software complexa e agentes autônomos

Amplamente otimizado para trajetórias de raciocínio em várias etapas, bases de código com múltiplos arquivos e execução autônoma aumentada por ferramentas.

Inteligência de código em escala de repositório

Analise dependências em árvores de diretórios complexas, isole bugs elusivos de concorrência e memória e gere correções verificadas completas com suítes de testes unitários de regressão.

Planejamento persistente de agentes em várias etapas

Mantém um estado operacional coerente ao longo de loops extensos de uso de ferramentas em várias etapas, decompondo instruções ambíguas em sequências de execução determinísticas e verificáveis.

Mecanismo de raciocínio adaptativo nativo

O modo de pensamento profundo integrado explora múltiplos caminhos dedutivos e valida hipóteses intermediárias antes de sintetizar respostas, minimizando alucinações em casos limites difíceis.

Uso determinístico de ferramentas e conformidade com Schema

Aceita chamadas de função no estilo OpenAI e saídas em JSON Schema na requisição de Chat Completions.

Estratégia de Frota: Quando Escolher Pro vs. Flash

Ambos os modelos V2.6 contam com a mesma janela de contexto de 1M e ingestão multimodal. Combine o seu nível de computação com o perfil da tarefa.
01

Escolha o MiMo V2.6 Pro

Design de arquitetura de sistemas, refatoração de repositórios complexos, agentes autônomos de missão crítica e tarefas analíticas de alto impacto onde a precisão supera a velocidade.

02

Escolha o MiMo V2.6 Flash

Processamento de alto rendimento, fanouts paralelos de subagentes, assistentes interativos em tempo real, geração automatizada de testes e indexação contínua em segundo plano por cerca de 1/3 do custo.

03

Alternância de modelos sem atrito

Alterne entre o Pro e o Flash perfeitamente mudando o model para mimo-v2.6-pro ou mimo-v2.6-flash sem modificar os payloads de requisição, schemas ou definições de ferramentas.

04

Faturamento transparente de tokens

Cobrado estritamente pelas taxas de tokens em tempo real (US$ 0,435 entrada / US$ 0,87 saída por 1M de tokens), sem penalidades por contexto longo ou sobretaxas ocultas da plataforma.

Início Rápido: Chamada via API Compatível com a OpenAI

Integre o MiMo V2.6 Pro a qualquer cliente SDK da OpenAI ou stack LangChain/LlamaIndex existente em segundos.

01

Aponte a URL Base para o AIReiter

Defina sua URL base como https://aireiter.com/api/v1 e forneça sua chave de API do AIReiter. Use as bibliotecas oficiais da OpenAI sem a necessidade de SDKs personalizados de terceiros.

02

Envie uma Requisição de Chat Completion

POST https://aireiter.com/api/v1/chat/completions Authorization: Bearer $AIREITER_API_KEY Content-Type: application/json { "model": "mimo-v2.6-pro", "messages": [ {"role": "user", "content": "Analise este plano de migração de arquitetura em busca de condições de corrida."} ], "temperature": 0.2 }

03

Streaming em Produção e Tool Calling

Ative stream: true para saída em tempo real estilo máquina de escrever e passe arrays padrão de tools para chamadas automáticas de função. Os tokens de raciocínio são transmitidos de forma contínua.

FAQ Técnico e Guia de Integração

Especificações técnicas, capacidades multimodais e orientações de integração para o MiMo V2.6 Pro.

/ 01

Qual é a janela de contexto e o comprimento máximo de geração?

O MiMo V2.6 Pro possui uma janela de contexto nativa de 1.048.576 tokens (1M) e suporta até 131.072 tokens (128K) em uma única geração de resposta.

/ 02

Quais modalidades de entrada a API suporta?

A API aceita texto, URLs/base64 de imagens, arquivos de áudio e clipes de vídeo em mensagens padrão do Chat Completions, retornando texto estruturado rico.

/ 03

Como funciona o modo de pensamento no MiMo V2.6 Pro?

O modo de pensamento está ativado por padrão para garantir um raciocínio passo a passo rigoroso. Para ajustá-lo ou desativá-lo em tarefas sensíveis à latência, especifique os parâmetros de thinking no payload da requisição.

/ 04

Qual é o identificador oficial do modelo na API?

Passe mimo-v2.6-pro no campo model da sua requisição de Chat Completions.

/ 05

Como o AIReiter lida com a tarifação de tokens?

O uso é faturado com precisão ao nível do token com base nos comprimentos reais de prompt e completion, sem multiplicadores de faixas para contextos longos ou cobranças por inatividade.