Todos os Modelos
Explore todos os modelos de IA disponíveis, compare preços e recursos e comece a integrar.

O Xiaomi MiMo-V2.6-Pro ativa 42B de parâmetros por token para tarefas complexas de engenharia. Chame como mimo-v2.6-pro.

O Xiaomi MiMo-V2.6-Flash oferece 1M de contexto a ~1/3 do custo do Pro. Chame como mimo-v2.6-flash.

O TypeSafe Jev retorna uma probabilidade, uma escolha ou uma pontuação.

Contexto de 1.048.576 tokens. Chame como muse-spark-1.3-contributor.

Cobrado a 20% da tabela oficial: $0.40 de entrada, $0.10 de entrada em cache e $1.20 de saída por milhão de tokens.

O GPT-6 Sol é o principal modelo de texto da OpenAI para programação exigente, raciocínio profundo e trabalho com agentes de longo prazo, com uma janela de contexto de 1M de tokens.

Cerca de $0.057 de entrada e $0.193 de saída por milhão de tokens, metade da tabela da China a ¥0.8 / ¥2.7. A leitura de cache é 12.5% da entrada e a gravação de cache é 125% da entrada. Sem taxas por chamada de ferramenta. Contexto hospedado de 1M de tokens.

O Claude Opus 5.5 reduz o preço de tabela do Opus 5 em 20% e as leituras de cache em 60%, com uma janela de contexto de 1M cobrada a uma taxa fixa única.

O DeepSeek V4.1 Flash é um novo MoE de 552B com 8B a 16B de parâmetros ativos, contexto de 1M, entrada nativa de imagem e as melhores pontuações no Terminal-Bench e DeepSWE da linha DeepSeek. A AIReiter cobra abaixo da tarifa oficial fora de pico, sem sobretaxa de horário de pico.

Modelo de fronteira da OpenAI para raciocínio complexo, programação e trabalhos de contexto longo.

O GPT-6 Luna é o nível de baixo custo e alto rendimento da família GPT-6, com uma janela de contexto de 1M de tokens e respostas rápidas para resumos, extração e perguntas do dia a dia.

Desenvolva com o Gemini 3.8 Flash para engenharia de software, agentes autônomos e tarefas corporativas complexas.

O Claude Fable 5.1 mantém os preços do Fable 5 para entrada e saída, reduz o custo de leitura de cache para um quarto e foi desenvolvido para programação agêntica e trabalho com documentos de longa duração.

GLM-5.3 Flash lê texto e imagens com contexto de 1M tokens e saída de 128K, com preço pensado para cargas de trabalho que você executa milhares de vezes por dia. O GLM-5.3 em si é apenas texto.

Gemini 3.6 Flash combina velocidade e inteligência para raciocínio avançado, codificação, compreensão multimodal e fluxos de trabalho agentivos.

Inteligência multimodal para compreender informações diversas.

Kimi K3 é um modelo de raciocínio de contexto longo disponível por meio de uma API de Chat Completions compatível com a OpenAI, adequado para compreensão de código, escrita, análise e fluxos de trabalho no estilo de agentes.

Modelo de raciocínio profundo para resolução de problemas complexos.

IA multimodal de alto desempenho para diversas aplicações.

O Claude Opus 5 é indicado para raciocínio exigente, programação avançada, análise, redação de textos longos e fluxos de trabalho com agentes por meio da Anthropic Messages API.

Claude Fable 5 é um modelo premium para raciocínio profundo, análise complexa, criação de longo formato e fluxos de trabalho de agentes exigentes.

Claude Sonnet 5 equilibra inteligência, velocidade e custo para raciocínio avançado, programação, escrita e trabalho profissional cotidiano.

Claude Opus 4.8 foi desenvolvido para fluxos de trabalho exigentes de raciocínio, programação, análise e conhecimento profissional.

Raciocínio avançado para análise profunda e pensamento complexo.

Assistente de IA equilibrado com velocidade e precisão.

Assistente de IA confiável com desempenho geral sólido.

Use o GLM-5.3 para programação em escala de repositório, análise bilíngue, revisão por agentes e recomendações que exigem compensações explícitas.

Use o Gemini 3.7 Flash para chat responsivo, ajuda focada em programação, processamento de documentos e cargas frequentes de API.

Use o Grok 4.5 para revisão de código, depuração, planejamento técnico e fluxos de trabalho de agente estáveis já validados nesta versão.

Avalie o Grok 4.6 para planejamento de implementação, depuração complexa, modernização de código e fluxos de trabalho de agentes de engenharia.

Use o DeepSeek V4 Pro quando um prompt exigir raciocínio mais profundo e uma recomendação final cuidadosa.

Use o DeepSeek V4 Flash como a rota de primeira passagem para tráfego técnico sensível a custos.

Use Kimi K2.7 Code quando o contexto do código for o gargalo.

Use Doubao Seed 2.1 Turbo para tráfego de produção em chinês com alta velocidade.

Use o GLM 5.2 quando a qualidade do processo de raciocínio e conclusões estruturadas forem importantes.

Use o MiniMax M3 quando documentos ou a memória do agente precisarem permanecer em uma única solicitação.

IA de fronteira para raciocínio avançado e tarefas complexas de inteligência.

IA de fronteira para raciocínio avançado e tarefas complexas de inteligência.

Modelo de raciocínio poderoso para análise e resolução de problemas.

IA de próxima geração para compreensão e geração criativa.

Qwen3.8 Max é um modelo carro-chefe com contexto de 1M. Use Chat Completions para diálogo e PDF; use Responses para web_search, code_interpreter e busca de imagens.