Todos os Modelos

Explore todos os modelos de IA disponíveis, compare preços e recursos e comece a integrar.

MiMo V2.6 Pro
xiaomi/MiMo V2.6 Pro

O Xiaomi MiMo-V2.6-Pro ativa 42B de parâmetros por token para tarefas complexas de engenharia. Chame como mimo-v2.6-pro.

MiMo V2.6 Flash
xiaomi/MiMo V2.6 Flash

O Xiaomi MiMo-V2.6-Flash oferece 1M de contexto a ~1/3 do custo do Pro. Chame como mimo-v2.6-flash.

Jev
Cloudflare/Jev

O TypeSafe Jev retorna uma probabilidade, uma escolha ou uma pontuação.

Muse Spark 1.3 Contributor
meta/Muse Spark 1.3 Contributor

Contexto de 1.048.576 tokens. Chame como muse-spark-1.3-contributor.

Grok 4.7
Grok/Grok 4.7

Cobrado a 20% da tabela oficial: $0.40 de entrada, $0.10 de entrada em cache e $1.20 de saída por milhão de tokens.

GPT-6 Sol
OpenAI/GPT-6 Sol

O GPT-6 Sol é o principal modelo de texto da OpenAI para programação exigente, raciocínio profundo e trabalho com agentes de longo prazo, com uma janela de contexto de 1M de tokens.

Qwen3.8 Flash
Qwen/Qwen3.8 Flash

Cerca de $0.057 de entrada e $0.193 de saída por milhão de tokens, metade da tabela da China a ¥0.8 / ¥2.7. A leitura de cache é 12.5% da entrada e a gravação de cache é 125% da entrada. Sem taxas por chamada de ferramenta. Contexto hospedado de 1M de tokens.

Claude Opus 5.5
Anthropic/Claude Opus 5.5

O Claude Opus 5.5 reduz o preço de tabela do Opus 5 em 20% e as leituras de cache em 60%, com uma janela de contexto de 1M cobrada a uma taxa fixa única.

DeepSeek V4.1 Flash
Deepseek/DeepSeek V4.1 Flash

O DeepSeek V4.1 Flash é um novo MoE de 552B com 8B a 16B de parâmetros ativos, contexto de 1M, entrada nativa de imagem e as melhores pontuações no Terminal-Bench e DeepSWE da linha DeepSeek. A AIReiter cobra abaixo da tarifa oficial fora de pico, sem sobretaxa de horário de pico.

GPT-6 Astra
OpenAI/GPT-6 Astra

Modelo de fronteira da OpenAI para raciocínio complexo, programação e trabalhos de contexto longo.

GPT-6 Luna
OpenAI/GPT-6 Luna

O GPT-6 Luna é o nível de baixo custo e alto rendimento da família GPT-6, com uma janela de contexto de 1M de tokens e respostas rápidas para resumos, extração e perguntas do dia a dia.

Gemini 3.8 Flash
Google/Gemini 3.8 Flash

Desenvolva com o Gemini 3.8 Flash para engenharia de software, agentes autônomos e tarefas corporativas complexas.

Claude Fable 5.1
Anthropic/Claude Fable 5.1

O Claude Fable 5.1 mantém os preços do Fable 5 para entrada e saída, reduz o custo de leitura de cache para um quarto e foi desenvolvido para programação agêntica e trabalho com documentos de longa duração.

GLM-5.3 Flash
Zhipu/GLM-5.3 Flash

GLM-5.3 Flash lê texto e imagens com contexto de 1M tokens e saída de 128K, com preço pensado para cargas de trabalho que você executa milhares de vezes por dia. O GLM-5.3 em si é apenas texto.

Gemini 3.6 Flash
Google/Gemini 3.6 Flash

Gemini 3.6 Flash combina velocidade e inteligência para raciocínio avançado, codificação, compreensão multimodal e fluxos de trabalho agentivos.

Gemini 3.1 Pro
Google/Gemini 3.1 Pro

Inteligência multimodal para compreender informações diversas.

Kimi K3
Moonshot/Kimi K3

Kimi K3 é um modelo de raciocínio de contexto longo disponível por meio de uma API de Chat Completions compatível com a OpenAI, adequado para compreensão de código, escrita, análise e fluxos de trabalho no estilo de agentes.

Gemini 3 Pro
Google/Gemini 3 Pro

Modelo de raciocínio profundo para resolução de problemas complexos.

Gemini 2.5 Pro
Google/Gemini 2.5 Pro

IA multimodal de alto desempenho para diversas aplicações.

Claude Opus 5
Anthropic/Claude Opus 5

O Claude Opus 5 é indicado para raciocínio exigente, programação avançada, análise, redação de textos longos e fluxos de trabalho com agentes por meio da Anthropic Messages API.

Claude Fable 5
Anthropic/Claude Fable 5

Claude Fable 5 é um modelo premium para raciocínio profundo, análise complexa, criação de longo formato e fluxos de trabalho de agentes exigentes.

Claude Sonnet 5
Anthropic/Claude Sonnet 5

Claude Sonnet 5 equilibra inteligência, velocidade e custo para raciocínio avançado, programação, escrita e trabalho profissional cotidiano.

Claude Opus 4.8
Anthropic/Claude Opus 4.8

Claude Opus 4.8 foi desenvolvido para fluxos de trabalho exigentes de raciocínio, programação, análise e conhecimento profissional.

Claude Opus 4.6
Anthropic/Claude Opus 4.6

Raciocínio avançado para análise profunda e pensamento complexo.

Claude Sonnet 4.6
Anthropic/Claude Sonnet 4.6

Assistente de IA equilibrado com velocidade e precisão.

Claude Sonnet 4.5
Anthropic/Claude Sonnet 4.5

Assistente de IA confiável com desempenho geral sólido.

GLM-5.3
Zhipu/GLM-5.3

Use o GLM-5.3 para programação em escala de repositório, análise bilíngue, revisão por agentes e recomendações que exigem compensações explícitas.

Gemini 3.7 Flash
Google/Gemini 3.7 Flash

Use o Gemini 3.7 Flash para chat responsivo, ajuda focada em programação, processamento de documentos e cargas frequentes de API.

Grok 4.5
Grok/Grok 4.5

Use o Grok 4.5 para revisão de código, depuração, planejamento técnico e fluxos de trabalho de agente estáveis já validados nesta versão.

Grok 4.6
Grok/Grok 4.6

Avalie o Grok 4.6 para planejamento de implementação, depuração complexa, modernização de código e fluxos de trabalho de agentes de engenharia.

DeepSeek V4 Pro
Deepseek/DeepSeek V4 Pro

Use o DeepSeek V4 Pro quando um prompt exigir raciocínio mais profundo e uma recomendação final cuidadosa.

DeepSeek V4 Flash
Deepseek/DeepSeek V4 Flash

Use o DeepSeek V4 Flash como a rota de primeira passagem para tráfego técnico sensível a custos.

Kimi K2.7 Code
Moonshot/Kimi K2.7 Code

Use Kimi K2.7 Code quando o contexto do código for o gargalo.

Doubao Seed 2.1 Turbo
Doubao/Doubao Seed 2.1 Turbo

Use Doubao Seed 2.1 Turbo para tráfego de produção em chinês com alta velocidade.

GLM 5.2
Zhipu/GLM 5.2

Use o GLM 5.2 quando a qualidade do processo de raciocínio e conclusões estruturadas forem importantes.

MiniMax M3
Minimax/MiniMax M3

Use o MiniMax M3 quando documentos ou a memória do agente precisarem permanecer em uma única solicitação.

GPT-5.6 Sol
OpenAI/GPT-5.6 Sol

IA de fronteira para raciocínio avançado e tarefas complexas de inteligência.

GPT-5.6 Terra
OpenAI/GPT-5.6 Terra

IA de fronteira para raciocínio avançado e tarefas complexas de inteligência.

GPT-5.5
OpenAI/GPT-5.5

Modelo de raciocínio poderoso para análise e resolução de problemas.

GPT-5.4
OpenAI/GPT-5.4

IA de próxima geração para compreensão e geração criativa.

Qwen3.8 Max
Qwen/Qwen3.8 Max

Qwen3.8 Max é um modelo carro-chefe com contexto de 1M. Use Chat Completions para diálogo e PDF; use Responses para web_search, code_interpreter e busca de imagens.