Tous les modèles

Parcourez tous les modèles IA disponibles, comparez les prix et les fonctionnalités, puis commencez l’intégration.

GPT-6.1 Sol
OpenAI/GPT-6.1 Sol

GPT-6.1 Sol is OpenAI's upgrade to GPT-6 Sol for demanding work across code, documents, and applications. It keeps the 1M-token context window and 128K output, supports reasoning effort up to max, and halves the price of cached input.

MiMo V2.6 Pro
Xiaomi/MiMo V2.6 Pro

Xiaomi MiMo-V2.6-Pro active 42B paramètres par token pour les tâches d'ingénierie complexes. Appelez sous le nom mimo-v2.6-pro.

MiMo V2.6 Flash
Xiaomi/MiMo V2.6 Flash

Xiaomi MiMo-V2.6-Flash offre un contexte de 1M pour ~1/3 du coût de Pro. Appelez sous le nom mimo-v2.6-flash.

Jev
Cloudflare/Jev

TypeSafe Jev renvoie une probabilité, un choix ou un score.

Muse Spark 1.3 Contributor
meta/Muse Spark 1.3 Contributor

Contexte de 1 048 576 tokens. Appeler en tant que muse-spark-1.3-contributor.

Claude Sonnet 5.5
Anthropic/Claude Sonnet 5.5

Claude Sonnet 5.5 conserve la tarification catalogue de Sonnet 5, tandis qu'Anthropic fait état d'une génération plus rapide et de moins de tokens par tâche, avec une fenêtre de contexte de 1M facturée à un tarif fixe unique.

Grok 4.7
Grok/Grok 4.7

Facturé à 20 % du tarif officiel : 0,40 $ en entrée, 0,10 $ en entrée en cache et 1,20 $ en sortie par million de tokens.

GPT-6 Sol
OpenAI/GPT-6 Sol

GPT-6 Sol est le modèle textuel phare d'OpenAI pour le codage exigeant, le raisonnement approfondi et le travail d'agent à long terme, avec une fenêtre de contexte de 1M de tokens.

Qwen3.8 Flash
Qwen/Qwen3.8 Flash

Environ 0,057 $ en entrée et 0,193 $ en sortie par million de tokens, soit la moitié du tarif Chine à 0,8 ¥ / 2,7 ¥. La lecture du cache correspond à 12,5 % de l'entrée et l'écriture du cache à 125 % de l'entrée. Aucun frais par appel d'outil. Le contexte hébergé est de 1M de tokens.

Claude Opus 5.5
Anthropic/Claude Opus 5.5

Claude Opus 5.5 réduit le tarif de base d'Opus 5 de 20 % et les lectures de cache de 60 %, avec une fenêtre de contexte de 1M facturée à un tarif fixe unique.

DeepSeek V4.1 Flash
Deepseek/DeepSeek V4.1 Flash

DeepSeek V4.1 Flash est un nouveau MoE de 552B avec 8B à 16B de paramètres actifs, un contexte de 1M, une entrée d'image native et les meilleurs scores Terminal-Bench et DeepSWE de la gamme DeepSeek. AIReiter le facture en dessous du tarif officiel hors pointe, sans supplément pour les heures de pointe.

GPT-6 Astra
OpenAI/GPT-6 Astra

Modèle de pointe d'OpenAI pour le raisonnement complexe, la programmation et les tâches à contexte long.

GPT-6 Luna
OpenAI/GPT-6 Luna

GPT-6 Luna est le modèle économique et à haut débit de la famille GPT-6, doté d'une fenêtre de contexte de 1M de tokens et offrant des réponses rapides pour la synthèse, l'extraction et les questions du quotidien.

Gemini 3.8 Flash
Google/Gemini 3.8 Flash

Développez avec Gemini 3.8 Flash pour l'ingénierie logicielle, les agents autonomes et les tâches d'entreprise complexes.

Claude Fable 5.1
Anthropic/Claude Fable 5.1

Claude Fable 5.1 conserve la tarification de Fable 5 pour les entrées et sorties, divise par quatre le coût de lecture du cache et est conçu pour le codage agentique de longue durée et le travail documentaire.

GLM-5.3 Flash
Zhipu/GLM-5.3 Flash

GLM-5.3 Flash lit à la fois le texte et les images avec un contexte de 1M tokens et une sortie de 128K, tarifé pour les charges de travail que vous exécutez des milliers de fois par jour. GLM-5.3 lui-même est uniquement textuel.

Gemini 3.6 Flash
Google/Gemini 3.6 Flash

Gemini 3.6 Flash combine vitesse et intelligence pour le raisonnement avancé, le codage, la compréhension multimodale et les flux de travail agentiques.

Gemini 3.1 Pro
Google/Gemini 3.1 Pro

Intelligence multimodale pour comprendre des informations diverses.

Kimi K3
Moonshot/Kimi K3

Kimi K3 est un modèle de raisonnement à long contexte disponible via une API Chat Completions compatible avec OpenAI, adapté à la compréhension du code, à l’écriture, à l’analyse et aux workflows de type agent.

Gemini 3 Pro
Google/Gemini 3 Pro

Modèle de raisonnement approfondi pour la résolution de problèmes complexes.

Gemini 2.5 Pro
Google/Gemini 2.5 Pro

IA multimodale haute performance pour des applications variées.

Claude Opus 5
Anthropic/Claude Opus 5

Claude Opus 5 est adapté au raisonnement exigeant, au codage avancé, à l’analyse, à la rédaction longue et aux workflows agentiques via l’Anthropic Messages API.

Claude Fable 5
Anthropic/Claude Fable 5

Claude Fable 5 est un modèle premium pour le raisonnement approfondi, l'analyse complexe, la création de contenus longs et les workflows d'agent exigeants.

Claude Sonnet 5
Anthropic/Claude Sonnet 5

Claude Sonnet 5 équilibre intelligence, rapidité et coût pour le raisonnement avancé, le codage, la rédaction et le travail professionnel au quotidien.

Claude Opus 4.8
Anthropic/Claude Opus 4.8

Claude Opus 4.8 est conçu pour les tâches de raisonnement exigeantes, le codage, l'analyse et les workflows de connaissances professionnelles.

Claude Opus 4.6
Anthropic/Claude Opus 4.6

Raisonnement avancé pour une analyse approfondie et une réflexion complexe.

Claude Sonnet 4.6
Anthropic/Claude Sonnet 4.6

Assistant IA équilibré, alliant rapidité et précision.

Claude Sonnet 4.5
Anthropic/Claude Sonnet 4.5

Assistant IA fiable avec de solides performances globales.

GLM-5.3
Zhipu/GLM-5.3

Utilisez GLM-5.3 pour le codage à l’échelle d’un dépôt, l’analyse bilingue, la revue par agents et les recommandations nécessitant des arbitrages explicites.

Gemini 3.7 Flash
Google/Gemini 3.7 Flash

Utilisez Gemini 3.7 Flash pour un chat réactif, une aide ciblée au codage, le traitement de documents et des charges de travail API fréquentes.

Grok 4.5
Grok/Grok 4.5

Utilisez Grok 4.5 pour la revue de code, le débogage, la planification technique et des workflows agents stables déjà validés sur cette version.

Grok 4.6
Grok/Grok 4.6

Évaluez Grok 4.6 pour la planification d'implémentation, le débogage complexe, la modernisation du code et les workflows d'agent d'ingénierie.

DeepSeek V4 Pro
Deepseek/DeepSeek V4 Pro

Utilisez DeepSeek V4 Pro lorsqu’une requête nécessite un raisonnement plus poussé et une recommandation finale prudente.

DeepSeek V4 Flash
Deepseek/DeepSeek V4 Flash

Utilisez DeepSeek V4 Flash comme première option pour le trafic technique sensible aux coûts.

Kimi K2.7 Code
Moonshot/Kimi K2.7 Code

Utilisez Kimi K2.7 Code lorsque le contexte du code est le facteur limitant.

Doubao Seed 2.1 Turbo
Doubao/Doubao Seed 2.1 Turbo

Utilisez Doubao Seed 2.1 Turbo pour un trafic de production en chinois rapide.

GLM 5.2
Zhipu/GLM 5.2

Utilisez GLM 5.2 lorsque la qualité du fil de raisonnement et des conclusions structurées sont importantes.

MiniMax M3
Minimax/MiniMax M3

Utilisez MiniMax M3 lorsque les documents ou la mémoire de l’agent doivent rester dans une seule requête.

GPT-5.6 Sol
OpenAI/GPT-5.6 Sol

IA de pointe pour le raisonnement avancé et les tâches d’intelligence complexes.

GPT-5.6 Terra
OpenAI/GPT-5.6 Terra

IA de pointe pour le raisonnement avancé et les tâches d’intelligence complexes.

GPT-5.5
OpenAI/GPT-5.5

Modèle de raisonnement puissant pour l'analyse et la résolution de problèmes.

GPT-5.4
OpenAI/GPT-5.4

IA de nouvelle génération pour la compréhension et la génération créative.

Qwen3.8 Max
Qwen/Qwen3.8 Max

Qwen3.8 Max est un modèle phare à contexte de 1 M. Utilisez Chat Completions pour les dialogues et les PDF ; utilisez Responses pour web_search, code_interpreter et la recherche d'images.