Tous les modèles
Parcourez tous les modèles IA disponibles, comparez les prix et les fonctionnalités, puis commencez l’intégration.

GPT-6.1 Sol is OpenAI's upgrade to GPT-6 Sol for demanding work across code, documents, and applications. It keeps the 1M-token context window and 128K output, supports reasoning effort up to max, and halves the price of cached input.

Xiaomi MiMo-V2.6-Pro active 42B paramètres par token pour les tâches d'ingénierie complexes. Appelez sous le nom mimo-v2.6-pro.

Xiaomi MiMo-V2.6-Flash offre un contexte de 1M pour ~1/3 du coût de Pro. Appelez sous le nom mimo-v2.6-flash.

TypeSafe Jev renvoie une probabilité, un choix ou un score.

Contexte de 1 048 576 tokens. Appeler en tant que muse-spark-1.3-contributor.

Claude Sonnet 5.5 conserve la tarification catalogue de Sonnet 5, tandis qu'Anthropic fait état d'une génération plus rapide et de moins de tokens par tâche, avec une fenêtre de contexte de 1M facturée à un tarif fixe unique.

Facturé à 20 % du tarif officiel : 0,40 $ en entrée, 0,10 $ en entrée en cache et 1,20 $ en sortie par million de tokens.

GPT-6 Sol est le modèle textuel phare d'OpenAI pour le codage exigeant, le raisonnement approfondi et le travail d'agent à long terme, avec une fenêtre de contexte de 1M de tokens.

Environ 0,057 $ en entrée et 0,193 $ en sortie par million de tokens, soit la moitié du tarif Chine à 0,8 ¥ / 2,7 ¥. La lecture du cache correspond à 12,5 % de l'entrée et l'écriture du cache à 125 % de l'entrée. Aucun frais par appel d'outil. Le contexte hébergé est de 1M de tokens.

Claude Opus 5.5 réduit le tarif de base d'Opus 5 de 20 % et les lectures de cache de 60 %, avec une fenêtre de contexte de 1M facturée à un tarif fixe unique.

DeepSeek V4.1 Flash est un nouveau MoE de 552B avec 8B à 16B de paramètres actifs, un contexte de 1M, une entrée d'image native et les meilleurs scores Terminal-Bench et DeepSWE de la gamme DeepSeek. AIReiter le facture en dessous du tarif officiel hors pointe, sans supplément pour les heures de pointe.

Modèle de pointe d'OpenAI pour le raisonnement complexe, la programmation et les tâches à contexte long.

GPT-6 Luna est le modèle économique et à haut débit de la famille GPT-6, doté d'une fenêtre de contexte de 1M de tokens et offrant des réponses rapides pour la synthèse, l'extraction et les questions du quotidien.

Développez avec Gemini 3.8 Flash pour l'ingénierie logicielle, les agents autonomes et les tâches d'entreprise complexes.

Claude Fable 5.1 conserve la tarification de Fable 5 pour les entrées et sorties, divise par quatre le coût de lecture du cache et est conçu pour le codage agentique de longue durée et le travail documentaire.

GLM-5.3 Flash lit à la fois le texte et les images avec un contexte de 1M tokens et une sortie de 128K, tarifé pour les charges de travail que vous exécutez des milliers de fois par jour. GLM-5.3 lui-même est uniquement textuel.

Gemini 3.6 Flash combine vitesse et intelligence pour le raisonnement avancé, le codage, la compréhension multimodale et les flux de travail agentiques.

Intelligence multimodale pour comprendre des informations diverses.

Kimi K3 est un modèle de raisonnement à long contexte disponible via une API Chat Completions compatible avec OpenAI, adapté à la compréhension du code, à l’écriture, à l’analyse et aux workflows de type agent.

Modèle de raisonnement approfondi pour la résolution de problèmes complexes.

IA multimodale haute performance pour des applications variées.

Claude Opus 5 est adapté au raisonnement exigeant, au codage avancé, à l’analyse, à la rédaction longue et aux workflows agentiques via l’Anthropic Messages API.

Claude Fable 5 est un modèle premium pour le raisonnement approfondi, l'analyse complexe, la création de contenus longs et les workflows d'agent exigeants.

Claude Sonnet 5 équilibre intelligence, rapidité et coût pour le raisonnement avancé, le codage, la rédaction et le travail professionnel au quotidien.

Claude Opus 4.8 est conçu pour les tâches de raisonnement exigeantes, le codage, l'analyse et les workflows de connaissances professionnelles.

Raisonnement avancé pour une analyse approfondie et une réflexion complexe.

Assistant IA équilibré, alliant rapidité et précision.

Assistant IA fiable avec de solides performances globales.

Utilisez GLM-5.3 pour le codage à l’échelle d’un dépôt, l’analyse bilingue, la revue par agents et les recommandations nécessitant des arbitrages explicites.

Utilisez Gemini 3.7 Flash pour un chat réactif, une aide ciblée au codage, le traitement de documents et des charges de travail API fréquentes.

Utilisez Grok 4.5 pour la revue de code, le débogage, la planification technique et des workflows agents stables déjà validés sur cette version.

Évaluez Grok 4.6 pour la planification d'implémentation, le débogage complexe, la modernisation du code et les workflows d'agent d'ingénierie.

Utilisez DeepSeek V4 Pro lorsqu’une requête nécessite un raisonnement plus poussé et une recommandation finale prudente.

Utilisez DeepSeek V4 Flash comme première option pour le trafic technique sensible aux coûts.

Utilisez Kimi K2.7 Code lorsque le contexte du code est le facteur limitant.

Utilisez Doubao Seed 2.1 Turbo pour un trafic de production en chinois rapide.

Utilisez GLM 5.2 lorsque la qualité du fil de raisonnement et des conclusions structurées sont importantes.

Utilisez MiniMax M3 lorsque les documents ou la mémoire de l’agent doivent rester dans une seule requête.

IA de pointe pour le raisonnement avancé et les tâches d’intelligence complexes.

IA de pointe pour le raisonnement avancé et les tâches d’intelligence complexes.

Modèle de raisonnement puissant pour l'analyse et la résolution de problèmes.

IA de nouvelle génération pour la compréhension et la génération créative.

Qwen3.8 Max est un modèle phare à contexte de 1 M. Utilisez Chat Completions pour les dialogues et les PDF ; utilisez Responses pour web_search, code_interpreter et la recherche d'images.