AIREITER
GrokText Chat

Grok 4.5

Essayez Grok 4.5 en ligne pour le codage, les workflows d’agents, l’analyse structurée, la sortie en streaming, la mise en cache des prompts et l’accès à l’API Chat Completions.

EntréeOfficiel $2.00 par million de tokensAIReiter $0.40 par million de tokensSortieOfficiel $6.00 par million de tokensAIReiter $1.20 par million de tokensLecture cacheOfficiel $0.30 par million de tokensAIReiter $0.06 par million de tokens
Exécuter avec l'API

ENTRÉE

SORTIE

Example
Generated in
42.7 seconds
Token d’entrée
134
Token de sortie
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Détails du modèle

Utilisez la même clé de modèle dans le Playground, les requêtes API et les workflows internes.

ID du modèle
grok-4.5
Fournisseur
Grok
Protocole
OpenAI Chat Completions
Fenêtre de contexte
500,000 tokens
Sortie maximale
8,192 tokens
Token d’entrée
40 crédits / 1 M de tokens
Token de sortie
120 crédits / 1 M de tokens
Lecture du cache
6 crédits / 1 M de tokens
Écriture du cache
-

Ce que vous pouvez faire avec Grok 4.5

Un modèle pour le codage et les workflows agentiques avec génération configurable et mise en cache des prompts.

Codage et débogage

Passez en revue les plans d’implémentation, traquez les défauts, expliquez du code peu familier et proposez des correctifs ciblés.

Workflows agentiques

Planifiez des tâches en plusieurs étapes et évaluez les résultats de workflows logiciels et d’ingénierie pilotés par des outils.

Analyse structurée

Renvoyez les décisions, les risques et les listes d’actions dans un format exploitable par les systèmes en aval.

Trafic API conscient du cache

Réutilisez des préfixes de prompt stables et vérifiez les économies via prompt_tokens_details.cached_tokens.

Cas d’utilisation de Grok 4.5

Particulièrement adapté aux travaux d’ingénierie qui bénéficient du raisonnement et de l’amélioration itérative.
01

Revue de pull request

Repérez les hypothèses risquées, les tests manquants et les problèmes de compatibilité avant la mise en production d’un changement.

02

Investigation d’incident

Combinez les logs, les symptômes et le contexte du code en causes classées par priorité et en un plan de vérification.

03

Assistants pour développeurs

Prenez en charge l’implémentation, la documentation, la conception des tests et les explications techniques dans un seul workflow.

04

Automatisation API

Exécutez des tâches répétées d’analyse et de transformation avec une sortie en streaming et une utilisation visible des tokens.

Devez-vous utiliser Grok 4.5 ou Grok 4.6 ?

Conservez cette page utile pour les intégrations Grok 4.5 existantes tout en rendant le chemin de mise à niveau explicite.

Conservez Grok 4.5 si

Votre ensemble d’évaluation passe déjà, l’intégration est stable et changer de modèle ajouterait un risque de régression.

Évaluez Grok 4.6 si

Vous démarrez un nouveau workflow de codage ou souhaitez retester des tâches agentiques difficiles avec la nouvelle route.

Ne migrez pas sur la base d’un simple titre

Comparez les deux modèles sur votre propre code, votre cible de latence, le comportement du cache et le taux de réponses acceptées.

Utilisez le routage quand c’est utile

Conservez le trafic prévisible sur 4.5 et envoyez uniquement les travaux plus difficiles ou nouvellement évalués vers 4.6.

Comment utiliser Grok 4.5

Testez la même charge de travail que vous prévoyez d’envoyer via l’API.

01

Exécutez une requête représentative

Utilisez du code réel ou un contexte de workflow plutôt qu’une question de benchmark générique.

02

Vérifiez la sortie et l’utilisation

Inspectez la qualité de la complétion, la latence, les tokens d’entrée, les tokens de sortie et les tokens d’entrée mis en cache.

03

Connectez les Chat Completions

Appelez POST https://aireiter.com/api/v1/chat/completions avec model "grok-4.5" et stream=true lorsque nécessaire.

Questions sur l’API Grok 4.5

Questions pratiques sur la compatibilité, la mise en cache et la mise à niveau.

/ 01

Grok 4.5 vaut-il encore la peine d’être utilisé ?

Oui, pour les charges de travail déjà validées avec lui. Les nouvelles intégrations devraient le comparer directement à Grok 4.6 avant de choisir une valeur par défaut.

/ 02

Quel protocole API cette route utilise-t-elle ?

Utilisez le point de terminaison Chat Completions compatible OpenAI avec model "grok-4.5".

/ 03

Quelle fenêtre de contexte est indiquée ?

La page indique une fenêtre de contexte de 500K tokens. Les requêtes à partir de 200K peuvent avoir une économie amont différente, alors vérifiez le tarif AIReiter actuel.

/ 04

Comment confirmer la mise en cache des prompts ?

Vérifiez usage.prompt_tokens_details.cached_tokens. Une requête répétée sans nombre positif de tokens mis en cache n’est pas une confirmation de cache.

/ 05

Comment dois-je comparer Grok 4.5 et 4.6 ?

Utilisez la même tâche de code, la même limite de réponse et la même grille d’acceptation, puis comparez le taux de réussite, la latence et l’utilisation réelle des tokens.