Blog
GLM-5.3-Flash : test, identité Ox Alpha, prix et limites
Test pratique de GLM-5.3-Flash : révélation de l’identité d’Ox Alpha, caractéristiques officielles, tarifs API, limites des benchmarks, besoins matériels en local et profils auxquels le modèle s’adresse.
Qwen3.8-Flash-Next : aperçu de l’architecture de Qwen4
Qwen3.8-Flash-Next préfigure l’architecture de Qwen4 : 125B paramètres au total, 6B actifs par token, GDN et attention clairsemée. Le point sur les spécifications, le matériel et les précautions avant sa sortie.
OpenRouter BYOK : frais, basculement et rotation des clés (2026)
Guide pratique d’OpenRouter BYOK : allocation gratuite actuelle, coûts de fallback, limites des fournisseurs, isolation des workspaces et rotation de clés sans interruption.
OpenRouter MCP : configuration, appels de modèles et vrais compromis
Guide pratique d’OpenRouter MCP : serveur distant officiel, configuration des clients, tests de modèles, facturation, confidentialité et arbitrage face aux API directes et aux serveurs MCP propres aux fournisseurs.
Test des prompts MiniMax H3 : ce qui fonctionne, ce qui casse (2026)
Format officiel MiniMax H3 contre retours d’utilisateurs : structure et langage caméra tiennent leurs promesses, l’audio reste le maillon faible, et les guillemets font parfois mieux que les balises <d>. Avec diagnostic des échecs et coût en tokens.
Lucy 2.5 Realtime Video : latence, coût et configuration de l’API
Audit de Lucy 2.5 realtime video de Decart : résolution réellement proposée par l’API, mesure des promesses de latence, coûts horaires chez Decart et fal, modes d’édition et cas d’usage à envisager dès maintenant.
Sorties structurées OpenRouter : pourquoi votre schéma est ignoré
Sorties structurées OpenRouter : niveaux d’application, six modes d’échec selon les modèles et fournisseurs, durcissement des requêtes, parsing en streaming, limites de Response Healing et test rapide en 10 appels.
Tarifs de Meta Muse Code : Contributor ou Standard (2026)
Muse Code facture au token, sans offre gratuite ni plafond de dépense. Contributor réduit le coût des entrées de 12,5x et celui des sorties de 21,25x, mais accorde à Meta des droits d'entraînement et impose une limite de 60 RPM. Voici les calculs et le tableau de décision.
Arrêt de l’OpenAI Assistants API : guide de migration vers Responses API
OpenAI met fin à l’Assistants API le 26 août 2026 : correspondances d’objets, migration des outils intégrés, retours d’équipes déjà passées à Responses, options de gestion d’état et plan adapté au temps restant.
Test de l’API GLM-5.2 : ce qui fonctionne, ce qui casse (2026)
Un test de l’API GLM-5.2 centré sur l’intégration : les limites de la compatibilité OpenAI, le comportement des appels d’outils dans les boucles longues, le coût des 429 et du cache, ainsi qu’un test de validation de 30 minutes avant mise en production.
Mise en cache des prompts avec OpenRouter : pourquoi vos caches ne sont jamais utilisés
Comment OpenRouter facture la mise en cache des prompts selon le fournisseur, vérifier les accès au cache avec cached_tokens, identifier les quatre pannes qui font chuter le taux de réussite et appliquer les correctifs dans le bon ordre pour retrouver les économies.
Guide de migration vers Anthropic Python SDK v1.0 : ce qui casse
anthropic 1.0.0 est sorti le 20 août 2026 : couche HTTP httpx2, Python 3.10+, suppression de Text Completions et des paramètres d’échantillonnage. Erreurs visibles ou silencieuses, tableau complet des suppressions et ordre de migration.
Guide API DeepSeek V4 Flash Vision Exp : limites et exemples
Guide pratique de DeepSeek V4 Flash Vision Exp : identifiant du modèle, méthodes d’envoi d’images, facturation des tokens, limites, formats d’API et recommandation prudente pour la production.
Claude Skills API : ce que la GA change et comment l’utiliser
Anthropic a fait passer la Skills API, computer use et la Files API en disponibilité générale le 20 août 2026. Voici les changements, l’ajout de skills aux appels API, les règles d’import et de versioning, ainsi que les problèmes réels d’activation rencontrés par les utilisateurs.
Qwen-UI-Agent : benchmarks officiels et modalités d’accès
Tous les benchmarks officiels de Qwen-UI-Agent réunis au même endroit — tableaux MobileWorld, OSWorld-Verified, WebArena et ScreenSpot-Pro avec comparatifs — ainsi qu’un point précis sur ce qui est public : rapport, dépôts et poids de MAI-UI.
Mistral Agentic Search : fonctionnement et résultats chiffrés
Mistral Agentic Search (20 août 2026) enveloppe votre index dans une boucle de récupération à cinq outils. Benchmarks officiels : jusqu’à +59 points de précision sur FinanceBench, 24 à 34 % de tokens en moins ; tarifs non publiés.
LFM2.5 QAD Q4_0 GGUF : choisir le bon fichier et comprendre les chiffres
Les checkpoints QAD Q4_0 de Liquid AI pour LFM2.5 préservent 96,5 à 97,4 % de la qualité BF16 au format 4 bits. Voici ce que change QAD, le piège de nommage entre fichiers de même taille, les commandes de téléchargement exactes et les cas où QAD est préférable à Q4_K_M.
Meilleures alternatives à GLM-5.2 en 2026 : le bon choix selon votre raison de changer
Comparatif des alternatives à GLM-5.2 selon les prix API officiels, le contexte et les licences, avec une recommandation pour chaque motif concret de changement : quotas épuisés, agents instables, auto-hébergement ou coût. Deux pistes de mise à niveau sont également incluses.
Guide Real-ESRGAN (2026) : modèles, téléchargements, GUI, ncnn-vulkan
Guide pratique de Real-ESRGAN : tous les fichiers de modèles expliqués, commandes portables ncnn-vulkan, Python avec GFPGAN, meilleures GUI et cas où Topaz ou SeedVR2 sont préférables.
AI Image Extender : 10 outils gratuits et leurs pièges à l’inscription (2026)
Comparatif de dix AI image extenders selon les conditions de leurs offres gratuites : sans inscription ou non, filigranes, réduction de résolution, et un test de 60 secondes avant de croire à la gratuité.