Blog
FLUX 3 Video : fonctionnalités, disponibilité et comparaison avec FLUX.2
Black Forest Labs a lancé FLUX 3, un modèle multimodal qui génère des vidéos avec audio natif. Voici ce qu'il permet de faire et le calendrier de disponibilité de ses différentes versions.
Kimi Code vs Claude Code : le mythe des 19 $ en 2026
Kimi Code est souvent présenté comme le clone économique de Claude Code. Avec K3, ce calcul ne tient plus. Voici les tarifs vérifiés, un duel de code mené en conditions réelles, la configuration d’interopérabilité en deux lignes et le CLI à privilégier.
9 alternatives à Ollama qui répondent à ses limites
Un guide des alternatives à Ollama organisé par problème : tableau comparatif avec prise en charge mobile, besoins matériels de chaque outil, coût de migration quasi nul et cas où une API hébergée vaut mieux que l'exécution locale.
Cursor Router : du code avec l’IA 60 % moins cher, mais avec une limite
Lancé le 22 juillet 2026, Cursor Router dirige chaque requête de code vers le modèle compétent le moins cher. Voici ses critères, le coût de chaque mode Auto par commit, les limites du routage et les alternatives pour les abonnés Pro.
Gemini 3.5 Flash-Lite : prix, vitesse et cas d’usage
Gemini 3.5 Flash-Lite coûte 0,30 $/2,50 $ par million de tokens et génère environ 415 tokens par seconde. Lors de mes tests, il s’est révélé 93 % moins cher que 3.6 Flash sur des tâches simples. Voici quand choisir cette offre plus abordable.
Gemini 3.6 Flash vs 3.1 Pro : prix, vitesse et verdict
Gemini 3.6 Flash coûte moins cher, est plus rapide et surpasse 3.1 Pro dans la plupart des benchmarks de code et d’agents. 3.1 Pro ne garde l’avantage que sur les tâches de raisonnement pur les plus exigeantes. Voici le face-à-face, avec un test réalisé en conditions réelles.
API de détection NSFW vs vision LLM : j’ai testé les pièges
Comparaison pratique des APIs de détection NSFW et des détecteurs open source face à la vision LLM multimodale sur les mêmes images, avec la tarification, une matrice de décision et une recommandation hiérarchisée pour construire ou acheter.
16 prompts pour retoucher vos photos avec l’IA (avec de vrais avant/après)
Une bibliothèque de prompts d’éditeur photo IA à copier-coller, classés par tâche, avec la clause de verrouillage d’identité qui évite de déformer les visages. Tous ont été testés sur de vrais modèles d’édition d’image, avec résultats avant/après.
Claude Opus 5 : prix, changements incompatibles et date de sortie
Claude Opus 5 est sorti le 24 juillet 2026 sous l’identifiant claude-opus-5, au tarif d’Opus 4.8 : contexte de 1M, nouveau niveau d’effort max, thinking activé par défaut et deux changements incompatibles à vérifier avant la migration.
Qwen-Image-3.0 : comment l’utiliser gratuitement et ce qu’il coûte réellement
Guide pratique de Qwen-Image-3.0 : comment l’utiliser gratuitement dès aujourd’hui, pourquoi aucun tarif API annoncé n’est encore officiel, à qui le modèle s’adresse et comment il se compare à Nano Banana Pro et Seedream 5.
Qwen-Audio-3.0-TTS : le modèle TTS en tête de l’Arena
Qwen-Audio-3.0-TTS est le nouveau modèle de synthèse vocale hébergé d’Alibaba. Son offre Plus domine l’Arena TTS indépendante d’Artificial Analysis ; voici ses caractéristiques, benchmarks, tarifs et modalités d’accès.
API gratuite de Google AI Studio : ce qui est vraiment gratuit
Google AI Studio vous offre un niveau gratuit de l'API Gemini avec une vraie clé en moins d'une minute. Voici ce que couvre le terme « gratuit », où se situent les limites et le point à surveiller concernant l'entraînement des données.
Erreur Upstream Connect : ce qui ne fonctionne vraiment pas
Décryptage de l’erreur upstream connect sur ChatGPT et l’API OpenAI : signification des motifs de réinitialisation, pourquoi le problème se situe chez OpenAI, et comment réagir avec les pages de statut, les tentatives automatiques et le basculement.
Kimi K3 dans OpenCode : configuration et coût réel d’une session
Guide pratique pour utiliser Kimi K3 dans OpenCode : configuration exacte, tarifs vérifiés à 3 $/15 $, coût réel par session et pistes pour éviter que K3 ne consume trop de tokens.
Qwen3.8 Open Weights : date de sortie, fuites et attentes
Qwen3.8-Max-Preview est disponible, mais pas ses open weights. Voici le calendrier qui a fuité, la réserve autour des 2,4 T de paramètres, les premiers retours de testeurs et les signes qui confirmeront que les weights sont réellement sortis.
GLM-5.3 : date de sortie, fuites et ce qu’il faut attendre
GLM-5.3 n’a pas encore été annoncé officiellement. Le modèle le plus récent de Z.ai reste GLM-5.2, sorti le 16 juin. Voici l’analyse du rythme de publication, le sondage du cofondateur, les canaux de fuite à suivre et la base GLM-5.2 à utiliser dès maintenant.
Meilleure API de suppression d’arrière-plan : j’en ai testé 5 avec la même image
Une même image testée dans cinq pipelines de suppression d’arrière-plan : BiRefNet l’emporte en qualité, Replicate l’héberge à partir de 0,51 $ pour 1 000 images, les éditeurs à prompt échouent, et les poids gratuits de RMBG-2.0 interdisent l’usage commercial.
Meilleur LLM pour la traduction : 6 testés, dont 2 coûtent 10× plus cher
Test pratique de juillet 2026 : six LLM sur trois tâches de traduction (EN→JA marketing, EN→DE documentation, JA→EN dialogue), avec latence mesurée, consommation de tokens, coût par tâche et les cas où DeepL reste préférable.
Un prompt suffit pour créer un site 3D en 30 secondes (6 testés)
Six prompts complets de sites 3D, testés de bout en bout : cinq pages Three.js fonctionnelles et un échec riche d’enseignements. Rendus réels, comptes de tokens, temps de génération et anatomie d’un bon prompt.
Les poids ouverts de Kimi K3 sont disponibles : 1,56 To et le matériel nécessaire pour l’exécuter
Ce que Moonshot a réellement publié avec les poids ouverts de Kimi K3, ce qu’autorise la Kimi K3 License, le véritable minimum matériel pour auto-héberger un MoE de 2,8T, et les services qui le proposent aujourd’hui.