Tokens réels · 46 % part chinoise · volume≠qualité · couche apps · prévisions août
Vous choisissez encore vos modèles avec des benchmarks datés ? OpenRouter est la plus grande plateforme neutre de routage : son classement reflète la consommation réelle de tokens payants, pas le marketing. Cette analyse s'appuie sur les données au 25 juillet 2026 : Mimo V2.5 en tête, 46 % pour les éditeurs chinois, et une divergence nette entre capacité et popularité. Tableau Top 12, parts éditeurs, couche applications, comparaison tarifaire, runbook de routage en 6 étapes, prévisions août. Liens : analyse de juin, guide API OpenRouter.
Le classement officiel (openrouter.ai/rankings) ordonne les modèles par volume de tokens payants — il décrit ce que les développeurs déploient, pas le modèle le plus performant en laboratoire. Avant toute décision d'achat, clarifiez ces cinq points :
Confondre volume et qualité : un modèle bon marché derrière une application à fort trafic peut dominer le classement sans exceller en raisonnement complexe.
Ne regarder que le champion du jour : les rangs quotidiens fluctuent (Mimo V2.5 vs Claude Opus 4.8) ; croisez parts éditeurs et cumul 30 jours.
Oublier le levier prix : DeepSeek V4 Flash ~$0,05–0,14/M contre GPT-5.5 ~$5/M — écart d'environ 35× ; le classement est largement une équation économique.
Ignorer la couche applications : le classement modèles indique les « cerveaux » populaires ; le classement Apps révèle leur usage — agents de code et jeu de rôle absorbent une large part du trafic.
Sous-estimer sécurité et conformité : les incidents de sandbox et la régulation US renforcent le poids de la réputation éditeur dans les choix enterprise.
Avec ce cadre, le tableau de juillet devient un thermomètre de trafic, non un verdict de qualité.
Au 25 juillet 2026 — Top 12 par tokens journaliers et parts éditeurs (données live : openrouter.ai/rankings).
| Rang | Modèle | Éditeur | Tokens/jour | Cumul 30 j |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | Tencent | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B (gratuit) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | StepFun | 204.8B | 5.9T |
| 9 | Kimi K3 | Moonshot AI | 157.6B | 1.6T (nouveau) |
| 10 | Ling 3.0 Flash | Ant InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
| Éditeur | Origine | Part (approx.) |
|---|---|---|
| DeepSeek | Chine | 16%–18% (leader stable) |
| Xiaomi | Chine | 8%–18% (bond Mimo V2.5, volatilité max.) |
| Anthropic | États-Unis | 10%–15% |
| Tencent | Chine | 8%–13% |
| États-Unis | 8%–13% | |
| Éditeurs chinois ~46 % au total (il y a un an <2%); Trois géants US ~30 %–36 % (il y a un an ~70%) | ||
DeepSeek reste l'éditeur le plus stable, mais le « champion mensuel » passe de MiniMax M2.5 à MiMo-V2-Pro puis Mimo V2.5 — le rang du jour ne suffit pas.
| Modèle | Entrée/M | Sortie/M | Positionnement |
|---|---|---|---|
| DeepSeek V4 Flash | $0.05–0.14 | $0.24–0.28 | Meilleur rapport qualité-prix, agentic coding |
| GLM 5.2 | $0.45 | $3.31 | Open source proche d'Opus en planification |
| Kimi K3 | ~$3 | ~$15 | 1,4 To open weight, niveau closed source |
| Claude Opus 5 | $5 (tier rapide $10) | $25 (tier rapide $50) | Frontière fermée, FrontierBench 43,3 % |
Par part de dépense : dialogue général 35,7 %, workflows agent 30,4 %, code 26,5 %. Sur classification et raisonnement complexe : Claude Sonnet 4.6 et Opus 4.7 à 13,5 % chacun, GPT-5.5 à 11,6 % — les modèles open source bon marché sont quasi absents. Le marché est en haltère : open source pour le volume, closed source pour les tâches difficiles.
Que vous soyez développeur indépendant ou responsable plateforme, transformez les données OpenRouter en stratégie de routage (voir le tutoriel API OpenRouter pour le fallback).
Cartographier les buckets : volume (chat, créatif, RP, code simple) vs tâches difficiles (raisonnement, décisions agent à risque, classification stricte).
Tier volume : tester DeepSeek V4 Flash et GLM 5.2 ; mesurer adoption et taux d'erreur.
Tier difficile : router les blocages vers Claude Opus 5 ou GPT-5.6 — voir analyse Opus 5.
Chaîne fallback OpenRouter : basculer automatiquement sur 429 ou panne ; priorités dans le tableau models.
Suite d'évaluation interne : prompts réels chaque mois ; adoption, latence et facture plutôt que le rang seul.
Scorecard sécurité : historique sandbox, conformité, journaux d'audit pour agents autonomes.
Note : Depuis l'Europe, latence OpenRouter ~180–250 ms, pas de factures locales ; sandbox pour la R&D, relais conforme en production si nécessaire.
| Rang | Application | Type | Part (approx.) |
|---|---|---|---|
| 1 | Hermes Agent | Agent personnel/CLI | ~45% |
| 2 | Kilo Code | Agent de code | ~13% |
| 3 | OpenClaw | Agent généraliste | ~9% |
| 4 | Claude Code | Agent de code | ~6% |
| 5 | Descript | Production de contenu | ~4.5% |
| 6–10 | pi, Lemonade, ISEKAI ZERO, Janitor AI, Cline | Agent/jeu de rôle | 1.7%–3.3% |
Cline → Roo Code → Kilo Code partagent une lignée ; Kilo Code dépasse désormais Cline. Le jeu de rôle (Janitor AI, ISEKAI ZERO, SillyTavern) représente plus de 50 % du volume open source selon OpenRouter × a16z — rarement visible dans la presse enterprise.
Attention : Classement quotidien — vérifiez openrouter.ai/rankings avant publication ; comparez avec l'analyse de juin pour l'inflexion Mimo V2.5.
Chiffres directement citables (OpenRouter, au 2026-07-25) :
OpenRouter unifie le routage, mais les agents sur portable (Hermes, Kilo Code, OpenClaw) subissent veille et kills de processus ; un VPS Linux seul manque Apple Silicon et la toolchain macOS. Pour des agents de code 7×24 et pipelines iOS CI/CD, la location cloud Mac Mini VpsMesh offre nœuds dédiés et environnement auditable. Tarifs : tarifs location Mac Mini M4, aide : centre d'aide.
Au 25/07 : Mimo V2.5 ~1,4T tokens/jour, puis DeepSeek V4 Flash (943,9B) et Tencent Hy3 (590B). Rang live sur openrouter.ai/rankings.
Agrégat 7 jours : éditeurs chinois ~46 % ; DeepSeek seul 16–18 %. Ne pas confondre avec 61 % de juin — métriques différentes.
Non. Classement = volume ; tâches difficiles : Claude Sonnet 4.6/Opus 4.7 mènent les dépenses. Hôte agent stable : centre d'aide.
Code : DeepSeek V4 Flash + GLM 5.2, étapes lourdes vers Opus 5. OpenRouter en sandbox ; agent 7×24 : tarifs Mac Mini M4.
Kimi K3 entre en 9e place (157,6B/jour), meilleure progression ; 1,4 To open weight. Voir revue Kimi K3 et controverse distillation.