OpenRouter juillet 2026
Analyse du classement LLM

Tokens réels · 46 % part chinoise · volume≠qualité · couche apps · prévisions août

Classement OpenRouter juillet 2026 parts par éditeur

Vous choisissez encore vos modèles avec des benchmarks datés ? OpenRouter est la plus grande plateforme neutre de routage : son classement reflète la consommation réelle de tokens payants, pas le marketing. Cette analyse s'appuie sur les données au 25 juillet 2026 : Mimo V2.5 en tête, 46 % pour les éditeurs chinois, et une divergence nette entre capacité et popularité. Tableau Top 12, parts éditeurs, couche applications, comparaison tarifaire, runbook de routage en 6 étapes, prévisions août. Liens : analyse de juin, guide API OpenRouter.

01

Lire le classement OpenRouter : cinq angles morts avant de décider

Le classement officiel (openrouter.ai/rankings) ordonne les modèles par volume de tokens payants — il décrit ce que les développeurs déploient, pas le modèle le plus performant en laboratoire. Avant toute décision d'achat, clarifiez ces cinq points :

  1. 01

    Confondre volume et qualité : un modèle bon marché derrière une application à fort trafic peut dominer le classement sans exceller en raisonnement complexe.

  2. 02

    Ne regarder que le champion du jour : les rangs quotidiens fluctuent (Mimo V2.5 vs Claude Opus 4.8) ; croisez parts éditeurs et cumul 30 jours.

  3. 03

    Oublier le levier prix : DeepSeek V4 Flash ~$0,05–0,14/M contre GPT-5.5 ~$5/M — écart d'environ 35× ; le classement est largement une équation économique.

  4. 04

    Ignorer la couche applications : le classement modèles indique les « cerveaux » populaires ; le classement Apps révèle leur usage — agents de code et jeu de rôle absorbent une large part du trafic.

  5. 05

    Sous-estimer sécurité et conformité : les incidents de sandbox et la régulation US renforcent le poids de la réputation éditeur dans les choix enterprise.

Avec ce cadre, le tableau de juillet devient un thermomètre de trafic, non un verdict de qualité.

02

OpenRouter juillet 2026 : tableaux modèles et éditeurs

Au 25 juillet 2026 — Top 12 par tokens journaliers et parts éditeurs (données live : openrouter.ai/rankings).

Top 12 modèles par tokens/jour (25/07)

RangModèleÉditeurTokens/jourCumul 30 j
1Mimo V2.5Xiaomi1.4T31.2T
2DeepSeek V4 FlashDeepSeek943.9B23.6T
3Hy3Tencent590B23.4T
4Nemotron 3 Ultra 550B (gratuit)NVIDIA428.6B9T
5DeepSeek V4 ProDeepSeek413.7B11.6T
6GLM 5.2Z.ai316.7B13.3T
7MiniMax M3MiniMax262.5B15.1T
8Step 3.7 FlashStepFun204.8B5.9T
9Kimi K3Moonshot AI157.6B1.6T (nouveau)
10Ling 3.0 FlashAnt InclusionAI128.3B417.3B
11Gemini 3 Flash PreviewGoogle106.3B4T
12Claude Sonnet 5Anthropic99.5B3.6T

Parts par éditeur (agrégat 7 jours, approx.)

ÉditeurOriginePart (approx.)
DeepSeekChine16%–18% (leader stable)
XiaomiChine8%–18% (bond Mimo V2.5, volatilité max.)
AnthropicÉtats-Unis10%–15%
TencentChine8%–13%
GoogleÉtats-Unis8%–13%
Éditeurs chinois ~46 % au total (il y a un an <2%); Trois géants US ~30 %–36 % (il y a un an ~70%)

DeepSeek reste l'éditeur le plus stable, mais le « champion mensuel » passe de MiniMax M2.5 à MiMo-V2-Pro puis Mimo V2.5 — le rang du jour ne suffit pas.

Prix et positionnement (volume vs tâches difficiles)

ModèleEntrée/MSortie/MPositionnement
DeepSeek V4 Flash$0.05–0.14$0.24–0.28Meilleur rapport qualité-prix, agentic coding
GLM 5.2$0.45$3.31Open source proche d'Opus en planification
Kimi K3~$3~$151,4 To open weight, niveau closed source
Claude Opus 5$5 (tier rapide $10)$25 (tier rapide $50)Frontière fermée, FrontierBench 43,3 %

Par part de dépense : dialogue général 35,7 %, workflows agent 30,4 %, code 26,5 %. Sur classification et raisonnement complexe : Claude Sonnet 4.6 et Opus 4.7 à 13,5 % chacun, GPT-5.5 à 11,6 % — les modèles open source bon marché sont quasi absents. Le marché est en haltère : open source pour le volume, closed source pour les tâches difficiles.

03

Runbook en 6 étapes : routage par niveau de tâche

Que vous soyez développeur indépendant ou responsable plateforme, transformez les données OpenRouter en stratégie de routage (voir le tutoriel API OpenRouter pour le fallback).

  1. 01

    Cartographier les buckets : volume (chat, créatif, RP, code simple) vs tâches difficiles (raisonnement, décisions agent à risque, classification stricte).

  2. 02

    Tier volume : tester DeepSeek V4 Flash et GLM 5.2 ; mesurer adoption et taux d'erreur.

  3. 03

    Tier difficile : router les blocages vers Claude Opus 5 ou GPT-5.6 — voir analyse Opus 5.

  4. 04

    Chaîne fallback OpenRouter : basculer automatiquement sur 429 ou panne ; priorités dans le tableau models.

  5. 05

    Suite d'évaluation interne : prompts réels chaque mois ; adoption, latence et facture plutôt que le rang seul.

  6. 06

    Scorecard sécurité : historique sandbox, conformité, journaux d'audit pour agents autonomes.

Note : Depuis l'Europe, latence OpenRouter ~180–250 ms, pas de factures locales ; sandbox pour la R&D, relais conforme en production si nécessaire.

04

Couche apps : agents de code et prévisions août

OpenRouter Apps Top 10 (part tokens, approx.)

RangApplicationTypePart (approx.)
1Hermes AgentAgent personnel/CLI~45%
2Kilo CodeAgent de code~13%
3OpenClawAgent généraliste~9%
4Claude CodeAgent de code~6%
5DescriptProduction de contenu~4.5%
6–10pi, Lemonade, ISEKAI ZERO, Janitor AI, ClineAgent/jeu de rôle1.7%–3.3%

Cline → Roo Code → Kilo Code partagent une lignée ; Kilo Code dépasse désormais Cline. Le jeu de rôle (Janitor AI, ISEKAI ZERO, SillyTavern) représente plus de 50 % du volume open source selon OpenRouter × a16z — rarement visible dans la presse enterprise.

Cinq prévisions pour août

  • Part open source chinoise en hausse — possiblement 50 % en 2026 sans baisse massive des prix US.
  • Champion mensuel instable — guerre des prix entre Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot.
  • Anthropic pourrait pousser un modèle plus abordable — Opus 5 est déjà la quatrième vague flagship en deux mois.
  • Poids 1,4 To de Kimi K3 — quantisation communautaire sous 2–4 semaines ; voir revue Kimi K3.
  • Sécurité et conformité comme contraintes dures — sandbox OpenAI, loi US « kill switch » et cadre White House avant août.

Attention : Classement quotidien — vérifiez openrouter.ai/rankings avant publication ; comparez avec l'analyse de juin pour l'inflexion Mimo V2.5.

05

Données citables et passage en production

Chiffres directement citables (OpenRouter, au 2026-07-25) :

  • Champion journalier : Mimo V2.5 ~1,4T tokens/jour.
  • Renversement de parts : éditeurs chinois ~46 %, de <2 % en 12 mois.
  • Ancre prix : DeepSeek V4 Flash vs GPT-5.5 input ~35×.
  • Concentration apps : Hermes Agent ~45 % des tokens apps.
  • Ancre qualité : Claude Opus 5 FrontierBench v0.1 43,3 % vs GPT-5.6 Sol 37,5 %.

OpenRouter unifie le routage, mais les agents sur portable (Hermes, Kilo Code, OpenClaw) subissent veille et kills de processus ; un VPS Linux seul manque Apple Silicon et la toolchain macOS. Pour des agents de code 7×24 et pipelines iOS CI/CD, la location cloud Mac Mini VpsMesh offre nœuds dédiés et environnement auditable. Tarifs : tarifs location Mac Mini M4, aide : centre d'aide.

FAQ

Questions fréquentes

Au 25/07 : Mimo V2.5 ~1,4T tokens/jour, puis DeepSeek V4 Flash (943,9B) et Tencent Hy3 (590B). Rang live sur openrouter.ai/rankings.

Agrégat 7 jours : éditeurs chinois ~46 % ; DeepSeek seul 16–18 %. Ne pas confondre avec 61 % de juin — métriques différentes.

Non. Classement = volume ; tâches difficiles : Claude Sonnet 4.6/Opus 4.7 mènent les dépenses. Hôte agent stable : centre d'aide.

Code : DeepSeek V4 Flash + GLM 5.2, étapes lourdes vers Opus 5. OpenRouter en sandbox ; agent 7×24 : tarifs Mac Mini M4.

Kimi K3 entre en 9e place (157,6B/jour), meilleure progression ; 1,4 To open weight. Voir revue Kimi K3 et controverse distillation.