Echte Token-Nutzung · 46 % China-Anteil · Volumen≠Qualität · App-Layer · August-Prognose
Noch Benchmarks von vor Monaten für die Modellauswahl? OpenRouter ist die größte neutrale Routing-Plattform — das Ranking misst bezahlte Token-Nutzung, nicht Marketing. Dieser datenbasierte Bericht nutzt den Stand 25. Juli 2026: Xiaomi Mimo V2.5 an der Spitze, chinesische Anbieter bei 46 %, Capability und Popularität divergieren. Enthält Top-12-Tabelle, Anbieteranteile, App-Ranking, Preisvergleich, 6-Schritte-Routing-Runbook, August-Prognose sowie DSGVO-relevante Enterprise-Hinweise. Verknüpft mit Juni-Analyse und OpenRouter-API-Leitfaden.
Das offizielle OpenRouter-Ranking (openrouter.ai/rankings) sortiert nach bezahlten Token-Volumina — es zeigt, was Entwickler produktiv einsetzen, nicht welches Modell am klügsten ist. Vor jeder Beschaffungsentscheidung sollten diese fünf Blindspots quantifiziert werden:
Volumen als Qualität missverstehen: Günstige, schnelle Modelle hinter High-Traffic-Apps dominieren das Ranking — das sagt wenig über komplexes Reasoning aus.
Nur den Tageskönig betrachten: Tagesrankings schwanken stark (Mimo V2.5 vs. Claude Opus 4.8 wechselt täglich); parallel Anbieteranteile und 30-Tage-Kumul auswerten.
Preishebel ignorieren: DeepSeek V4 Flash Input ca. $0,05–0,14/M vs. GPT-5.5 ca. $5/M — Faktor ~35; Volumenrankings sind zu einem großen Teil Preisarithmetik.
Nur Modell-, nicht App-Layer: Das Modell-Ranking zeigt beliebte «Gehirne»; der Apps-Ranking zeigt, wofür sie laufen — Coding-Agenten und Rollenspiel dominieren.
Sicherheit und Compliance unterschätzen: Sandbox-Escape-Berichte bei OpenAI und anstehende US-Regulierung erhöhen die Gewichtung von Anbieter-Sicherheitsreputation — für EU-Enterprise zentral im DSGVO-Scoring.
Mit diesen Korrekturen wird die Juli-Tabelle zum Traffic-Thermometer, nicht zum Qualitäts-Urteil.
Stand 25. Juli 2026 — Top-12 nach Tages-Tokens und Anbieteranteile (Live-Daten: openrouter.ai/rankings).
| Rang | Modell | Anbieter | Tages-Tokens | 30-Tage-Summe |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | Tencent | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B (kostenlos) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | StepFun | 204.8B | 5.9T |
| 9 | Kimi K3 | Moonshot AI | 157.6B | 1.6T (Neu) |
| 10 | Ling 3.0 Flash | Ant InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
| Anbieter | Herkunft | Anteil (ca.) |
|---|---|---|
| DeepSeek | China | 16%–18% (stabiler Spitzenreiter) |
| Xiaomi | China | 8%–18% (Mimo V2.5-Sprung, höchste Volatilität) |
| Anthropic | USA | 10%–15% |
| Tencent | China | 8%–13% |
| USA | 8%–13% | |
| Chinesische Anbieter zusammen ca. 46% (vor einem Jahr <2%); US-Dreierbund zusammen ca. 30%–36% (vor einem Jahr ~70%) | ||
DeepSeek ist der stabilste Anbieter-Champion, aber der «Monatskönig» wechselt: MiniMax M2.5 → MiMo-V2-Pro → Mimo V2.5 — wer nur den Tagesplatz 1 liest, verpasst die Struktur.
| Modell | Input/M | Output/M | Positionierung |
|---|---|---|---|
| DeepSeek V4 Flash | $0.05–0.14 | $0.24–0.28 | Preis-Leistungs-König, Agentic Coding |
| GLM 5.2 | $0.45 | $3.31 | Open-Source nahe Opus-Planung |
| Kimi K3 | ~$3 | ~$15 | 1,4TB Open Weight, Closed-Source-Niveau |
| Claude Opus 5 | $5 (Schnell-Tier $10) | $25 (Schnell-Tier $50) | Closed Frontier, FrontierBench 43,3% |
Nach Ausgabenanteil: Alltagsdialog 35,7 %, Agent-Workflows 30,4 %, Code 26,5 %. Bei «Klassifikation/komplexes Reasoning»: Claude Sonnet 4.6 und Opus 4.7 je 13,5 %, GPT-5.5 11,6 % — günstige Open-Source-Modelle fehlen hier fast. Der Markt ist hantelförmig: Open Source für Volumen, Closed Source für schwere Tasks und Preissetzung.
Für Indie-Entwickler und Enterprise-Architekten: OpenRouter-Daten in ein gestaffeltes Routing übersetzen (siehe OpenRouter-API-Tutorial für Fallback-Konfiguration).
Task-Buckets inventarisieren: Volumen (Chat, Kreativ, RP, einfaches Coding) vs. schwere Tasks (Reasoning, riskante Agent-Entscheidungen, harte Klassifikation).
Volumen-Tier: DeepSeek V4 Flash (bestes Preis-Leistungs-Verhältnis) und GLM 5.2 (Open Source nahe Opus-Planung) testen; Adoption und Fehlerrate loggen.
Schwer-Tier: Blockierte Schritte an Claude Opus 5 oder GPT-5.6 — siehe Opus-5-Analyse.
OpenRouter-Fallback-Kette: Bei 429/Outage automatisch umschalten; Priorität im models-Array, nicht im App-Code hardcoden.
Internes Eval-Set: Eigene Prompts monatlich gegen openrouter.ai/rankings spiegeln — Adoption, Latenz, Rechnung statt reiner Rangliste.
Sicherheits-Scorecard: Sandbox-Historie, Compliance, DSGVO-Drittlandtransfer in die Gewichtung; autonome Agenten mit Rechte-Reduktion und Audit-Logs.
Hinweis: OpenRouter aus der EU: Latenz ca. 180–250 ms, keine EU-Rechnungen; Sandbox für Pre-Prod, Produktion ggf. DSGVO-konformes Relay evaluieren.
| Rang | App | Typ | Anteil (ca.) |
|---|---|---|---|
| 1 | Hermes Agent | Persönlicher Agent/CLI | ~45% |
| 2 | Kilo Code | Coding-Agent | ~13% |
| 3 | OpenClaw | Universal-Agent | ~9% |
| 4 | Claude Code | Coding-Agent | ~6% |
| 5 | Descript | Content-Produktion | ~4.5% |
| 6–10 | pi, Lemonade, ISEKAI ZERO, Janitor AI, Cline | Agent/Rollenspiel | 1.7%–3.3% |
Cline → Roo Code → Kilo Code teilen eine Code-Linie; «Enkel» Kilo Code überholt inzwischen Cline. Rollenspiel/Companion (Janitor AI, ISEKAI ZERO, SillyTavern) treibt einen großen Open-Source-Anteil — laut OpenRouter × a16z State of AI über 50 % des Open-Source-Volumens, selten in Enterprise-Berichten.
Achtung: Rankings ändern sich täglich — vor Veröffentlichung openrouter.ai/rankings prüfen; Vergleich mit Juni-Analyse zeigt den Mimo-V2.5-Inflection.
Direkt zitierbar (Quelle: OpenRouter Rankings, Stand 2026-07-25):
OpenRouter vereinheitlicht Routing — Agenten auf dem Laptop (Hermes, Kilo Code, OpenClaw) scheitern an Sleep und Prozess-Kill; reine Linux-VPS fehlen Apple Silicon und macOS-Toolchain. Für 7×24 Coding-Agenten und iOS CI/CD ist VpsMesh Mac Mini Cloud-Miete die stabilere Basis: dedizierte Knoten, auditierbare Umgebung. Tarife: Mac Mini M4 Mietpreise, Setup: Hilfezentrum.
Stand 25.07.: Xiaomi Mimo V2.5 ca. 1,4T Token/Tag, dann DeepSeek V4 Flash (943,9B) und Tencent Hy3 (590B). Tagesplätze schwanken — Live-Daten auf openrouter.ai/rankings.
7-Tage-Aggregat: chinesische Anbieter ~46 %; DeepSeek allein 16–18 %. Nicht mit Juni-61-%-Modellstatistik verwechseln — unterschiedliche Metriken.
Nein. Ranking = Token-Volumen; schwere Tasks: Claude Sonnet 4.6/Opus 4.7 führen Ausgabenanteile. Eigenes Eval-Set aufbauen; Agent-Host: Hilfezentrum.
Coding: DeepSeek V4 Flash + GLM 5.2, schwere Schritte Opus 5. OpenRouter als Sandbox; 7×24-Agent: Mac Mini M4 Mietpreise.
Kimi K3 neu auf Platz 9 (157,6B/Tag), stärkster Aufsteiger; 1,4TB Open Weight. Hintergrund: Kimi-K3-Review und Destillations-Bericht.