Реальные токены · 46% Китай · объём≠качество · app-layer · прогноз август
Ещё выбираете модель по бенчмаркам полугодовой давности? OpenRouter — крупнейшая нейтральная routing-платформа: рейтинг считает реально оплаченные токены, а не PR. Разбор по данным на 25 июля 2026: Mimo V2.5 на вершине, ~46% у китайских вендоров, capability и popularity расходятся. Top-12, доли вендоров, app-layer, цены, 6-шаговый routing runbook, прогноз на август. Кросс-линки: разбор июня, гайд OpenRouter API.
Официальный рейтинг (openrouter.ai/rankings) сортирует по paid token volume — это «что реально крутят в проде», а не «кто умнее в lab». Перед закупкой разберите пять ловушек:
Объём = качество: дешёвая модель за high-traffic app легко забирает #1 — на hard reasoning картина другая.
Смотреть только daily #1: Mimo V2.5 vs Claude Opus 4.8 меняются день ото дня; смотрите vendor share и 30-day cumulative.
Игнор price leverage: DeepSeek V4 Flash input ~$0.05–0.14/M vs GPT-5.5 ~$5/M — ~35× gap; ranking в значительной степени математика цены.
Только model layer: model chart — популярные «мозги»; Apps chart — что они делают: coding agents и RP жрут львиную долю.
Security/compliance как afterthought: sandbox escape у OpenAI и US regulation поднимают вес vendor security score в enterprise selection.
С этими поправками июльская таблица — traffic thermometer, не quality verdict.
Срез 25.07.2026 — Top-12 по daily tokens и vendor shares (live: openrouter.ai/rankings).
| # | Модель | Вендор | Токены/день | 30 дней |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | Tencent | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B (free) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | StepFun | 204.8B | 5.9T |
| 9 | Kimi K3 | Moonshot AI | 157.6B | 1.6T (новичок) |
| 10 | Ling 3.0 Flash | Ant InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
| Вендор | Регион | Доля (~) |
|---|---|---|
| DeepSeek | Китай | 16%–18% (стабильный лидер) |
| Xiaomi | Китай | 8%–18% (скачок Mimo V2.5, max волатильность) |
| Anthropic | США | 10%–15% |
| Tencent | Китай | 8%–13% |
| США | 8%–13% | |
| Китайские вендоры суммарно ~46% (год назад <2%); US big three ~30%–36% (год назад ~70%) | ||
DeepSeek — самый стабильный vendor champion, но «monthly #1 model» мигрирует MiniMax M2.5 → MiMo-V2-Pro → Mimo V2.5. Daily rank alone — noise.
| Модель | Input/M | Output/M | Роль |
|---|---|---|---|
| DeepSeek V4 Flash | $0.05–0.14 | $0.24–0.28 | value king, agentic coding |
| GLM 5.2 | $0.45 | $3.31 | open-source близко к Opus по planning |
| Kimi K3 | ~$3 | ~$15 | 1,4TB open weights, closed-tier качество |
| Claude Opus 5 | $5 (fast tier $10) | $25 (fast tier $50) | closed frontier, FrontierBench 43,3% |
По spend share: general chat 35.7%, agent workflows 30.4%, code 26.5%. На classification/hard reasoning: Claude Sonnet 4.6 и Opus 4.7 по 13.5%, GPT-5.5 11.6% — cheap open-source почти invisible. Рынок barbell: OSS на volume, closed на pricing power hard tasks.
Indie или platform lead — переведите OpenRouter data в tiered routing (fallback config: OpenRouter API guide).
Bucket workloads: volume tier (chat, creative, RP, easy code) vs hard tier (reasoning, risky agent decisions, strict classification).
Volume tier pick: гоняйте DeepSeek V4 Flash + GLM 5.2; логируйте adoption rate и error rate.
Hard tier escalation: stuck steps → Claude Opus 5 или GPT-5.6; см. Opus 5 breakdown.
OpenRouter fallback chain: на 429/outage auto-switch; priority в models array, не hardcoded retry в app code.
Internal eval set: свои prompts ежемесячно vs openrouter.ai/rankings — adoption, latency, bill, не rank worship.
Security scorecard: sandbox history, compliance posture, audit logs для autonomous agents; least privilege обязателен.
Примечание: Latency до OpenRouter из RU/EU ~180–250 ms; для prod оцените compliant relay; sandbox — ок для R&D.
| # | App | Тип | Доля (~) |
|---|---|---|---|
| 1 | Hermes Agent | personal agent/CLI | ~45% |
| 2 | Kilo Code | coding agent | ~13% |
| 3 | OpenClaw | универсальный agent | ~9% |
| 4 | Claude Code | coding agent | ~6% |
| 5 | Descript | контент | ~4.5% |
| 6–10 | pi, Lemonade, ISEKAI ZERO, Janitor AI, Cline | agent/RP | 1.7%–3.3% |
Cline → Roo Code → Kilo Code — один lineage; «grandkid» Kilo Code уже обогнал Cline. RP/companion (Janitor AI, ISEKAI ZERO, SillyTavern) — > 50% OSS volume по OpenRouter × a16z State of AI; enterprise press это почти не видит.
Внимание: Rankings daily drift — перед публикацией сверьте openrouter.ai/rankings; vs июньский разбор виден Mimo V2.5 inflection.
Copy-paste friendly (OpenRouter, cutoff 2026-07-25):
OpenRouter решает multi-model routing, но agents на laptop (Hermes, Kilo Code, OpenClaw) умирают от sleep/kill; Linux VPS без Apple Silicon и macOS toolchain — fallback chain крутится вхолостую. Для 7×24 coding agents и iOS CI/CD аренда Mac Mini VpsMesh — dedicated node, auditable env. Тарифы: цены аренды Mac Mini M4, setup: центр помощи.
На 25.07: Mimo V2.5 ~1.4T tokens/day, далее DeepSeek V4 Flash (943.9B), Tencent Hy3 (590B). Daily rank drift — live: openrouter.ai/rankings.
7-day aggregate: Chinese vendors ~46%; DeepSeek solo 16–18%. Не путать с 61% июня — другая метрика.
Нет. Ranking = token volume; hard tasks: Claude Sonnet 4.6/Opus 4.7 lead spend. Stable agent host: центр помощи.
Code stack: DeepSeek V4 Flash + GLM 5.2, hard steps → Opus 5. OpenRouter sandbox; 7×24 agent: цены аренды Mac Mini M4.
Kimi K3 debut #9 (157.6B/day), fastest climber; 1.4TB open weights record. Deep dive: Kimi K3 review, distillation drama.