OpenRouter 2026年7月
大模型排行榜深度解析

真实 Token 用量 · 中国模型 46% 份额 · 用量≠质量 · 应用层秘密 · 8 月预测

2026年7月OpenRouter大模型排行榜厂商份额图

还在用几个月前的跑分榜做模型选型?OpenRouter 是全球最大的中立模型路由平台,排行榜不看营销、只看开发者真金白银的 Token 用量。本文基于截至 2026 年 7 月 25 日的最新数据,解析 7 月三大变化:小米 Mimo V2.5 登顶中国厂商份额突破 46%capability 与 popularity 分道扬镳。含 Top 12 模型表、厂商份额、应用层排行、价格对比、六步分层路由 Runbook、8 月趋势预测,并与6 月排行长文OpenRouter 接入教程互链。

01

OpenRouter 排行榜选型:五个常见盲区

OpenRouter 官方排行榜(openrouter.ai/rankings)按真实付费 Token 流量排序,本质是「开发者在用什么」,而非「哪个模型最聪明」。在引用榜单做采购决策前,应先认清以下五类盲区 🔍

  1. 01

    把用量当质量:便宜又快的模型挂在高流量应用背后即可霸榜,不代表在复杂推理上更强;难任务的消费份额图景完全不同。

  2. 02

    只看单日冠军:榜单每日波动大(如 Mimo V2.5 与 Claude Opus 4.8 名次隔日易变);应同时看厂商总份额30 天累计

  3. 03

    忽略价格杠杆:DeepSeek V4 Flash 输入约 $0.05–0.14/M,GPT-5.5 约 $5/M——价差约 35 倍,用量排名很大程度是价格数学的结果。

  4. 04

    只看模型层不看应用层:模型榜告诉你「哪个大脑受欢迎」,Apps 榜才揭示「这些大脑在做什么」——编程 Agent 与角色扮演占了大半流量。

  5. 05

    忽视安全与合规新变量:本周 OpenAI 未发布模型沙盒逃逸事件发酵,企业选型中「厂商安全声誉」权重将明显上升。

认清盲区后,下一节的 7 月数据表才有正确读法:它是流量温度计,不是能力判决书

02

2026 年 7 月 OpenRouter 模型与厂商对比表

截至 7 月 25 日,单日 Token 用量 Top 12 与厂商份额如下(具体数字请以发布时 openrouter.ai/rankings 实时数据为准)。

模型 Token 用量 Top 12(7/25 日用量)

排名模型厂商单日 Token近 30 天累计
1Mimo V2.5小米1.4T31.2T
2DeepSeek V4 FlashDeepSeek943.9B23.6T
3Hy3腾讯590B23.4T
4Nemotron 3 Ultra 550B(免费)NVIDIA428.6B9T
5DeepSeek V4 ProDeepSeek413.7B11.6T
6GLM 5.2智谱 Z.ai316.7B13.3T
7MiniMax M3MiniMax262.5B15.1T
8Step 3.7 Flash阶跃星辰204.8B5.9T
9Kimi K3月之暗面157.6B1.6T(新上榜)
10Ling 3.0 Flash蚂蚁 InclusionAI128.3B417.3B
11Gemini 3 Flash PreviewGoogle106.3B4T
12Claude Sonnet 5Anthropic99.5B3.6T

厂商 Token 份额(综合 7 天口径,约数)

厂商归属份额(约)
DeepSeek中国16%–18%(单一厂商最稳第一)
小米中国8%–18%(Mimo V2.5 暴涨,波动最大)
Anthropic美国10%–15%
腾讯中国8%–13%
Google美国8%–13%
中国厂商合计约 46%(一年前 <2%);美国三巨头合计约 30%–36%(一年前约 70%)

DeepSeek 是厂商份额最稳定的冠军,但「月度冠军模型」从 MiniMax M2.5 → MiMo-V2-Pro → Mimo V2.5 不断易主——看榜不能只看谁今天第一。

价格与定位对照(用量榜 vs 难任务定价权)

模型输入/M输出/M定位
DeepSeek V4 Flash$0.05–0.14$0.24–0.28性价比之王,Agentic Coding 首选
GLM 5.2$0.45$3.31开源里类 Opus 规划质量
Kimi K3~$3~$151.4TB 开源权重,闭源级能力
Claude Opus 5$5(快速档 $10)$25(快速档 $50)闭源旗舰,FrontierBench v0.1 43.3%

按任务类型看消费金额占比:通用对话 35.7%、Agent 工作流 30.4%、代码 26.5%。但专门看「分类/复杂推理」:Claude Sonnet 4.6 与 Opus 4.7 各 13.5% 并列第一,GPT-5.5 第三 11.6%——廉价开源模型在此维度几乎「查无此模」。市场呈哑铃型:开源吃跑量,闭源守难任务定价权。

03

六步 Runbook:按任务分层路由模型

无论独立开发者还是企业技术负责人,都可用以下六步把 OpenRouter 数据转化为可执行的分层路由策略(配合OpenRouter API 教程中的 fallback 配置)。

  1. 01

    盘点任务桶:将 workload 分为跑量(闲聊、创意、角色扮演、简单编程)与难任务(复杂推理、高风险 Agent 决策、强一致性分类)两类。

  2. 02

    跑量层选模型:优先测试 DeepSeek V4 Flash(性价比最优)与 GLM 5.2(开源最接近 Opus 规划质量);记录采纳率与错误率。

  3. 03

    难任务层选旗舰:卡住的步骤再路由至 Claude Opus 5GPT-5.6;参考Opus 5 发布解读的性价比变化。

  4. 04

    配置 OpenRouter fallback 链:主模型 429/宕机时自动切备;用 models 数组写清优先级,避免业务代码硬编码重试。

  5. 05

    建立内部评测集:不要只看排行榜名次;用你真实 prompt 测采纳率、延迟与账单,每月对照 openrouter.ai/rankings 更新路由表。

  6. 06

    纳入安全评分卡:将厂商安全记录、沙盒逃逸历史、合规资质写入选型权重;自主 Agent 场景做权限收敛与审计日志。

提示:国内访问 OpenRouter 平均延迟约 180–250ms,且不支持国内发票;正式生产可评估硅基流动等合规中转,OpenRouter 更适合技术预研沙盒。

04

应用层秘密:编程 Agent 称王与 8 月趋势预测

OpenRouter Apps Top 10(按 Token 份额,约数)

排名应用类型份额(约)
1Hermes Agent个人智能体/CLI~45%
2Kilo Code编程 Agent~13%
3OpenClaw通用 Agent~9%
4Claude Code编程 Agent~6%
5Descript内容生产~4.5%
6–10pi、Lemonade、ISEKAI ZERO、Janitor AI、ClineAgent/角色扮演1.7%–3.3%

Cline → Roo Code → Kilo Code 是同一代码血统的三次分叉,「孙子辈」Kilo Code 已反超祖辈 Cline。角色扮演/陪伴类(Janitor AI、ISEKAI ZERO、SillyTavern 等)合计占据开源模型可观流量——OpenRouter × a16z《State of AI》显示创意角色扮演贡献开源用量一半以上,企业报道几乎看不到这半壁江山。

8 月五大预测

  • 中国开源合计份额继续爬升,年内有望突破 50%,除非美国厂商大幅降价。
  • 「月度冠军模型」继续易主——小米、DeepSeek、腾讯、智谱、MiniMax、月之暗面价格战不停。
  • Anthropic 或推更平价型号抢用量,Opus 5 已是两个月内第四款旗舰(Mythos 5 → Fable 5 → Sonnet 5 → Opus 5)。
  • Kimi K3 的 1.4TB 权重将在 2–4 周内出现社区量化版,详见Kimi K3 深度评测
  • 安全与合规成选型硬变量:OpenAI 沙盒逃逸、美国「AI 终止开关法案」与白宫预发布审查框架预计 8 月前落地。

注意:榜单每日变动,发布前请打开 openrouter.ai/rankings 核对 Top 10;与6 月分析对比可看出 Mimo V2.5 取代 DeepSeek Flash 成为日冠的拐点。

05

可引用硬数据与生产环境收束

下列数据可直接引用进技术方案(来源:OpenRouter 官方排行榜及公开镜像,截止 2026-07-25)。

  • 日冠模型:小米 Mimo V2.51.4T Token/天,为 7 月最大单日用量。
  • 份额逆转:中国厂商合计约 46%,12 个月从 <2% 攀升,为 AI 行业最陡峭份额迁移之一。
  • 价差锚点:DeepSeek V4 Flash vs GPT-5.5 输入价差约 35 倍,解释用量榜结构的核心变量。
  • 应用集中度:Hermes Agent 单应用约占平台 App Token 45%;编程类 Agent 占据 Top 10 大半席位。
  • 质量锚点:Claude Opus 5 在 FrontierBench v0.1 得分 43.3%,高于 GPT-5.6 Sol 的 37.5%。

OpenRouter 解决了「多模型统一路由」,但跑在本地笔记本上的 Agent(Hermes、Kilo Code、OpenClaw)仍受休眠、系统更新与进程被杀影响——模型路由再聪明,宿主离线就会让 fallback 链空转。纯 Linux VPS 又缺 Apple Silicon 与 macOS 工具链。对需要7×24 在线的编程 Agent 与 iOS CI/CD 流水线VpsMesh 的 Mac Mini 云端租赁通常是更优解:专用节点、可审计环境,让分层路由策略跑在真正稳定的宿主上。

FAQ

常见问题

截至 7 月 25 日,小米 Mimo V2.5以约 1.4 万亿 Token/天居首,其次 DeepSeek V4 Flash(9439 亿/天)与腾讯 Hy3(5900 亿/天)。名次每日变动,请以 openrouter.ai/rankings 实时数据为准。

综合 7 天口径,中国厂商合计约 46% Token 份额;DeepSeek 单一厂商最稳(16%–18%)。对比6 月 61% 模型层占比,厂商维度与模型维度统计口径不同,不宜直接等同。

不能。排行榜测 Token 用量;难任务上 Claude Sonnet 4.6/Opus 4.7 仍占消费份额前列。建议建立内部评测集,并参考帮助中心部署稳定 Agent 宿主。

编程任务优先 DeepSeek V4 Flash + GLM 5.2 混合路由,复杂步骤再切 Opus 5。OpenRouter 做预研沙盒;7×24 Agent 可参考Mac Mini 租赁定价规划宿主成本。

Kimi K3 新上榜即居第 9(157.6B/天),涨势最猛;1.4TB 开源权重创纪录。背景见Kimi K3 深度评测蒸馏门周报