OpenRouter 2026年7月
大模型排行榜深度解析

真實 Token 用量 · 中國模型 46% 份額 · 用量≠品質 · 應用層秘密 · 8 月預測

2026年7月OpenRouter大模型排行榜廠商份額圖

還在用幾個月前的跑分榜做模型選型?OpenRouter 是全球最大的中立模型路由平台,排行榜不看行銷、只看開發者真金白銀的 Token 用量。本文基於截至 2026 年 7 月 25 日的最新數據,解析 7 月三大變化:小米 Mimo V2.5 登頂中國廠商份額突破 46%capability 與 popularity 分道揚鑣。含 Top 12 模型表、廠商份額、應用層排行、價格對比、六步分層路由 Runbook、8 月趨勢預測,並與6 月排行長文OpenRouter 接入教程互鏈。

01

OpenRouter 排行榜選型:五個常見盲區

OpenRouter 官方排行榜(openrouter.ai/rankings)按真實付費 Token 流量排序,本質是「開發者在用什麼」,而非「哪個模型最聰明」。在引用榜單做採購決策前,應先認清以下五類盲區。

  1. 01

    把用量當品質:便宜又快的模型掛在高流量應用背後即可霸榜,不代表在複雜推理上更強;難任務的消費份額圖景完全不同。

  2. 02

    只看單日冠軍:榜單每日波動大(如 Mimo V2.5 與 Claude Opus 4.8 名次隔日易變);應同時看廠商總份額30 天累計

  3. 03

    忽略價格槓桿:DeepSeek V4 Flash 輸入約 $0.05–0.14/M,GPT-5.5 約 $5/M——價差約 35 倍,用量排名很大程度是價格數學的結果。

  4. 04

    只看模型層不看應用層:模型榜告訴你「哪個大腦受歡迎」,Apps 榜才揭示「這些大腦在做什麼」——編程 Agent 與角色扮演占了大半流量。

  5. 05

    忽視安全與合規新變數:本週 OpenAI 未發布模型沙盒逃逸事件發酵,企業選型中「廠商安全聲譽」權重將明顯上升。

認清盲區後,下一節的 7 月數據表才有正確讀法:它是流量溫度計,不是能力判決書

02

2026 年 7 月 OpenRouter 模型與廠商對比表

截至 7 月 25 日,單日 Token 用量 Top 12 與廠商份額如下(具體數字請以發布時 openrouter.ai/rankings 即時數據為準)。

模型 Token 用量 Top 12(7/25 日用量)

排名模型廠商單日 Token近 30 天累計
1Mimo V2.5小米1.4T31.2T
2DeepSeek V4 FlashDeepSeek943.9B23.6T
3Hy3騰訊590B23.4T
4Nemotron 3 Ultra 550B(免費)NVIDIA428.6B9T
5DeepSeek V4 ProDeepSeek413.7B11.6T
6GLM 5.2智譜 Z.ai316.7B13.3T
7MiniMax M3MiniMax262.5B15.1T
8Step 3.7 Flash階躍星辰204.8B5.9T
9Kimi K3月之暗面157.6B1.6T(新上榜)
10Ling 3.0 Flash螞蟻 InclusionAI128.3B417.3B
11Gemini 3 Flash PreviewGoogle106.3B4T
12Claude Sonnet 5Anthropic99.5B3.6T

廠商 Token 份額(綜合 7 天口徑,約數)

廠商歸屬份額(約)
DeepSeek中國16%–18%(單一廠商最穩第一)
小米中國8%–18%(Mimo V2.5 暴漲,波動最大)
Anthropic美國10%–15%
騰訊中國8%–13%
Google美國8%–13%
中國廠商合計約 46%(一年前 <2%);美國三巨頭合計約 30%–36%(一年前約 70%)

DeepSeek 是廠商份額最穩定的冠軍,但「月度冠軍模型」從 MiniMax M2.5 → MiMo-V2-Pro → Mimo V2.5 不斷易主——看榜不能只看誰今天第一。

價格與定位對照(用量榜 vs 難任務定價權)

模型輸入/M輸出/M定位
DeepSeek V4 Flash$0.05–0.14$0.24–0.28性價比之王,Agentic Coding 首選
GLM 5.2$0.45$3.31開源裡類 Opus 規劃品質
Kimi K3~$3~$151.4TB 開源權重,閉源級能力
Claude Opus 5$5(快速檔 $10)$25(快速檔 $50)閉源旗艦,FrontierBench v0.1 43.3%

按任務類型看消費金額佔比:通用對話 35.7%、Agent 工作流 30.4%、程式碼 26.5%。但專門看「分類/複雜推理」:Claude Sonnet 4.6 與 Opus 4.7 各 13.5% 並列第一,GPT-5.5 第三 11.6%——廉價開源模型在此維度幾乎「查無此模」。市場呈啞鈴型:開源吃跑量,閉源守難任務定價權。

03

六步 Runbook:按任務分層路由模型

無論獨立開發者還是企業技術負責人,都可用以下六步把 OpenRouter 數據轉化為可執行的分層路由策略(配合OpenRouter API 教程中的 fallback 配置)。

  1. 01

    盤點任務桶:將 workload 分為跑量(閒聊、創意、角色扮演、簡單編程)與難任務(複雜推理、高風險 Agent 決策、強一致性分類)兩類。

  2. 02

    跑量層選模型:優先測試 DeepSeek V4 Flash(性價比最優)與 GLM 5.2(開源最接近 Opus 規劃品質);記錄採納率與錯誤率。

  3. 03

    難任務層選旗艦:卡住的步驟再路由至 Claude Opus 5GPT-5.6;參考Opus 5 發布解讀的性價比變化。

  4. 04

    配置 OpenRouter fallback 鏈:主模型 429/宕機時自動切備;用 models 陣列寫清優先級,避免業務程式碼硬編碼重試。

  5. 05

    建立內部評測集:不要只看排行榜名次;用你真實 prompt 測採納率、延遲與帳單,每月對照 openrouter.ai/rankings 更新路由表。

  6. 06

    納入安全評分卡:將廠商安全記錄、沙盒逃逸歷史、合規資質寫入選型權重;自主 Agent 場景做權限收斂與審計日誌。

i

提示:國內訪問 OpenRouter 平均延遲約 180–250ms,且不支持國內發票;正式生產可評估矽基流動等合規中轉,OpenRouter 更適合技術預研沙盒。

04

應用層秘密:編程 Agent 稱王與 8 月趨勢預測

OpenRouter Apps Top 10(按 Token 份額,約數)

排名應用類型份額(約)
1Hermes Agent個人智能體/CLI~45%
2Kilo Code編程 Agent~13%
3OpenClaw通用 Agent~9%
4Claude Code編程 Agent~6%
5Descript內容生產~4.5%
6–10pi、Lemonade、ISEKAI ZERO、Janitor AI、ClineAgent/角色扮演1.7%–3.3%

Cline → Roo Code → Kilo Code 是同一代碼血統的三次分叉,「孫子輩」Kilo Code 已反超輩祖 Cline。角色扮演/陪伴類(Janitor AI、ISEKAI ZERO、SillyTavern 等)合計占據開源模型可觀流量——OpenRouter × a16z《State of AI》顯示創意角色扮演貢獻開源用量一半以上,企業報導幾乎看不到這半壁江山。

8 月五大預測

  • 中國開源合計份額繼續爬升,年內有望突破 50%,除非美國廠商大幅降價。
  • 「月度冠軍模型」繼續易主——小米、DeepSeek、騰訊、智譜、MiniMax、月之暗面價格戰不停。
  • Anthropic 或推更平價型號搶用量,Opus 5 已是兩個月內第四款旗艦(Mythos 5 → Fable 5 → Sonnet 5 → Opus 5)。
  • Kimi K3 的 1.4TB 權重將在 2–4 週內出現社群量化版,詳見Kimi K3 深度評測
  • 安全與合規成選型硬變數:OpenAI 沙盒逃逸、美國「AI 終止開關法案」與白宮預發布審查框架預計 8 月前落地。
!

注意:榜單每日變動,發布前請打開 openrouter.ai/rankings 核對 Top 10;與6 月分析對比可看出 Mimo V2.5 取代 DeepSeek Flash 成為日冠的拐點。

05

可引用硬數據與生產環境收束

下列數據可直接引用進技術方案(來源:OpenRouter 官方排行榜及公開鏡像,截止 2026-07-25)。

  • 日冠模型:小米 Mimo V2.51.4T Token/天,為 7 月最大單日用量。
  • 份額逆轉:中國廠商合計約 46%,12 個月從 <2% 攀升,為 AI 行業最陡峭份額遷移之一。
  • 價差錨點:DeepSeek V4 Flash vs GPT-5.5 輸入價差約 35 倍,解釋用量榜結構的核心變數。
  • 應用集中度:Hermes Agent 單應用約占平台 App Token 45%;編程類 Agent 占據 Top 10 大半席位。
  • 品質錨點:Claude Opus 5 在 FrontierBench v0.1 得分 43.3%,高於 GPT-5.6 Sol 的 37.5%。

OpenRouter 解決了「多模型統一路由」,但跑在本地筆電上的 Agent(Hermes、Kilo Code、OpenClaw)仍受休眠、系統更新與進程被殺影響——模型路由再聰明,宿主離線就會讓 fallback 鏈空轉。純 Linux 伺服器又缺 Apple Silicon 與 macOS 工具鏈。對需要7×24 在線的編程 Agent 與 iOS CI/CD 流水線VpsMesh 的 Mac Mini 雲端租賃通常是更優解:專用節點、可審計環境,讓分層路由策略跑在真正穩定的宿主上。方案見 Mac Mini M4 租用定價,部署見 雲端說明中心

FAQ

常見問題

截至 7 月 25 日,小米 Mimo V2.5以約 1.4 萬億 Token/天居首,其次 DeepSeek V4 Flash(9439 億/天)與騰訊 Hy3(5900 億/天)。名次每日變動,請以 openrouter.ai/rankings 即時數據為準。

綜合 7 天口徑,中國廠商合計約 46% Token 份額;DeepSeek 單一廠商最穩(16%–18%)。對比6 月 61% 模型層佔比,廠商維度與模型維度統計口徑不同,不宜直接等同。

不能。排行榜測 Token 用量;難任務上 Claude Sonnet 4.6/Opus 4.7 仍占消費份額前列。建議建立內部評測集,並參考雲端說明中心部署穩定 Agent 宿主。

編程任務優先 DeepSeek V4 Flash + GLM 5.2 混合路由,複雜步驟再切 Opus 5。OpenRouter 做預研沙盒;7×24 Agent 可參考Mac Mini 租用定價規劃宿主成本。

Kimi K3 新上榜即居第 9(157.6B/天),漲勢最猛;1.4TB 開源權重創紀錄。背景見Kimi K3 深度評測蒸餾門週報