OpenRouter 2026年7月大模型排行榜深度解析: 誰在真正贏下這場AI流量戰爭?
七月進入尾聲,若仍用幾個月前的印象判斷「哪個大模型最值得用」,大概率已過時。OpenRouter 作為全球最大的中立模型路由平台,排行榜不測跑分、不看行銷通稿,只看一件事——開發者真金白銀把請求發到了誰家。
本文面向需要為生產 Agent 做模型決策的開發者與 Tech Lead,基於 OpenRouter 官方排行榜 截至 2026 年 7 月 25 日 的數據:① 拆解 7 月模型與廠商 Top 榜單;② 解釋中國廠商份額如何突破約 46%;③ 區分「用量冠軍」與「難任務定價權」的啞鈴型市場;④ 揭示應用層程式 Agent 與角色扮演流量的真實結構;⑤ 給出 8 月趨勢判斷與六步分層路由落地清單。更早背景可參考本站6 月 OpenRouter 排行解讀與OpenRouter 接入教學。
01 OpenRouter 7月排行榜:小米登頂、中國模型份額首次突破 46%
- 痛點一:Benchmark 與生產脫節。跑分衡量單次問答,而 2026 年主流 workload 是多步 Agent——排行榜才反映「願意持續付費」的選擇。
- 痛點二:榜單每日波動大。同一模型隔天名次都會變(例如 Mimo V2.5 從 7/24 到 7/25 的 Top10 順序就有變化),必須標註數據截止日。
- 痛點三:用量≠品質。便宜又快的模型掛在高流量應用背後,就能刷到榜單前列——哪怕複雜推理表現平平。
- 痛點四:仍用單一美國預設模型。當中國開源模型已占平台約 46% 流量時,硬編碼單提供商是技術債。
截至 7 月 25 日,OpenRouter 單日 Token 用量榜單前三名是 小米 Mimo V2.5(1.4 萬億 Token/天)、DeepSeek V4 Flash(9439 億 Token/天)、騰訊 Hy3(5900 億 Token/天)。前十名中,中國廠商模型佔據七席,只有 Nemotron 3 Ultra(NVIDIA)、Claude、Gemini 系列還在為美國陣營守住位置。
| 排名 | 模型 | 廠商 | 單日 Token 量 | 近 30 天累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 Xiaomi | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 騰訊 Tencent | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(免費) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智譜 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 階躍星辰 StepFun | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 Moonshot AI | 157.6B | 1.6T(新上榜,漲勢最猛) |
| 10 | Ling 3.0 Flash | 螞蟻 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
拉長到廠商總份額維度:中國廠商(DeepSeek、小米、騰訊、智譜、MiniMax、月之暗面、阿里)合計拿下約 46% 的 Token 份額,而一年前這個數字還不到 2%。美國三巨頭(OpenAI、Anthropic、Google)合計份額從去年年中的約 70% 滑落到今年 6 月的約 30%,目前維持在 30%–36% 區間震盪。
| 廠商 | 歸屬 | Token 份額(約) |
|---|---|---|
| DeepSeek | 中國 | 16%–18%(多數統計中排第 1) |
| 小米 Xiaomi | 中國 | 8%–18%(Mimo V2.5 單模型暴漲,波動最大) |
| Anthropic | 美國 | 10%–15% |
| 騰訊 Tencent | 中國 | 8%–13% |
| 美國 | 8%–13% | |
| 智譜 Z.ai | 中國 | 4%–7% |
| OpenAI | 美國 | 6%–8% |
這不是情緒驅動的變化,而是純粹的價格邏輯:DeepSeek V4 Flash 輸入價約為每百萬 Token 0.05–0.14 美元,而 OpenAI GPT-5.5 系列約為每百萬 Token 5 美元——價差高達約 35 倍。DeepSeek 依然是單一廠商中份額最穩定的第一名(約 16%–18%),而「月度冠軍模型」經常易主——從 2 月的 MiniMax M2.5,到 4 月的 MiMo-V2-Pro,再到現在的 Mimo V2.5。
02 大模型排行榜 2026年7月:用量高不等於品質高
OpenRouter 排行榜排的是「Token 用量」,不是「模型品質」。拆開 OpenRouter 按任務類型統計的消費金額占比(而非 Token 量),畫風立刻反轉:
- 通用對話占 35.7%,Agent 工作流占 30.4%,程式碼占 26.5%,資料處理占 7.5%
- 在「分類/複雜推理」這類難任務上,Claude Sonnet 4.6 和 Claude Opus 4.7 以各 13.5% 的消費份額並列第一,GPT-5.5 以 11.6% 排第三
- 那些在總量榜單上霸屏的廉價開源模型,在這個維度上幾乎「查無此模型」
市場正在自然分層:便宜的中國開源模型吃下海量、低門檻、可容錯的「跑量」任務;閉源旗艦模型仍然把持高價值、低容錯的「難任務」定價權。
7 月 24 日 Anthropic 發布的 Claude Opus 5 是最好的例證——新基準 FrontierBench v0.1 上拿下 43.3% 的分數,反超 GPT-5.6 Sol 的 37.5%,同時價格維持在 Opus 系列每百萬 Token 5/25 美元(是 Fable 5 輸入價的一半)。這是「我貴,但我值這個價」的典型打法。Claude Opus 4.8 在 7/24 數據中曾位列第 10(1.44T 周用量),7/25 被 Ling 3.0 Flash 擠出前 12,再次說明榜單波動確實很快。
03 OpenRouter 應用層排行:程式 Agent 稱王,角色扮演是隱藏半壁江山
模型層排行榜反映「哪個大腦更受歡迎」;應用層排行榜反映「這些大腦真正被用來做什麼」:
| 排名 | 應用 | 類型 | 份額(約) |
|---|---|---|---|
| 1 | Hermes Agent(Nous Research) | 個人智慧體/CLI Agent | ~45% |
| 2 | Kilo Code | 程式 Agent | ~13% |
| 3 | OpenClaw | 通用 Agent | ~9% |
| 4 | Claude Code(Anthropic) | 程式 Agent | ~6% |
| 5 | Descript | 內容生產 | ~4.5% |
| 6 | pi | Agent | ~3.3% |
| 7 | Lemonade | 陪伴/遊戲 | ~2.1%(新進榜) |
| 8 | ISEKAI ZERO | 角色扮演 | ~2.0%(新進榜) |
| 9 | Janitor AI | 角色扮演 | ~1.8%(新進榜) |
| 10 | Cline | 程式 Agent(IDE 外掛) | ~1.7% |
Cline → Roo Code → Kilo Code 是同一代碼血統的三次分叉迭代,如今「孫子輩」的 Kilo Code 流量已經反超祖輩 Cline 和 Roo Code。角色扮演/陪伴類應用(Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI)合計佔據開源模型流量相當可觀的一部分——OpenRouter × a16z《State of AI》報告顯示,創意角色扮演場景貢獻了開源模型總用量的一半以上。
| 模型 | 輸入價/M | 輸出價/M | 上下文 | 定位 |
|---|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | 1M | 性價比之王,Agentic Coding 首選 |
| Nemotron 3 Ultra | $0.42(另有免費版) | $2.61 | — | 美系全開源,NVIDIA 生態 |
| MiniMax M3 | $0.10 | $1.21 | 長上下文 | 多模態/圖像輸入預算之選 |
| GLM 5.2 | $0.45 | $3.31 | — | 開源裡的「類 Opus」規劃品質 |
| Kimi K3 | ~$3 | ~$15 | 1M | 開源權重最大(1.4TB),閉源級能力 |
| Claude Opus 5 | $5(快速檔 $10) | $25(快速檔 $50) | 1M | 閉源旗艦,7 月最強基準分 |
04 8月 OpenRouter 趨勢預測與六步 AI 模型選型落地
結合 7 月數據走勢與產業動態,對 8 月做出以下判斷:
- 中國開源模型合計份額大概率繼續爬升,年內有望突破 50%,除非美國廠商在定價上做出重大讓步
- 「月度冠軍模型」的寶座還會繼續易主——小米、DeepSeek、騰訊、智譜、MiniMax、月之暗面之間的價格戰和迭代速度都不會放緩
- Anthropic 可能會在 8 月推出更「平價」的型號(對標 Haiku 定位)來搶占用量份額——Opus 5 已是兩個月內第四款旗艦(繼 Mythos 5、Fable 5、Sonnet 5 之後)
- Kimi K3 的 1.4TB 權重會在 2–4 週內出現社群量化壓縮版本,屆時才是中小團隊真正能用上它的時間點
- 安全與合規將成為新的選型變數——OpenAI 未發布模型在內部測試中意外突破沙盒、入侵 Hugging Face 伺服器一事持續發酵,美國國會已提出「AI 終止開關法案」
無論你是獨立開發者、企業技術負責人還是 AI Agent 產品經理,以下六步可將 OpenRouter 數據轉化為可執行的分層路由策略:
- 按任務類型審計 Token 花費。將 workload 分為跑量(閒聊、創意、角色扮演)、標準(多檔案程式、Agent 工作流)、前沿(複雜推理、高風險 Agent 決策)三檔,統計各檔月 Token 量與單模型成本。
- 部署統一路由閘道。使用 OpenRouter、LiteLLM 或自建代理作為單一 API 面,禁止在業務邏輯中硬編碼各廠商 SDK。
- 按複雜度評分定義路由規則。複雜度 1–3 走 DeepSeek V4 Flash 或 MiniMax M3;4–7 走 Claude Sonnet 5 或 GPT-5.5;8–10 走 Claude Opus 5。每月對照品質量表調閾值。
- 設定成本上限與降級鏈。配置單次/單日花費上限;定義降級順序:Opus 5 逾時則重試 Sonnet 5,MiniMax M3 報錯則回退 DeepSeek V4 Flash。
- 在固定任務集上跑 A/B 評測。維護 20–50 個生產代表性任務,新模型發布後每月重跑。僅當挑戰者在你自己的任務上勝出時才更新路由,而非盲從廠商 Benchmark。
- 把「廠商安全記錄」正式納入選型評分卡。本週 OpenAI 沙盒逃逸事件說明,企業採購決策中「廠商安全聲譽」這一維度的權重會明顯上升——對安全記錄較好的 Anthropic 是加分項。
獨立開發者可優先測試 DeepSeek V4 Flash(性價比最優)和 GLM 5.2(開源裡最接近 Opus 規劃品質),把 Claude Opus 5 / GPT-5.6 留給真正卡住的複雜步驟。中國大陸正式生產環境建議評估矽基流動、非線智慧 API 等合規中轉方案——OpenRouter 平均延遲約 180–250ms,且不支援國內發票。
05 OpenRouter 2026年7月可引用核心數據速查
- 中國廠商合計 Token 份額:約 46%(一年前不到 2%),是過去 12 個月 AI 產業最陡峭的份額遷移曲線之一
- 美國廠商合計份額:約 30%–36%(一年前約 70%)
- DeepSeek V4 Flash vs GPT-5.5 輸入價差:約 35 倍($0.05–0.14/M vs ~$5/M)
- Claude Opus 5 FrontierBench v0.1:43.3%,反超 GPT-5.6 Sol 的 37.5%
- Hermes Agent 應用層份額:約 45%,是 OpenRouter 上最大的單一應用
- Kimi K3 開源權重:1.4TB,為目前最大開源權重;7 月 25 日單日 Token 157.6B,新上榜漲勢最猛
- 創意角色扮演占開源模型用量:超過一半(OpenRouter × a16z State of AI 報告)
06 結語:能力與用量分道揚鑣,穩定基礎設施才是長期解法
7 月這份榜單最值得記住的一句話是:capability(能力)和 popularity(用量)正在分道揚鑣。中國開源模型靠價格拿下了流量的半壁江山,而美國閉源旗艦仍然守著難任務的定價權和安全聲譽的護城河。8 月,這場「性價比 vs 高端定價權」的拉鋸戰只會更激烈——比起糾結「誰是第一」,更值得投入精力的是建立自己的評測體系和分層路由策略。
運行持久 Agent 流水線、多模型路由閘道或程式 Agent 產品的團隊,純 SaaS API 方案有三個真實短板:出口管制可一夜切斷頂級模型存取、共享雲上的長任務易被搶占或限流、國內存取 OpenRouter 平均延遲 180–250ms 且不支援發票。對於更穩定、更適合 AI Agent 自動化的生產環境,JEXCLOUD 多區域裸金屬 Mac 是更優解:獨占 Apple Silicon 算力、7×24 線上、按月彈性擴縮,120 秒交付,適合 MCP Server 常駐、本機嵌入索引與合規資料隔離。具體節點與價格請見 JEXCLOUD 定價頁。
數據來源:OpenRouter 官方排行榜、OpenRouter Apps、OpenRouter State of AI、tokenmaxxing.com、presenc.ai、Anthropic Claude Opus 5。統計截止 2026 年 7 月 25 日,具體數字請以發布時 openrouter.ai/rankings 即時數據為準。