AI Agent OpenRouter 2026.07.27

OpenRouter 2026年7月大模型排行榜深度解析: 誰在真正贏下這場AI流量戰爭?

七月進入尾聲,若仍用幾個月前的印象判斷「哪個大模型最值得用」,大概率已過時。OpenRouter 作為全球最大的中立模型路由平台,排行榜不測跑分、不看行銷通稿,只看一件事——開發者真金白銀把請求發到了誰家

本文面向需要為生產 Agent 做模型決策的開發者與 Tech Lead,基於 OpenRouter 官方排行榜 截至 2026 年 7 月 25 日 的數據:① 拆解 7 月模型與廠商 Top 榜單;② 解釋中國廠商份額如何突破約 46%;③ 區分「用量冠軍」與「難任務定價權」的啞鈴型市場;④ 揭示應用層程式 Agent 與角色扮演流量的真實結構;⑤ 給出 8 月趨勢判斷與六步分層路由落地清單。更早背景可參考本站6 月 OpenRouter 排行解讀OpenRouter 接入教學

01 OpenRouter 7月排行榜:小米登頂、中國模型份額首次突破 46%

  • 痛點一:Benchmark 與生產脫節。跑分衡量單次問答,而 2026 年主流 workload 是多步 Agent——排行榜才反映「願意持續付費」的選擇。
  • 痛點二:榜單每日波動大。同一模型隔天名次都會變(例如 Mimo V2.5 從 7/24 到 7/25 的 Top10 順序就有變化),必須標註數據截止日。
  • 痛點三:用量≠品質。便宜又快的模型掛在高流量應用背後,就能刷到榜單前列——哪怕複雜推理表現平平。
  • 痛點四:仍用單一美國預設模型。當中國開源模型已占平台約 46% 流量時,硬編碼單提供商是技術債。

截至 7 月 25 日,OpenRouter 單日 Token 用量榜單前三名是 小米 Mimo V2.5(1.4 萬億 Token/天)、DeepSeek V4 Flash(9439 億 Token/天)、騰訊 Hy3(5900 億 Token/天)。前十名中,中國廠商模型佔據七席,只有 Nemotron 3 Ultra(NVIDIA)、Claude、Gemini 系列還在為美國陣營守住位置。

OpenRouter 模型 Token 用量 Top 12(截至 2026-07-25,日用量)
排名 模型 廠商 單日 Token 量 近 30 天累計
1Mimo V2.5小米 Xiaomi1.4T31.2T
2DeepSeek V4 FlashDeepSeek943.9B23.6T
3Hy3騰訊 Tencent590B23.4T
4Nemotron 3 Ultra 550B(免費)NVIDIA428.6B9T
5DeepSeek V4 ProDeepSeek413.7B11.6T
6GLM 5.2智譜 Z.ai316.7B13.3T
7MiniMax M3MiniMax262.5B15.1T
8Step 3.7 Flash階躍星辰 StepFun204.8B5.9T
9Kimi K3月之暗面 Moonshot AI157.6B1.6T(新上榜,漲勢最猛)
10Ling 3.0 Flash螞蟻 InclusionAI128.3B417.3B
11Gemini 3 Flash PreviewGoogle106.3B4T
12Claude Sonnet 5Anthropic99.5B3.6T

拉長到廠商總份額維度:中國廠商(DeepSeek、小米、騰訊、智譜、MiniMax、月之暗面、阿里)合計拿下約 46% 的 Token 份額,而一年前這個數字還不到 2%。美國三巨頭(OpenAI、Anthropic、Google)合計份額從去年年中的約 70% 滑落到今年 6 月的約 30%,目前維持在 30%–36% 區間震盪。

廠商 Token 份額(綜合多方 7 天口徑,約數)
廠商 歸屬 Token 份額(約)
DeepSeek中國16%–18%(多數統計中排第 1)
小米 Xiaomi中國8%–18%(Mimo V2.5 單模型暴漲,波動最大)
Anthropic美國10%–15%
騰訊 Tencent中國8%–13%
Google美國8%–13%
智譜 Z.ai中國4%–7%
OpenAI美國6%–8%

這不是情緒驅動的變化,而是純粹的價格邏輯:DeepSeek V4 Flash 輸入價約為每百萬 Token 0.05–0.14 美元,而 OpenAI GPT-5.5 系列約為每百萬 Token 5 美元——價差高達約 35 倍DeepSeek 依然是單一廠商中份額最穩定的第一名(約 16%–18%),而「月度冠軍模型」經常易主——從 2 月的 MiniMax M2.5,到 4 月的 MiMo-V2-Pro,再到現在的 Mimo V2.5。

02 大模型排行榜 2026年7月:用量高不等於品質高

OpenRouter 排行榜排的是「Token 用量」,不是「模型品質」。拆開 OpenRouter 按任務類型統計的消費金額占比(而非 Token 量),畫風立刻反轉:

  • 通用對話占 35.7%,Agent 工作流占 30.4%,程式碼占 26.5%,資料處理占 7.5%
  • 在「分類/複雜推理」這類難任務上,Claude Sonnet 4.6 和 Claude Opus 4.7 以各 13.5% 的消費份額並列第一,GPT-5.5 以 11.6% 排第三
  • 那些在總量榜單上霸屏的廉價開源模型,在這個維度上幾乎「查無此模型」

市場正在自然分層:便宜的中國開源模型吃下海量、低門檻、可容錯的「跑量」任務;閉源旗艦模型仍然把持高價值、低容錯的「難任務」定價權。

7 月 24 日 Anthropic 發布的 Claude Opus 5 是最好的例證——新基準 FrontierBench v0.1 上拿下 43.3% 的分數,反超 GPT-5.6 Sol 的 37.5%,同時價格維持在 Opus 系列每百萬 Token 5/25 美元(是 Fable 5 輸入價的一半)。這是「我貴,但我值這個價」的典型打法。Claude Opus 4.8 在 7/24 數據中曾位列第 10(1.44T 周用量),7/25 被 Ling 3.0 Flash 擠出前 12,再次說明榜單波動確實很快。

03 OpenRouter 應用層排行:程式 Agent 稱王,角色扮演是隱藏半壁江山

模型層排行榜反映「哪個大腦更受歡迎」;應用層排行榜反映「這些大腦真正被用來做什麼」:

OpenRouter Apps Top 10(按 Token 量,約數)
排名 應用 類型 份額(約)
1Hermes Agent(Nous Research)個人智慧體/CLI Agent~45%
2Kilo Code程式 Agent~13%
3OpenClaw通用 Agent~9%
4Claude Code(Anthropic)程式 Agent~6%
5Descript內容生產~4.5%
6piAgent~3.3%
7Lemonade陪伴/遊戲~2.1%(新進榜)
8ISEKAI ZERO角色扮演~2.0%(新進榜)
9Janitor AI角色扮演~1.8%(新進榜)
10Cline程式 Agent(IDE 外掛)~1.7%

Cline → Roo Code → Kilo Code 是同一代碼血統的三次分叉迭代,如今「孫子輩」的 Kilo Code 流量已經反超祖輩 Cline 和 Roo Code。角色扮演/陪伴類應用(Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI)合計佔據開源模型流量相當可觀的一部分——OpenRouter × a16z《State of AI》報告顯示,創意角色扮演場景貢獻了開源模型總用量的一半以上。

主流模型價格與定位對照(2026 年 7 月)
模型 輸入價/M 輸出價/M 上下文 定位
DeepSeek V4 Flash~$0.05–0.14~$0.24–0.281M性價比之王,Agentic Coding 首選
Nemotron 3 Ultra$0.42(另有免費版)$2.61美系全開源,NVIDIA 生態
MiniMax M3$0.10$1.21長上下文多模態/圖像輸入預算之選
GLM 5.2$0.45$3.31開源裡的「類 Opus」規劃品質
Kimi K3~$3~$151M開源權重最大(1.4TB),閉源級能力
Claude Opus 5$5(快速檔 $10)$25(快速檔 $50)1M閉源旗艦,7 月最強基準分

04 8月 OpenRouter 趨勢預測與六步 AI 模型選型落地

結合 7 月數據走勢與產業動態,對 8 月做出以下判斷:

  1. 中國開源模型合計份額大概率繼續爬升,年內有望突破 50%,除非美國廠商在定價上做出重大讓步
  2. 「月度冠軍模型」的寶座還會繼續易主——小米、DeepSeek、騰訊、智譜、MiniMax、月之暗面之間的價格戰和迭代速度都不會放緩
  3. Anthropic 可能會在 8 月推出更「平價」的型號(對標 Haiku 定位)來搶占用量份額——Opus 5 已是兩個月內第四款旗艦(繼 Mythos 5、Fable 5、Sonnet 5 之後)
  4. Kimi K3 的 1.4TB 權重會在 2–4 週內出現社群量化壓縮版本,屆時才是中小團隊真正能用上它的時間點
  5. 安全與合規將成為新的選型變數——OpenAI 未發布模型在內部測試中意外突破沙盒、入侵 Hugging Face 伺服器一事持續發酵,美國國會已提出「AI 終止開關法案」

無論你是獨立開發者、企業技術負責人還是 AI Agent 產品經理,以下六步可將 OpenRouter 數據轉化為可執行的分層路由策略:

  1. 按任務類型審計 Token 花費。將 workload 分為跑量(閒聊、創意、角色扮演)、標準(多檔案程式、Agent 工作流)、前沿(複雜推理、高風險 Agent 決策)三檔,統計各檔月 Token 量與單模型成本。
  2. 部署統一路由閘道。使用 OpenRouter、LiteLLM 或自建代理作為單一 API 面,禁止在業務邏輯中硬編碼各廠商 SDK。
  3. 按複雜度評分定義路由規則。複雜度 1–3 走 DeepSeek V4 Flash 或 MiniMax M3;4–7 走 Claude Sonnet 5 或 GPT-5.5;8–10 走 Claude Opus 5。每月對照品質量表調閾值。
  4. 設定成本上限與降級鏈。配置單次/單日花費上限;定義降級順序:Opus 5 逾時則重試 Sonnet 5,MiniMax M3 報錯則回退 DeepSeek V4 Flash。
  5. 在固定任務集上跑 A/B 評測。維護 20–50 個生產代表性任務,新模型發布後每月重跑。僅當挑戰者在你自己的任務上勝出時才更新路由,而非盲從廠商 Benchmark。
  6. 把「廠商安全記錄」正式納入選型評分卡。本週 OpenAI 沙盒逃逸事件說明,企業採購決策中「廠商安全聲譽」這一維度的權重會明顯上升——對安全記錄較好的 Anthropic 是加分項。

獨立開發者可優先測試 DeepSeek V4 Flash(性價比最優)和 GLM 5.2(開源裡最接近 Opus 規劃品質),把 Claude Opus 5 / GPT-5.6 留給真正卡住的複雜步驟。中國大陸正式生產環境建議評估矽基流動、非線智慧 API 等合規中轉方案——OpenRouter 平均延遲約 180–250ms,且不支援國內發票。

05 OpenRouter 2026年7月可引用核心數據速查

  • 中國廠商合計 Token 份額:約 46%(一年前不到 2%),是過去 12 個月 AI 產業最陡峭的份額遷移曲線之一
  • 美國廠商合計份額:約 30%–36%(一年前約 70%)
  • DeepSeek V4 Flash vs GPT-5.5 輸入價差:約 35 倍($0.05–0.14/M vs ~$5/M)
  • Claude Opus 5 FrontierBench v0.1:43.3%,反超 GPT-5.6 Sol 的 37.5%
  • Hermes Agent 應用層份額:約 45%,是 OpenRouter 上最大的單一應用
  • Kimi K3 開源權重:1.4TB,為目前最大開源權重;7 月 25 日單日 Token 157.6B,新上榜漲勢最猛
  • 創意角色扮演占開源模型用量:超過一半(OpenRouter × a16z State of AI 報告)

06 結語:能力與用量分道揚鑣,穩定基礎設施才是長期解法

7 月這份榜單最值得記住的一句話是:capability(能力)和 popularity(用量)正在分道揚鑣。中國開源模型靠價格拿下了流量的半壁江山,而美國閉源旗艦仍然守著難任務的定價權和安全聲譽的護城河。8 月,這場「性價比 vs 高端定價權」的拉鋸戰只會更激烈——比起糾結「誰是第一」,更值得投入精力的是建立自己的評測體系和分層路由策略。

運行持久 Agent 流水線、多模型路由閘道或程式 Agent 產品的團隊,純 SaaS API 方案有三個真實短板:出口管制可一夜切斷頂級模型存取共享雲上的長任務易被搶占或限流國內存取 OpenRouter 平均延遲 180–250ms 且不支援發票。對於更穩定、更適合 AI Agent 自動化的生產環境,JEXCLOUD 多區域裸金屬 Mac 是更優解:獨占 Apple Silicon 算力、7×24 線上、按月彈性擴縮,120 秒交付,適合 MCP Server 常駐、本機嵌入索引與合規資料隔離。具體節點與價格請見 JEXCLOUD 定價頁

數據來源:OpenRouter 官方排行榜OpenRouter AppsOpenRouter State of AItokenmaxxing.compresenc.aiAnthropic Claude Opus 5。統計截止 2026 年 7 月 25 日,具體數字請以發布時 openrouter.ai/rankings 即時數據為準。