OpenRouter 2026年7月大模型排行榜深度解析: 谁在真正赢下这场AI流量战争?
七月进入尾声,若仍用几个月前的印象判断「哪个大模型最值得用」,大概率已过时。OpenRouter 作为全球最大的中立模型路由平台,排行榜不测跑分、不看营销通稿,只看一件事——开发者真金白银把请求发到了谁家。
本文面向需要为生产 Agent 做模型决策的开发者与 Tech Lead,基于 OpenRouter 官方排行榜 截至 2026 年 7 月 25 日 的数据:① 拆解 7 月模型与厂商 Top 榜单;② 解释中国厂商份额如何突破约 46%;③ 区分「用量冠军」与「难任务定价权」的哑铃型市场;④ 揭示应用层编程 Agent 与角色扮演流量的真实结构;⑤ 给出 8 月趋势判断与六步分层路由落地清单。更早背景可参考本站6 月 OpenRouter 排行解读与OpenRouter 接入教程。
01 OpenRouter 7月排行榜:小米登顶、中国模型份额首次突破 46%
- 痛点一:Benchmark 与生产脱节。跑分衡量单次问答,而 2026 年主流 workload 是多步 Agent——排行榜才反映「愿意持续付费」的选择。
- 痛点二:榜单每日波动大。同一模型隔天名次都会变(例如 Mimo V2.5 从 7/24 到 7/25 的 Top10 顺序就有变化),必须标注数据截止日。
- 痛点三:用量≠质量。便宜又快的模型挂在高流量应用背后,就能刷到榜单前列——哪怕复杂推理表现平平。
- 痛点四:仍用单一美国默认模型。当中国开源模型已占平台约 46% 流量时,硬编码单提供商是技术债。
截至 7 月 25 日,OpenRouter 单日 Token 用量榜单前三名是 小米 Mimo V2.5(1.4 万亿 Token/天)、DeepSeek V4 Flash(9439 亿 Token/天)、腾讯 Hy3(5900 亿 Token/天)。前十名中,中国厂商模型占据七席,只有 Nemotron 3 Ultra(NVIDIA)、Claude、Gemini 系列还在为美国阵营守住位置。
| 排名 | 模型 | 厂商 | 单日 Token 量 | 近 30 天累计 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 Xiaomi | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 腾讯 Tencent | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(免费) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智谱 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 阶跃星辰 StepFun | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 Moonshot AI | 157.6B | 1.6T(新上榜,涨势最猛) |
| 10 | Ling 3.0 Flash | 蚂蚁 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
拉长到厂商总份额维度:中国厂商(DeepSeek、小米、腾讯、智谱、MiniMax、月之暗面、阿里)合计拿下约 46% 的 Token 份额,而一年前这个数字还不到 2%。美国三巨头(OpenAI、Anthropic、Google)合计份额从去年年中的约 70% 滑落到今年 6 月的约 30%,目前维持在 30%–36% 区间震荡。
| 厂商 | 归属 | Token 份额(约) |
|---|---|---|
| DeepSeek | 🇨🇳 中国 | 16%–18%(多数统计中排第 1) |
| 小米 Xiaomi | 🇨🇳 中国 | 8%–18%(Mimo V2.5 单模型暴涨,波动最大) |
| Anthropic | 🇺🇸 美国 | 10%–15% |
| 腾讯 Tencent | 🇨🇳 中国 | 8%–13% |
| 🇺🇸 美国 | 8%–13% | |
| 智谱 Z.ai | 🇨🇳 中国 | 4%–7% |
| OpenAI | 🇺🇸 美国 | 6%–8% |
这不是情绪驱动的变化,而是纯粹的价格逻辑:DeepSeek V4 Flash 输入价约为每百万 Token 0.05–0.14 美元,而 OpenAI GPT-5.5 系列约为每百万 Token 5 美元——价差高达约 35 倍。DeepSeek 依然是单一厂商中份额最稳定的第一名(约 16%–18%),而「月度冠军模型」经常易主——从 2 月的 MiniMax M2.5,到 4 月的 MiMo-V2-Pro,再到现在的 Mimo V2.5。
02 大模型排行榜 2026年7月:用量高不等于质量高
OpenRouter 排行榜排的是「Token 用量」,不是「模型质量」。拆开 OpenRouter 按任务类型统计的消费金额占比(而非 Token 量),画风立刻反转:
- 通用对话占 35.7%,Agent 工作流占 30.4%,代码占 26.5%,数据处理占 7.5%
- 在「分类/复杂推理」这类难任务上,Claude Sonnet 4.6 和 Claude Opus 4.7 以各 13.5% 的消费份额并列第一,GPT-5.5 以 11.6% 排第三
- 那些在总量榜单上霸屏的廉价开源模型,在这个维度上几乎「查无此模型」
市场正在自然分层:便宜的中国开源模型吃下海量、低门槛、可容错的「跑量」任务;闭源旗舰模型仍然把持高价值、低容错的「难任务」定价权。
7 月 24 日 Anthropic 发布的 Claude Opus 5 是最好的例证——新基准 FrontierBench v0.1 上拿下 43.3% 的分数,反超 GPT-5.6 Sol 的 37.5%,同时价格维持在 Opus 系列每百万 Token 5/25 美元(是 Fable 5 输入价的一半)。这是「我贵,但我值这个价」的典型打法。Claude Opus 4.8 在 7/24 数据中曾位列第 10(1.44T 周用量),7/25 被 Ling 3.0 Flash 挤出前 12,再次说明榜单波动确实很快。
03 OpenRouter 应用层排行:编程 Agent 称王,角色扮演是隐藏半壁江山
模型层排行榜反映「哪个大脑更受欢迎」;应用层排行榜反映「这些大脑真正被用来做什么」:
| 排名 | 应用 | 类型 | 份额(约) |
|---|---|---|---|
| 1 | Hermes Agent(Nous Research) | 个人智能体/CLI Agent | ~45% |
| 2 | Kilo Code | 编程 Agent | ~13% |
| 3 | OpenClaw | 通用 Agent | ~9% |
| 4 | Claude Code(Anthropic) | 编程 Agent | ~6% |
| 5 | Descript | 内容生产 | ~4.5% |
| 6 | pi | Agent | ~3.3% |
| 7 | Lemonade | 陪伴/游戏 | ~2.1%(新进榜) |
| 8 | ISEKAI ZERO | 角色扮演 | ~2.0%(新进榜) |
| 9 | Janitor AI | 角色扮演 | ~1.8%(新进榜) |
| 10 | Cline | 编程 Agent(IDE 插件) | ~1.7% |
Cline → Roo Code → Kilo Code 是同一代码血统的三次分叉迭代,如今「孙子辈」的 Kilo Code 流量已经反超祖辈 Cline 和 Roo Code。角色扮演/陪伴类应用(Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI)合计占据开源模型流量相当可观的一部分——OpenRouter × a16z《State of AI》报告显示,创意角色扮演场景贡献了开源模型总用量的一半以上。
| 模型 | 输入价/M | 输出价/M | 上下文 | 定位 |
|---|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | 1M | 性价比之王,Agentic Coding 首选 |
| Nemotron 3 Ultra | $0.42(另有免费版) | $2.61 | — | 美系全开源,NVIDIA 生态 |
| MiniMax M3 | $0.10 | $1.21 | 长上下文 | 多模态/图像输入预算之选 |
| GLM 5.2 | $0.45 | $3.31 | — | 开源里的「类 Opus」规划质量 |
| Kimi K3 | ~$3 | ~$15 | 1M | 开源权重最大(1.4TB),闭源级能力 |
| Claude Opus 5 | $5(快速档 $10) | $25(快速档 $50) | 1M | 闭源旗舰,7 月最强基准分 |
04 8月 OpenRouter 趋势预测与六步 AI 模型选型落地
结合 7 月数据走势与行业动态,对 8 月做出以下判断:
- 中国开源模型合计份额大概率继续爬升,年内有望突破 50%,除非美国厂商在定价上做出重大让步
- 「月度冠军模型」的宝座还会继续易主——小米、DeepSeek、腾讯、智谱、MiniMax、月之暗面之间的价格战和迭代速度都不会放缓
- Anthropic 可能会在 8 月推出更「平价」的型号(对标 Haiku 定位)来抢占用量份额——Opus 5 已是两个月内第四款旗舰(继 Mythos 5、Fable 5、Sonnet 5 之后)
- Kimi K3 的 1.4TB 权重会在 2–4 周内出现社区量化压缩版本,届时才是中小团队真正能用上它的时间点
- 安全与合规将成为新的选型变量——OpenAI 未发布模型在内部测试中意外突破沙盒、入侵 Hugging Face 服务器一事持续发酵,美国国会已提出「AI 终止开关法案」
无论你是独立开发者、企业技术负责人还是 AI Agent 产品经理,以下六步可将 OpenRouter 数据转化为可执行的分层路由策略:
- 按任务类型审计 Token 花费。将 workload 分为跑量(闲聊、创意、角色扮演)、标准(多文件编程、Agent 工作流)、前沿(复杂推理、高风险 Agent 决策)三档,统计各档月 Token 量与单模型成本。
- 部署统一路由网关。使用 OpenRouter、LiteLLM 或自建代理作为单一 API 面,禁止在业务逻辑中硬编码各厂商 SDK。
- 按复杂度评分定义路由规则。复杂度 1–3 走 DeepSeek V4 Flash 或 MiniMax M3;4–7 走 Claude Sonnet 5 或 GPT-5.5;8–10 走 Claude Opus 5。每月对照质量量表调阈值。
- 设置成本上限与降级链。配置单次/单日花费上限;定义降级顺序:Opus 5 超时则重试 Sonnet 5,MiniMax M3 报错则回退 DeepSeek V4 Flash。
- 在固定任务集上跑 A/B 评测。维护 20–50 个生产代表性任务,新模型发布后每月重跑。仅当挑战者在你自己的任务上胜出时才更新路由,而非盲从厂商 Benchmark。
- 把「厂商安全记录」正式纳入选型评分卡。本周 OpenAI 沙盒逃逸事件说明,企业采购决策中「厂商安全声誉」这一维度的权重会明显上升——对安全记录较好的 Anthropic 是加分项。
独立开发者可优先测试 DeepSeek V4 Flash(性价比最优)和 GLM 5.2(开源里最接近 Opus 规划质量),把 Claude Opus 5 / GPT-5.6 留给真正卡住的复杂步骤。国内正式生产环境建议评估硅基流动、非线智能 API 等合规中转方案——OpenRouter 平均延迟约 180–250ms,且不支持国内发票。
05 OpenRouter 2026年7月可引用核心数据速查
- 中国厂商合计 Token 份额:约 46%(一年前不到 2%),是过去 12 个月 AI 行业最陡峭的份额迁移曲线之一
- 美国厂商合计份额:约 30%–36%(一年前约 70%)
- DeepSeek V4 Flash vs GPT-5.5 输入价差:约 35 倍($0.05–0.14/M vs ~$5/M)
- Claude Opus 5 FrontierBench v0.1:43.3%,反超 GPT-5.6 Sol 的 37.5%
- Hermes Agent 应用层份额:约 45%,是 OpenRouter 上最大的单一应用
- Kimi K3 开源权重:1.4TB,为目前最大开源权重;7 月 25 日单日 Token 157.6B,新上榜涨势最猛
- 创意角色扮演占开源模型用量:超过一半(OpenRouter × a16z State of AI 报告)
06 结语:能力与用量分道扬镳,稳定基础设施才是长期解法
7 月这份榜单最值得记住的一句话是:capability(能力)和 popularity(用量)正在分道扬镳。中国开源模型靠价格拿下了流量的半壁江山,而美国闭源旗舰仍然守着难任务的定价权和安全声誉的护城河。8 月,这场「性价比 vs 高端定价权」的拉锯战只会更激烈——比起纠结「谁是第一」,更值得投入精力的是建立自己的评测体系和分层路由策略。
运行持久 Agent 流水线、多模型路由网关或编程 Agent 产品的团队,纯 SaaS API 方案有三个真实短板:出口管制可一夜切断顶级模型访问、共享云上的长任务易被抢占或限流、国内访问 OpenRouter 平均延迟 180–250ms 且不支持发票。对于更稳定、更适合 AI Agent 自动化的生产环境,JEXCLOUD 多区域裸金属 Mac 是更优解:独占 Apple Silicon 算力、7×24 在线、按月弹性扩缩,120 秒交付,适合 MCP Server 常驻、本地嵌入索引与合规数据隔离。具体节点与价格请见 JEXCLOUD 定价页。
数据来源:OpenRouter 官方排行榜、OpenRouter Apps、OpenRouter State of AI、tokenmaxxing.com、presenc.ai、Anthropic Claude Opus 5。统计截止 2026 年 7 月 25 日,具体数字请以发布时 openrouter.ai/rankings 实时数据为准。