DeepSeek涨价+阿里开源2.4万亿旗舰+GLM-5.3跃升:中国大模型8月为何集体"变阵"?
8月12日到17日的五天里,中国大模型圈接连做了三件互相矛盾又互相呼应的事:DeepSeek宣布API涨价最高超1100%,阿里同步把从未开源过的Qwen-Max级旗舰2.4万亿参数权重放出来,智谱则用同一个基座模型、纯靠后训练把编程测试成绩拉高数倍。三家公司、三种打法,共同指向同一个信号——国产大模型正在从"卷价格"转向"卷定价权"。
本文将回答三件事:① 这两周发生了什么、核心数字怎么读;② DeepSeek 分时涨价、阿里自定义许可证、GLM-5.3 同基座后训练分别在赌什么;③ 涨价后 DeepSeek 还是不是最便宜的旗舰,以及开发者该如何拆账单、读许可证、错峰调度。站内相关复盘见 Qwen3.8-Max 发布、V4 Flash 正式版 与 GPT-5.6 降价。
01 中国大模型8月变阵:时间线与核心痛点
把镜头拉到一张时间线上,这两周的节奏会更清楚:
| 日期 | 事件 |
|---|---|
| 7月16日 | 月之暗面 Kimi K3(2.8万亿参数)开源,此前已引发美方安全关注 |
| 8月2日–3日 | 阿里 Qwen3.8-Max 先预告、后上线云端 API |
| 8月10日 | Meta 发布开源模型 Muse Glimmer(300亿参数,Apache 2.0),预告旗舰 Muse Spark 1.2 权重"即将开源" |
| 8月12日 | 阿里正式在 ModelScope / Hugging Face 放出 Qwen3.8-2.4T-A95B 开源权重;同日 xAI 发布 Grok 4.6 |
| 8月13日 | DeepSeek-V4-Pro 正式版上线,同步公告 8月17日起 API 涨价;谷歌发布降价的 Gemini 3.7 Flash |
| 8月14日 | 智谱发布 GLM-5.3,沿用 GLM-5.2 的 7430亿参数基座 |
| 8月17日 0点(北京时间) | DeepSeek 新定价正式生效 |
把镜头再拉远一点:7月30日 OpenAI 已经把最便宜档的 GPT-5.6 Luna 降价 80%,8月6日–7日又把 Luna 设为免费用户默认模型并开放无限文本对话——也就是说,中国厂商在涨价和开源上做加法的同一时间,美国厂商正在免费和降价上做加法。这不是巧合,而是同一场定价博弈的两个侧面。Kimi K3 开源背景见 Kimi K3 全面开源,DeepSeek 此前峰谷计费框架见 V4 GA 与峰谷计费。
读者与采购团队当前面临的核心痛点:
- headline 涨幅口径混乱:媒体分别写"涨 11 倍""涨超 1100%""涨 350%",对应的是缓存命中输入、输出、缓存未命中输入等不同计费项,直接按标题估算账单会失真。
- "官方最便宜"假设被打破:高峰时段 DeepSeek 官方价已反超部分第三方转售平台,错峰与选渠道第一次变成必做功课。
- 开源不等于 Apache 2.0:Qwen3.8-Max 权重可下,但自定义许可证卡住了高营收 MaaS / AI 工作助手业务。
- 地域禁令谣言跑得比许可证原文快:网上一度传阿里禁止美欧英韩用户下载,原文并无任何地域限制。
三家公司、三种打法,共同指向同一个信号:国产大模型正在从"卷价格"转向"卷定价权"。
02 DeepSeek涨价、Qwen开源、GLM-5.3:核心数据一览
DeepSeek 新定价自 8月17日 0点起生效,北京时间 9–12 点、14–18 点为高峰时段。
| 计费项 | 涨价前 | 空闲时段(新) | 高峰时段(新) | 涨幅(高峰) |
|---|---|---|---|---|
| V4-Flash 缓存命中输入 | ¥0.02 | ¥0.05 | ¥0.10 | 约 400% |
| V4-Flash 缓存未命中输入 | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 输出 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro 缓存命中输入 | ¥0.025 | ¥0.15 | ¥0.30 | 约 1100% |
| V4-Pro 缓存未命中输入 | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 输出 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
数据来源:DeepSeek 官方公告,经华尔街见闻、IT之家、V2EX 等多方交叉核对。缓存命中场景涨幅最大(最高约 12 倍 / 1100%+),但绝对金额仍很小;对重度调用者影响更大的其实是输出价格(350%)和缓存未命中输入价格。独立成本测算显示,一个较现实的重度负载(约 8400 万 tokens/月、多为空闲、约一半缓存命中)账单涨幅更接近 1.8 倍——真实,但远低于最吓人的 headline。
| 项目 | 数据 |
|---|---|
| 参数规模 | 2.4万亿总参数,950亿激活参数(MoE,512个专家,10路由+1共享) |
| 上下文窗口 | 开源权重原生 26.2万 tokens,可扩展至约 101万;云端 Max 版默认 100万 tokens |
| 发布节奏 | 8月2日预告 → 8月3日 API 上线 → 8月12日开源权重 |
| API 定价(国际站) | 输入 $2 / M tokens,输出 $6 / M tokens |
| 许可证 | 非 Apache 2.0,自定义 "Qwen3.8-Max License" |
| 意义 | 阿里历史上首次把 Max 级(旗舰)模型开源,此前 Qwen3.5 / 3.6 / 3.7 Max 均为闭源 API |
| 基准测试 | GLM-5.2 | GLM-5.3 | 变化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 |
| Agents' Last Exam(CLI) | 23.8% | 28.5% | +4.7 |
| CyberGym | 77.2% | 84.5% | +7.3 |
| AutomationBench | 26.2% | 48.2% | +22.0 |
以上为智谱官方自测数据,尚无独立第三方复测结果。GLM-5.3 在 Terminal-Bench 3.0 上仍落后 GPT-5.6 Sol(34.6%)和 Claude Fable 5(33.7%),并非全面登顶,而是"开源模型第一梯队"。
03 DeepSeek、阿里、智谱:三种打法三种逻辑
1. DeepSeek:从"贴地价"到"分时定价",本质是算力紧张的显性化
DeepSeek 这次涨价最容易被误读为"跟涨",但细看结构会发现它更像一次"算力账单透明化"。此前 DeepSeek 长期采用不分时段的统一低价,本质上是用低价换取用户规模,再靠缓存命中率和错峰调度摊薄成本。但当调用量指数级增长、GPU 产能跟不上时,这套模式撑不住了——涨价公告里"鼓励更灵活的工作负载调度"这句话,翻译过来就是"我们的算力已经不够用了,请你自己错峰"。
值得注意的细节:涨价后 DeepSeek 官方 API 的价格,在高峰时段已经反超部分第三方转售平台(如 GMI Cloud、Novita 等目前报价仍低于 DeepSeek 官方高峰价)。这意味着"官方价格最便宜"这个曾经支撑 DeepSeek 护城河的假设,第一次被打破。
2. 阿里:开源权重,圈住生态;自定义许可证,圈住收入
Qwen3.8-Max 的开源不是简单的"慈善"。阿里同时做了两件事:把 2.4万亿参数的权重公开下载,同时给这个权重配了一份不同于以往 Apache 2.0 的自定义许可证——年营收超 5000万美元的"模型即服务"或"AI 工作助手"业务,必须单独找阿里谈商业授权;月活超 1亿或月收入超 2000万美元的产品,必须在界面上显著展示模型名称。
这套组合拳的逻辑是:用开源换开发者生态和口碑(尤其是海外开发者,缓解"国产模型上不了台面"的印象),但在真正能产生现金流的大客户身上,继续保留议价权。这也是为什么它和 Meta 的 Muse Glimmer(完全 Apache 2.0,无附加条款)在"开源程度"上其实不是一个量级。
需要澄清一个流传较广的谣言:网上一度传阿里的许可证禁止美国、欧盟、英国、韩国用户下载,这是不实信息,官方许可证原文中并无任何地域限制条款——这类谣言的传播速度往往比读一遍原始许可证文本更快,值得对信息源保持警惕。一手文本见 Hugging Face 模型仓库 与 LICENSE 原文。
3. 智谱 GLM-5.3:不换基座,只换"后训练配方",说明规模化训练已不是唯一杠杆
GLM-5.3 最值得关注的不是分数本身,而是"怎么拿到这个分数"——基座模型和 GLM-5.2 完全相同(7430亿参数),没有重新预训练,仅靠扩大强化学习环境规模做后训练,就把 Terminal-Bench 3.0 从 4.6% 拉到 28.3%,接近 6 倍提升。这印证了行业内近半年逐渐清晰的一个趋势:当预训练的 Scaling Law 边际收益放缓,"后训练强化学习规模化"正在成为新的性能杠杆,而这个杠杆的门槛显著低于重新训练一个千亿级基座模型,意味着更多中小厂商也有机会靠"精装修"追上头部模型。官方技术页见 Z.ai GLM-5.3。
TZ=Asia/Shanghai date +%H:%M
# peak if 09:00-12:00 or 14:00-18:00 Beijing
# shift batch / eval jobs off these windows
# do not quote 1100% as your real bill delta
curl -s https://api-docs.deepseek.com/quick_start/pricing
DeepSeek 把算力缺口写进价目表;阿里用开源换生态、用许可证留议价权;智谱证明后训练规模化可以单独当杠杆。
04 涨价之后,DeepSeek还是最便宜的旗舰吗?
| 模型 | 输入价格 | 输出价格 | 开源程度 |
|---|---|---|---|
| DeepSeek V4-Pro(高峰) | ¥9.0(约 $1.26) | ¥27.0(约 $3.78) | 权重未开源 |
| DeepSeek V4-Pro(空闲) | ¥4.5(约 $0.63) | ¥13.5(约 $1.89) | 权重未开源 |
| Qwen3.8-Max(国际站) | $2 | $6 | 开源(自定义许可证) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | 闭源 |
| Claude Opus 5(据阿里披露的倍数关系推算) | 约 $5 | 约 $25 | 闭源 |
换算汇率按约 ¥7.15 / $1 估算,仅供参考,实际以官方公告为准。可以看到:涨价后 DeepSeek V4-Pro 空闲时段价格仍明显低于 Claude Opus 5,但已经不再是"全场最低"——阿里国际站的 Qwen3.8-Max、OpenAI 的 Luna 都比 DeepSeek 的空闲价更便宜,说明"国产=最便宜"的等式正在瓦解,价格竞争进入分层阶段。
"国产=最便宜"在 2025 年到 2026 年初大体成立;到 2026 年 8 月 17 日,这不再是可以无条件沿用的假设。
05 争议点、两线战争与六步落地清单
争议点与需要注意的细节
- 涨价幅度的口径混乱:不同媒体分别报道"涨 11 倍""涨超 1100%""涨 350%",这些说法都对,但对应的是不同计费维度(缓存命中输入 vs 输出 vs 缓存未命中输入),阅读时需要看清具体是哪一项。
- 阿里"震悟 M890 国产芯片"服务的说法:多家中文财经媒体报道称 Qwen3.8-Max 部分推理服务跑在阿里自研的震悟 M890 芯片和"盘古 AL128"超节点上,但这一细节目前仅见于中文媒体转述,未见阿里官方独立技术文档或第三方基准测试确认,建议标注为未经独立验证的信息。
- GLM-5.3"发现 Cursor 严重漏洞"的说法:来自 VentureBeat 报道及智谱方面透露,具体漏洞细节未公开披露,真实性和影响范围有待第三方安全机构确认,属于厂商单方面披露。
- 中国商务部可能酝酿反制出口管制:部分报道提及中国官方可能针对 AI / 半导体技术酝酿反制性出口管制措施,这一说法目前未见官方正式确认,属于媒体推测 / 传闻性质,仅供背景参考。
影响与背景:这不是孤立事件,而是一场"两线战争"
把这几件事放进更大的叙事里看:过去一个月,中国头部模型厂商呈现出"一周三更"的密集发布节奏——DeepSeek、阿里、智谱之外,还有月之暗面 Kimi K3(7月16日,2.8万亿参数开源)、MiniMax H3 等轮番登场。国内财经媒体普遍将这一现象解读为"中国开源模型密集发布,倒逼全球 AI 行业重新定价"。
与此同时,美国厂商走的是另一条路径:OpenAI 7月30日大幅降价(Luna 降 80%),8月6日–7日把降价后的 Luna 设为免费用户默认模型并开放无限文本对话;谷歌 8月13日发布价格减半的 Gemini 3.7 Flash。也就是说,中国厂商在"开源旗舰+梯度涨价",美国厂商在"消费端免费+降价防守"——两条路径同时发生,共同把 2026年8月变成了大模型行业定价逻辑重构的一个关键节点。
另一层背景是地缘政治:月之暗面 Kimi K3 的开源此前已引发美方安全审查关注,阿里选择在这个窗口把 2.4万亿参数的旗舰模型开源,被部分分析解读为"在潜在监管收紧前,抢先巩固国产模型的国际影响力和技术对等叙事"。这一判断带有一定推测性质,但确实是理解这波开源潮时机选择时不可忽略的背景。
六步落地清单(给开发者与采购):
- 按计费项拆账单:分别核算缓存命中输入、缓存未命中输入、输出三类涨幅,不要用"1100%"当自己的真实倍率。
- 对照北京时间高峰窗:把可批处理的 Agent / 评测任务挪出 9–12、14–18,优先吃空闲价。
- 先读 LICENSE 原文:以 Hugging Face / ModelScope 仓库里的许可证文件为准,不要转发"美欧英韩禁下"类二手传言。
- 对照营收与 MAU 门槛:MaaS / AI 工作助手过去 12 个月收入超 5000万美元需单独谈授权;月活超 1亿或月收入超 2000万美元需显著标注模型名。
- 横向比价后再锁供应商:同时看 DeepSeek 空闲/高峰、Qwen 国际站 $2/$6、GPT-5.6 Luna $0.20/$1.20,以及第三方转售是否已低于官方高峰价。
- 选稳定错峰宿主:本地拉 2.4T 权重、长上下文评测或 7×24 Agent 调度时,优先可独占、可长连接的裸金属 Mac,而不是超卖共享云。
# Aug 2026 China open-weight + pricing watchlist
1. split bill: cache-hit / cache-miss / output
2. shift jobs off Beijing 09-12 and 14-18
3. read Qwen3.8-Max LICENSE, not rumor threads
4. check $50M MaaS / 100M MAU / $20M monthly triggers
5. compare Luna $0.20/$1.20 vs Qwen $2/$6 vs DS off-peak
6. avoid shared-cloud for 2.4T / long-context evals
next: isolated Apple Silicon host
可引用硬核数据(2026-08-17 口径):
- V4-Pro 缓存命中输入高峰涨幅:¥0.025 → ¥0.30,约 1100%(headline 数字只对应这一档)
- V4-Pro 输出高峰涨幅:¥6.0 → ¥27.0,350%(对真实账单影响更大)
- Qwen3.8-2.4T-A95B:2.4万亿总参数 / 950亿激活,原生 262,144 tokens,自定义许可证
- GLM-5.3 Terminal-Bench 3.0:4.6% → 28.3%,同 7430亿基座、无重新预训练
- 许可证门槛:MaaS / AI 工作助手任意连续 12 个月收入超 $5000万须另谈授权;月活超 1亿或月收入超 $2000万须显著展示模型名
06 FAQ与生产环境收束
Q1:DeepSeek 这次涨价之后,是不是意味着以后用起来更贵了?
要分场景看。如果你的调用大多落在空闲时段(非北京时间 9–12 点、14–18 点),且是缓存命中率较高的重度用户,实际涨幅会明显低于表面的"350%""1100%"这类 headline 数字(有分析测算重度用户实际账单涨幅约为 1.8 倍左右);但如果集中在高峰时段调用、且缓存命中率低,涨幅会接近甚至达到 headline 数字。
Q2:阿里开源的 Qwen3.8-Max,个人开发者能免费商用吗?
个人开发者和内部使用基本不受影响。但如果你的业务是"模型即服务"或"AI 工作助手"类产品,且过去 12 个月内该业务累计收入超过 5000万美元,需要单独向阿里申请商业授权;如果产品月活超 1亿或月收入超 2000万美元,需要在界面上显著标注模型名称。
Q3:GLM-5.3 和 GLM-5.2 是同一个模型吗?为什么突然变强这么多?
底层基座模型确实完全相同(7430亿参数),智谱没有重新训练。分数大幅提升的原因是后训练阶段大幅扩大了强化学习环境的规模,这说明当前阶段"后训练规模化"本身就是一个独立、有效的性能杠杆,不一定需要重新预训练一个更大的基座。
Q4:网传阿里的 Qwen3.8-Max 许可证禁止美国、欧盟用户下载,是真的吗?
不是真的。这是网络上流传的不实信息,官方许可证原文中没有任何地域限制条款,主要限制是针对超过特定营收规模的商业化服务,与用户所在地区无关。
Q5:Meta 这次开源 Muse Glimmer,是不是意味着 Llama 时代的开源精神又回来了?
目前还只能算"部分回归"。Muse Glimmer 本身只是一个 300亿参数的蒸馏小模型,Meta 真正的旗舰闭源模型 Muse Spark 1.2 尚未开源,扎克伯格只是"预告"未来会开放其权重。如果这一步真的落地,才称得上是美国厂商首次把旗舰级闭源模型转为开源,目前仍需持续关注后续进展。
数据来源:DeepSeek 官方涨价公告,经华尔街见闻、IT之家、AIGC 工具导航、V2EX 社区讨论交叉核对;阿里 Qwen 官方模型仓库(Hugging Face / ModelScope)及南华早报(SCMP)关于许可证条款的报道;智谱(Z.ai)GLM-5.3 官方技术页面及 VentureBeat、StableLearn 相关报道;Meta AI Research 官方博客及 VentureBeat 关于 Muse Glimmer 的报道;第一财经、搜狐财经等关于中国大模型密集发布节奏的综合报道。以上数据截至发稿前公开信息整理,涉及价格、许可证条款、基准测试分数等内容建议发布前再次核实最新官方公告,部分细节(如芯片服务、安全漏洞发现、出口管制传闻)已在正文中标注为未经独立验证信息。
共享云主机跑长上下文评测或本地拉 2.4T 权重时,常见宽带抖动与超卖;错峰调度 Agent 时,临时拼凑节点长连接易被打断,也难做真正的独占隔离。把高内存推理和 7×24 调度丢给不稳定的共享实例,账单和任务成功率都会一起抖。对于更稳定、更适合开源权重评测与错峰 Agent 自动化的生产环境,JEXCLOUD 多区域裸金属 Mac 通常是更优解:独占 Apple Silicon、可 root、7×24 在线、按月弹性,约 120 秒交付。具体节点与价格请见 JEXCLOUD 定价页。