8 月 12 日到 17 日的五天里,跟进国产 API 账单、开源权重和 Agent 选型的人会同时撞上三件互相矛盾又互相呼应的事:DeepSeek 宣布 API 涨价最高超 1100%,阿里把从未开源过的 Qwen-Max 级旗舰 2.4 万亿参数权重放出来,智谱则用同一个基座、纯靠后训练把编程测试成绩拉高数倍。三家公司、三种打法,共同指向同一个信号——国产大模型正在从「卷价格」转向「卷定价权」。
本文按素材稿整理时间线、涨价明细、Qwen 规格、GLM 基准、三种逻辑、横向比价、争议点与 FAQ。读完应能回答:1100% 对应哪一档计费、个人开发者能否免费商用 Qwen3.8-Max、GLM-5.3 是不是换了基座。
01 DeepSeek涨价这两周到底发生了什么
痛点很具体:媒体标题分别写「涨 11 倍」「涨超 1100%」「涨 350%」,开源许可证又被传「禁止欧美下载」,业务侧很难判断自己的账单和合规边界会怎么变。先把可核对节点摊开:
| 日期 | 事件 |
|---|---|
| 7 月 16 日 | 月之暗面 Kimi K3(2.8 万亿参数)开源,此前已引发美方安全关注 |
| 7 月 30 日 | OpenAI 把最便宜档 GPT-5.6 Luna 降价 80% |
| 8 月 2 日–3 日 | 阿里 Qwen3.8-Max 先预告、后上线云端 API |
| 8 月 6 日–7 日 | OpenAI 把 Luna 设为免费用户默认模型,并开放无限文本对话 |
| 8 月 10 日 | Meta 发布开源模型 Muse Glimmer(300 亿参数,Apache 2.0),预告旗舰 Muse Spark 1.2 权重「即将开源」 |
| 8 月 12 日 | 阿里正式在 ModelScope / Hugging Face 放出 Qwen3.8-2.4T-A95B 开源权重;同日 xAI 发布 Grok 4.6 |
| 8 月 13 日 | DeepSeek-V4-Pro 正式版上线,同步公告 8 月 17 日起 API 涨价;谷歌发布降价的 Gemini 3.7 Flash |
| 8 月 14 日 | 智谱发布 GLM-5.3,沿用 GLM-5.2 的 7430 亿参数基座 |
| 8 月 17 日 0 点(北京时间) | DeepSeek 新定价正式生效 |
把镜头拉远:中国厂商在涨价和开源上做加法的同一时间,美国厂商正在免费和降价上做加法。这不是巧合,而是同一场定价博弈的两个侧面。国内财经媒体普遍将过去一个月 DeepSeek、阿里、智谱,以及月之暗面 Kimi K3、MiniMax H3 的密集发布,解读为「一周三更」,倒逼全球 AI 行业重新定价。
三家看起来各走各的:一家涨价、一家放权重、一家只改后训练。合在一起,比的是谁能定义价格,而不只是谁更便宜。
02 DeepSeek新价格、Qwen3.8规格和GLM-5.3基准怎么对照
先把三组可引用数字摊开。高峰时段为北京时间 9–12 点、14–18 点;价格单位为每百万 tokens,人民币口径来自 DeepSeek 官方公告,并经华尔街见闻、IT之家、V2EX 等多方交叉核对。
| 计费项(每百万 tokens) | 涨价前 | 空闲时段(新) | 高峰时段(新) | 涨幅(高峰) |
|---|---|---|---|---|
| V4-Flash 缓存命中输入 | ¥0.02 | ¥0.05 | ¥0.10 | 约 400% |
| V4-Flash 缓存未命中输入 | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 输出 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro 缓存命中输入 | ¥0.025 | ¥0.15 | ¥0.30 | 约 1100% |
| V4-Pro 缓存未命中输入 | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 输出 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
缓存命中场景涨幅最大(最高约 12 倍 / 1100%+),但绝对金额仍很小;对重度调用者影响更大的其实是输出价格(350%)和缓存未命中输入价格。有分析测算:重度用户实际账单涨幅约为 1.8 倍左右——前提是调用大多落在空闲时段,且缓存命中率较高。
| 项目 | 数据 |
|---|---|
| 参数规模 | 2.4 万亿总参数,950 亿激活参数(MoE,512 个专家,10 路由 + 1 共享) |
| 上下文窗口 | 开源权重原生 26.2 万 tokens,可扩展至约 101 万;云端 Max 版默认 100 万 tokens |
| 发布节奏 | 8 月 2 日预告 → 8 月 3 日 API 上线 → 8 月 12 日开源权重 |
| API 定价(国际站) | 输入 $2 / M tokens,输出 $6 / M tokens |
| 许可证 | 非 Apache 2.0,自定义「Qwen3.8-Max License」 |
| 意义 | 阿里历史上首次把 Max 级(旗舰)模型开源,此前 Qwen3.5 / 3.6 / 3.7 Max 均为闭源 API |
| 基准测试 | GLM-5.2 | GLM-5.3 | 变化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 |
| Agents' Last Exam(CLI) | 23.8% | 28.5% | +4.7 |
| CyberGym | 77.2% | 84.5% | +7.3 |
| AutomationBench | 26.2% | 48.2% | +22.0 |
以上为智谱官方自测数据,尚无独立第三方复测结果。GLM-5.3 在 Terminal-Bench 3.0 上仍落后 GPT-5.6 Sol(34.6%)和 Claude Fable 5(33.7%),并非全面登顶,而是「开源模型第一梯队」。
headline 数字看缓存命中输入;真实账单更常被输出价和缓存未命中输入价拉动。
03 DeepSeek分时定价、阿里自定义许可证、智谱后训练各赌什么
1. DeepSeek:从「贴地价」到「分时定价」,本质是算力紧张的显性化。这次涨价最容易被误读为「跟涨」,但细看结构更像一次「算力账单透明化」。此前 DeepSeek 长期采用不分时段的统一低价,用低价换用户规模,再靠缓存命中率和错峰调度摊薄成本。当调用量指数级增长、GPU 产能跟不上时,这套模式撑不住——涨价公告里「鼓励更灵活的工作负载调度」,翻译过来就是「我们的算力已经不够用了,请你自己错峰」。涨价后,官方 API 在高峰时段已经反超部分第三方转售平台(如 GMI Cloud、Novita 等目前报价仍低于 DeepSeek 官方高峰价)。「官方价格最便宜」这个曾经支撑护城河的假设,第一次被打破。
2. 阿里:开源权重圈住生态,自定义许可证圈住收入。Qwen3.8-Max 的开源不是简单的「慈善」。阿里同时做了两件事:把 2.4 万亿参数的权重公开下载,同时配一份不同于以往 Apache 2.0 的自定义许可证——年营收超 5000 万美元的「模型即服务」或「AI 工作助手」业务,必须单独找阿里谈商业授权;月活超 1 亿或月收入超 2000 万美元的产品,必须在界面上显著展示模型名称。逻辑是:用开源换开发者生态和口碑(尤其是海外开发者),但在真正能产生现金流的大客户身上继续保留议价权。这也是为什么它和 Meta 的 Muse Glimmer(完全 Apache 2.0,无附加条款)在「开源程度」上不是一个量级。网上一度传许可证禁止美国、欧盟、英国、韩国用户下载,这是不实信息,官方许可证原文中并无任何地域限制条款。
3. 智谱 GLM-5.3:不换基座,只换「后训练配方」。最值得关注的不是分数本身,而是怎么拿到这个分数——基座模型和 GLM-5.2 完全相同(7430 亿参数),没有重新预训练,仅靠扩大强化学习环境规模做后训练,就把 Terminal-Bench 3.0 从 4.6% 拉到 28.3%,接近 6 倍提升。当预训练 Scaling Law 边际收益放缓,「后训练强化学习规模化」正在成为新的性能杠杆,门槛显著低于重新训练一个千亿级基座,意味着更多中小厂商也有机会靠「精装修」追上头部模型。
China labs · Aug 12–17 2026
DeepSeek peak TOD pricing · cache-hit input ~1100%
Qwen3.8 2.4T-A95B weights + custom license
GLM-5.3 same 743B base · post-training only
US labs Luna -80% then free default · Gemini 3.7 Flash cut
Signal compete on pricing power, not floor price
可引用硬信息(便于二次核对):
- V4-Pro 缓存命中输入:¥0.025 → 高峰 ¥0.30,约 1100%。
- Qwen3.8-Max:2.4 万亿总参数 / 950 亿激活;国际站 API $2 / $6;自定义许可证。
- GLM-5.3 Terminal-Bench 3.0:4.6% → 28.3%(厂商自测);仍落后 Sol 34.6%、Fable 5 33.7%。
04 涨价后DeepSeek还是最便宜吗,读完怎么六步核实
换算汇率按约 ¥7.15 / $1 估算,仅供参考,实际以官方公告为准。
| 模型 | 输入(每百万 tokens) | 输出(每百万 tokens) | 开源程度 |
|---|---|---|---|
| DeepSeek V4-Pro(高峰) | ¥9.0(约 $1.26) | ¥27.0(约 $3.78) | 权重未开源 |
| DeepSeek V4-Pro(空闲) | ¥4.5(约 $0.63) | ¥13.5(约 $1.89) | 权重未开源 |
| Qwen3.8-Max(国际站) | $2 | $6 | 开源(自定义许可证) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | 闭源 |
| Claude Opus 5(据阿里披露的倍数关系推算) | 约 $5 | 约 $25 | 闭源 |
涨价后 DeepSeek V4-Pro 空闲时段价格仍明显低于 Claude Opus 5,但已经不再是「全场最低」——阿里国际站的 Qwen3.8-Max、OpenAI 的 Luna 都比 DeepSeek 的空闲价更便宜。「国产 = 最便宜」的等式正在瓦解,价格竞争进入分层阶段。
争议点与需要注意的细节(按素材标注):
- 涨价幅度的口径混乱:「涨 11 倍」「涨超 1100%」「涨 350%」都对,但对应不同计费维度(缓存命中输入 vs 输出 vs 缓存未命中输入)。
- 阿里「震悟 M890 国产芯片」服务的说法:多家中文财经媒体报道称 Qwen3.8-Max 部分推理服务跑在阿里自研的震悟 M890 芯片和「盘古 AL128」超节点上,目前仅见于中文媒体转述,未见阿里官方独立技术文档或第三方基准测试确认,属未经独立验证。
- GLM-5.3「发现 Cursor 严重漏洞」的说法:来自 VentureBeat 报道及智谱方面透露,具体漏洞细节未公开披露,属厂商单方面披露。
- 中国商务部可能酝酿反制出口管制:部分报道提及,目前未见官方正式确认,属媒体推测 / 传闻,仅供背景参考。
六步核实指南:
- 打开 DeepSeek 官方价目:按缓存命中输入、缓存未命中输入、输出三项分别核对空闲价与高峰价;高峰为北京时间 9–12 点、14–18 点,生效点为 8 月 17 日 0 点。
- 把 headline 涨幅对回计费项:约 1100% 对应 V4-Pro 高峰缓存命中输入;350% 对应输出;200% 对应缓存未命中输入。不要把三个数字当成同一件事。
- 阅读 Qwen3.8-Max License 原文:确认无地域限制;年营收超 5000 万美元的「模型即服务」或「AI 工作助手」需单独商业授权;月活超 1 亿或月收入超 2000 万美元须显著标注模型名称。
- 对照 GLM 官方基准表:确认 5.3 与 5.2 同为 7430 亿基座、无重新预训练;Terminal-Bench 3.0 为 4.6% → 28.3%;并标注尚无第三方复测,且仍落后 Sol 与 Fable 5。
- 做一张自己的比价表:把 DeepSeek 空闲 / 高峰、Qwen 国际站 $2 / $6、Luna $0.20 / $1.20、Claude Opus 5 约 $5 / $25 放在同一口径(可按约 ¥7.15 / $1 换算),再决定路由,而不是默认「国产最便宜」。
- 按工作负载做调度:能错峰且缓存命中高,实际账单涨幅可能接近约 1.8 倍;高峰 + 低缓存则接近 headline。需要自部署权重时,评估自定义许可证与节点,而不是只看「能下载」。
官方与报道入口(发版或入库后请再次打开链接核对):
05 DeepSeek涨价FAQ:账单、许可证和节点怎么选
FAQ 速答
- DeepSeek 这次涨价之后,是不是意味着以后用起来更贵了?要分场景看。如果调用大多落在空闲时段(非北京时间 9–12 点、14–18 点),且缓存命中率较高,实际涨幅会明显低于「350%」「1100%」这类 headline 数字(有分析测算重度用户实际账单涨幅约为 1.8 倍左右);如果集中在高峰时段、且缓存命中率低,涨幅会接近甚至达到 headline 数字。
- 阿里开源的 Qwen3.8-Max,个人开发者能免费商用吗?个人开发者和内部使用基本不受影响。但如果你的业务是「模型即服务」或「AI 工作助手」类产品,且过去 12 个月内该业务累计收入超过 5000 万美元,需要单独向阿里申请商业授权;如果产品月活超 1 亿或月收入超 2000 万美元,需要在界面上显著标注模型名称。
- GLM-5.3 和 GLM-5.2 是同一个模型吗?为什么突然变强这么多?底层基座模型确实完全相同(7430 亿参数),智谱没有重新训练。分数大幅提升的原因是后训练阶段大幅扩大了强化学习环境的规模,说明当前阶段「后训练规模化」本身就是一个独立、有效的性能杠杆。
- 网传阿里的 Qwen3.8-Max 许可证禁止美国、欧盟用户下载,是真的吗?不是真的。官方许可证原文中没有任何地域限制条款,主要限制是针对超过特定营收规模的商业化服务,与用户所在地区无关。
- Meta 这次开源 Muse Glimmer,是不是意味着 Llama 时代的开源精神又回来了?目前还只能算「部分回归」。Muse Glimmer 本身只是一个 300 亿参数的蒸馏小模型,旗舰闭源模型 Muse Spark 1.2 尚未开源,扎克伯格只是「预告」未来会开放其权重。如果这一步真的落地,才称得上是美国厂商首次把旗舰级闭源模型转为开源。
另一层背景是地缘政治:月之暗面 Kimi K3 的开源此前已引发美方安全审查关注,阿里选择在这个窗口把 2.4 万亿参数的旗舰模型开源,被部分分析解读为「在潜在监管收紧前,抢先巩固国产模型的国际影响力和技术对等叙事」。这一判断带有一定推测性质,但确实是理解这波开源潮时机选择时不可忽略的背景。
对开发者与 Agent 团队而言:只盯官方低价 API,会在高峰时段被分时定价打到;只下载开源权重却没有稳定节点,2.4 万亿级 MoE 很难变成可复现的生产环境;共享 GPU 云还常把隔离、许可证展示和 7×24 日志搅在一起。对需要完整 macOS 环境跑 Cursor、本地开放权重试验与 iOS CI/CD、且希望节点 7×24 在线的团队,CALMVPS 的裸金属 Mac Mini 租赁通常是更优解:独占 Apple Silicon、按月弹性下单、120 秒交付。机型与实时价格见 CALMVPS 定价页。
数据来源:DeepSeek 官方涨价公告,经华尔街见闻、IT之家、AIGC 工具导航、V2EX 社区讨论交叉核对;阿里 Qwen 官方模型仓库(Hugging Face / ModelScope)及南华早报(SCMP)关于许可证条款的报道;智谱(Z.ai)GLM-5.3 官方技术页面及 VentureBeat、StableLearn 相关报道;Meta AI Research 官方博客及 VentureBeat 关于 Muse Glimmer 的报道;第一财经、搜狐财经等关于中国大模型密集发布节奏的综合报道。以上数据截至发稿前公开信息整理,涉及价格、许可证条款、基准测试分数等内容建议发布前再次核实最新官方公告;芯片服务、安全漏洞发现、出口管制传闻已在正文中标注为未经独立验证信息。