DeepSeek涨价1100%之后,开发者账单到底会贵多少
卡住选型的往往不是「贵了」三个字,而是口径对不上:
- headline 不是整张账单:媒体分别写「涨11倍」「涨超1100%」「涨350%」,都对,但对应的是缓存命中输入、输出、缓存未命中输入等不同计费项。
- 高峰与空闲差一倍:北京时间 9–12 点、14–18 点是高峰;错峰调度被写进涨价公告,本质是算力不够用时的显性化。
- 「官方最便宜」第一次被打破:高峰时段,DeepSeek 官方 API 已反超部分第三方转售(如 GMI Cloud、Novita 目前报价仍低于官方高峰价)。
- 开源不等于免费商用:Qwen3.8-Max 权重可下,但许可证不是 Apache 2.0;年营收门槛一过,就要单独谈授权。
此前我们写过 DeepSeek V4 Flash 正式版的跑分与低价结构,以及 Qwen3.8-Max 发布时「下周开源」的预告。本篇不再复述单品发版,只盯 8 月中旬这三记同步变阵。
8月中旬中国大模型发生了什么:一张时间线
把镜头拉到 7 月中旬到 8 月 17 日 0 点(北京时间),三家中国实验室和同期的美国动作叠在同一窗口:
| 日期 | 事件 |
|---|---|
| 7月16日 | 月之暗面 Kimi K3(2.8万亿参数)开源,此前已引发美方安全关注 |
| 8月2日–3日 | 阿里 Qwen3.8-Max 先预告、后上线云端 API |
| 8月10日 | Meta 发布开源模型 Muse Glimmer(300亿参数,Apache 2.0),预告旗舰 Muse Spark 1.2 权重「即将开源」 |
| 8月12日 | 阿里正式在 ModelScope / Hugging Face 放出 Qwen3.8-2.4T-A95B 开源权重;同日 xAI 发布 Grok 4.6 |
| 8月13日 | DeepSeek-V4-Pro 正式版上线,同步公告 8 月 17 日起 API 涨价;谷歌发布降价的 Gemini 3.7 Flash |
| 8月14日 | 智谱发布 GLM-5.3,沿用 GLM-5.2 的 7430 亿参数基座 |
| 8月17日 0点(北京时间) | DeepSeek 新定价正式生效 |
再往前两周:7 月 30 日 OpenAI 把最便宜档 GPT-5.6 Luna 降价 80%,8 月 6–7 日又把 Luna 设为免费用户默认模型并开放无限文本对话。中国厂商在涨价和开源上做加法的同一时间,美国厂商在免费和降价上做加法——同一场定价博弈的两个侧面。Luna 那一轮降价,可对照 GPT-5.6 价格下调拆解。
DeepSeek / Qwen / GLM 核心数据对照,涨价后谁还便宜
DeepSeek 新价自 8 月 17 日 0 点起,北京时间 9–12 点、14–18 点为高峰。下表单位为每百万 tokens,人民币。
| 计费项 | 涨价前 | 空闲(新) | 高峰(新) | 高峰涨幅 |
|---|---|---|---|---|
| V4-Flash 缓存命中输入 | ¥0.02 | ¥0.05 | ¥0.10 | 约400% |
| V4-Flash 缓存未命中输入 | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 输出 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro 缓存命中输入 | ¥0.025 | ¥0.15 | ¥0.30 | 约1100% |
| V4-Pro 缓存未命中输入 | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 输出 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
缓存命中场景涨幅最大(最高约 12 倍 / 1100%+),但绝对金额仍很小;对重度调用者影响更大的是输出价格(350%)和缓存未命中输入。有分析测算:约 8400 万 tokens/月、多在空闲、一半缓存命中的重度负载,账单更接近约 1.8 倍,而不是标题里的 11 倍。
Qwen3.8-2.4T-A95B(Qwen3.8-Max 开源权重)关键规格:
| 项目 | 数据 |
|---|---|
| 参数规模 | 2.4万亿总参数,950亿激活(MoE,512个专家,10路由+1共享) |
| 上下文窗口 | 开源权重原生 26.2 万 tokens,可扩展至约 101 万;云端 Max 版默认 100 万 tokens |
| 发布节奏 | 8月2日预告 → 8月3日 API 上线 → 8月12日开源权重 |
| API 定价(国际站) | 输入 $2 / M tokens,输出 $6 / M tokens |
| 许可证 | 非 Apache 2.0,自定义「Qwen3.8-Max License」 |
| 意义 | 阿里历史上首次把 Max 级旗舰开源;此前 Qwen3.5 / 3.6 / 3.7 Max 均为闭源 API |
GLM-5.3 与 GLM-5.2 同基座、纯靠后训练。以下为智谱官方自测,尚无独立第三方复测:
| 基准测试 | GLM-5.2 | GLM-5.3 | 变化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 |
| Agents' Last Exam(CLI) | 23.8% | 28.5% | +4.7 |
| CyberGym | 77.2% | 84.5% | +7.3 |
| AutomationBench | 26.2% | 48.2% | +22.0 |
GLM-5.3 在 Terminal-Bench 3.0 上仍落后 GPT-5.6 Sol(34.6%)和 Claude Fable 5(33.7%),是「开源模型第一梯队」,不是全面登顶。
横向比价(输入 / 输出均为每百万 tokens;人民币兑美元按约 ¥7.15/$1 估算,仅供参考):
| 模型 | 输入 | 输出 | 开源程度 |
|---|---|---|---|
| DeepSeek V4-Pro(高峰) | ¥9.0(约 $1.26) | ¥27.0(约 $3.78) | 权重未开源 |
| DeepSeek V4-Pro(空闲) | ¥4.5(约 $0.63) | ¥13.5(约 $1.89) | 权重未开源 |
| Qwen3.8-Max(国际站) | $2 | $6 | 开源(自定义许可证) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | 闭源 |
| Claude Opus 5(据阿里披露的倍数关系推算) | 约 $5 | 约 $25 | 闭源 |
涨价后 DeepSeek V4-Pro 空闲价仍明显低于 Claude Opus 5,但已经不再是全场最低:阿里国际站 Qwen3.8-Max、OpenAI Luna 都比 DeepSeek 空闲价更便宜。「国产 = 最便宜」的等式正在瓦解,价格竞争进入分层阶段。
三种打法:分时涨价、自定义开源、后训练配方分别在赌什么
DeepSeek:从贴地价到分时定价,本质是算力紧张的显性化。最容易被误读为「跟涨」,细看结构更像一次算力账单透明化。此前不分时段的统一低价,用低价换用户规模,再靠缓存命中和错峰摊薄成本;调用量指数级增长、GPU 产能跟不上时,这套模式撑不住。公告里「鼓励更灵活的工作负载调度」,翻译过来就是:高峰算力已经不够用,请你自己错峰。
阿里:开源权重圈住生态,自定义许可证圈住收入。2.4 万亿参数可公开下载,同时配一份不同于以往 Apache 2.0 的许可证——年营收超 5000 万美元的「模型即服务」或「AI 工作助手」业务,必须单独谈商业授权;月活超 1 亿或月收入超 2000 万美元的产品,必须在界面上显著展示模型名称。用开源换开发者生态和海外口碑,但在真正能产生现金流的大客户身上保留议价权。这和 Meta Muse Glimmer(完全 Apache 2.0、无附加条款)不是一个量级的「开源」。
需要澄清一个流传较广的谣言:网上一度传阿里许可证禁止美国、欧盟、英国、韩国用户下载,这是不实信息,官方许可证原文并无任何地域限制条款。
智谱 GLM-5.3:不换基座,只换后训练配方。基座与 GLM-5.2 完全相同(7430 亿参数),没有重新预训练,仅靠扩大强化学习环境规模,就把 Terminal-Bench 3.0 从 4.6% 拉到 28.3%,接近 6 倍。当预训练 Scaling Law 边际收益放缓,「后训练强化学习规模化」正在成为新杠杆,门槛显著低于重训一个千亿级基座,中小厂商也有机会靠「精装修」追上头部。
核对官方价表与许可证:开发者六步清单
发版信息可能随时间变化,请以官方链接为准。下面六步用来把标题数字落成你自己的账单和合规结论。
- 打开官方价表,记下高峰 / 空闲与缓存档:不要只转述媒体百分比。DeepSeek 价表按 cache hit / miss 和 output 分列,先抄下你实际会打到的那几档。
- 把调用时区映射到北京高峰:高峰是北京时间 9–12、14–18。用本机时区算一次,避免「我这边半夜」其实落在对方高峰。
- 用最近一周日志估缓存命中率:固定系统提示很长的应用,对 cache-hit 涨幅最敏感;命中率低时,输出 350% 和 miss 输入 200% 才是账单主体。
- 对照 Qwen 许可证门槛,而不是只看「开源」标签:个人与内部使用基本不受影响;MaaS / AI 工作助手且过去 12 个月该业务收入超 5000 万美元,须单独申请商业授权。
- 把 GLM-5.3 分数记成「官方自测、尚未第三方复测」:Terminal-Bench 3.0 仍落后 GPT-5.6 Sol 与 Claude Fable 5,选型时不要写成全面登顶。
- 本地下载权重做对照时,用干净可 wipe 的环境:2.4T 级权重不是笔记本能轻松吃下的;若只要在 Apple Silicon 上跑量化小模型、对照 Agent 工作流,用独享、可 root、测完能清空的机器,比共享开发机更干净。
TZ=Asia/Shanghai date '+%H:%M %Z'
python3 -c "from datetime import datetime; from zoneinfo import ZoneInfo
h=datetime.now(ZoneInfo('Asia/Shanghai')).hour
print('peak' if (9<=h<12 or 14<=h<18) else 'off-peak')"
第三方转售价可能暂时低于官方高峰价,但额度、合规与断供风险不同;比价时把「谁在供货」和「价签」放在同一行看。
哪些说法还没被独立验证,以及可核对来源
- 涨价幅度口径混乱:1100% 对应高峰时段缓存命中输入(起步最接近免费的那一档);输出涨 350%,才是多数真实账单的主体。
- 「震悟 M890 国产芯片」服务:多家中文财经媒体称 Qwen3.8-Max 部分推理跑在阿里自研震悟 M890 和「盘古 AL128」超节点上,目前仅见于中文媒体转述,未见阿里官方独立技术文档或第三方基准确认,属未经独立验证。
- GLM-5.3「发现 Cursor 严重漏洞」:来自 VentureBeat 报道及智谱方面透露,具体漏洞细节未公开,真实性与影响范围有待第三方安全机构确认,属厂商单方面披露。
- 中国商务部可能酝酿反制出口管制:部分报道提及,目前未见官方正式确认,属媒体推测 / 传闻,仅供背景参考。
国内财经媒体普遍将过去一个月「一周三更」解读为国产开源密集发布、倒逼全球重新定价。地缘一层:Kimi K3 开源已引发美方安全审查关注,阿里在这个窗口放出 2.4 万亿旗舰,被部分分析读成「在潜在监管收紧前抢先巩固国际影响力」——带推测性质,但是理解开源潮时机时不可忽略的背景。
官方源(价格、权重、基准以页面当时文本为准):
DeepSeek API Docs — Models & Pricing
Hugging Face — Qwen/Qwen3.8-2.4T-A95B
Z.ai — GLM-5.3: Frontier Coding with Emergent Cyber Capabilities
第三方报道与交叉核对:
CIO — DeepSeek raises some V4 prices by more than 10x
NVIDIA Technical Blog — Serve Qwen3.8-2.4T-A95B
常见问题
DeepSeek这次涨价之后,是不是意味着以后用起来更贵了?
要分场景看。如果你的调用大多落在空闲时段(非北京时间 9–12 点、14–18 点),且是缓存命中率较高的重度用户,实际涨幅会明显低于表面的「350%」「1100%」这类 headline 数字(有分析测算重度用户实际账单涨幅约为 1.8 倍左右);但如果集中在高峰时段调用、且缓存命中率低,涨幅会接近甚至达到 headline 数字。
阿里开源的Qwen3.8-Max,个人开发者能免费商用吗?
个人开发者和内部使用基本不受影响。但如果你的业务是「模型即服务」或「AI 工作助手」类产品,且过去 12 个月内该业务累计收入超过 5000 万美元,需要单独向阿里申请商业授权;如果产品月活超 1 亿或月收入超 2000 万美元,需要在界面上显著标注模型名称。
GLM-5.3和GLM-5.2是同一个模型吗?为什么突然变强这么多?
底层基座模型确实完全相同(7430 亿参数),智谱没有重新训练。分数大幅提升的原因是后训练阶段大幅扩大了强化学习环境的规模,这说明当前阶段「后训练规模化」本身就是一个独立、有效的性能杠杆,不一定需要重新预训练一个更大的基座。
网传阿里的Qwen3.8-Max许可证禁止美国、欧盟用户下载,是真的吗?
不是真的。这是网络上流传的不实信息,官方许可证原文中没有任何地域限制条款,主要限制是针对超过特定营收规模的商业化服务,与用户所在地区无关。
Meta这次开源Muse Glimmer,是不是意味着Llama时代的开源精神又回来了?
目前还只能算「部分回归」。Muse Glimmer 本身只是一个 300 亿参数的蒸馏小模型,Meta 真正的旗舰闭源模型 Muse Spark 1.2 尚未开源,扎克伯格只是「预告」未来会开放其权重。如果这一步真的落地,才称得上是美国厂商首次把旗舰级闭源模型转为开源,目前仍需持续关注后续进展。
API 分时涨价、2.4T 级权重下载、后训练配方对照,都会撞上同一类摩擦:共享开发机状态脏、本机磁盘装不下、又不能把对照实验和日常编译混在一台长期开机的电脑上。需要一台干净、可支配、真实 Apple Silicon 硬件来跑量化模型或 Agent 工作流时,KVMFLUX 按天起租的云端 Mac mini 通常更省事——独享物理机、Root、SSH + VNC,租期可对照 按天 / 周 / 月 / 季哪个更划算。