DeepSeek涨价1100%之后,开发者账单到底会贵多少

卡住选型的往往不是「贵了」三个字,而是口径对不上:

  • headline 不是整张账单:媒体分别写「涨11倍」「涨超1100%」「涨350%」,都对,但对应的是缓存命中输入、输出、缓存未命中输入等不同计费项。
  • 高峰与空闲差一倍:北京时间 9–12 点、14–18 点是高峰;错峰调度被写进涨价公告,本质是算力不够用时的显性化。
  • 「官方最便宜」第一次被打破:高峰时段,DeepSeek 官方 API 已反超部分第三方转售(如 GMI Cloud、Novita 目前报价仍低于官方高峰价)。
  • 开源不等于免费商用:Qwen3.8-Max 权重可下,但许可证不是 Apache 2.0;年营收门槛一过,就要单独谈授权。

此前我们写过 DeepSeek V4 Flash 正式版的跑分与低价结构,以及 Qwen3.8-Max 发布时「下周开源」的预告。本篇不再复述单品发版,只盯 8 月中旬这三记同步变阵。

8月中旬中国大模型发生了什么:一张时间线

把镜头拉到 7 月中旬到 8 月 17 日 0 点(北京时间),三家中国实验室和同期的美国动作叠在同一窗口:

日期 事件
7月16日 月之暗面 Kimi K3(2.8万亿参数)开源,此前已引发美方安全关注
8月2日–3日 阿里 Qwen3.8-Max 先预告、后上线云端 API
8月10日 Meta 发布开源模型 Muse Glimmer(300亿参数,Apache 2.0),预告旗舰 Muse Spark 1.2 权重「即将开源」
8月12日 阿里正式在 ModelScope / Hugging Face 放出 Qwen3.8-2.4T-A95B 开源权重;同日 xAI 发布 Grok 4.6
8月13日 DeepSeek-V4-Pro 正式版上线,同步公告 8 月 17 日起 API 涨价;谷歌发布降价的 Gemini 3.7 Flash
8月14日 智谱发布 GLM-5.3,沿用 GLM-5.2 的 7430 亿参数基座
8月17日 0点(北京时间) DeepSeek 新定价正式生效

再往前两周:7 月 30 日 OpenAI 把最便宜档 GPT-5.6 Luna 降价 80%,8 月 6–7 日又把 Luna 设为免费用户默认模型并开放无限文本对话。中国厂商在涨价和开源上做加法的同一时间,美国厂商在免费和降价上做加法——同一场定价博弈的两个侧面。Luna 那一轮降价,可对照 GPT-5.6 价格下调拆解

DeepSeek / Qwen / GLM 核心数据对照,涨价后谁还便宜

DeepSeek 新价自 8 月 17 日 0 点起,北京时间 9–12 点、14–18 点为高峰。下表单位为每百万 tokens,人民币。

计费项 涨价前 空闲(新) 高峰(新) 高峰涨幅
V4-Flash 缓存命中输入 ¥0.02 ¥0.05 ¥0.10 约400%
V4-Flash 缓存未命中输入 ¥1.0 ¥1.5 ¥3.0 200%
V4-Flash 输出 ¥2.0 ¥4.5 ¥9.0 350%
V4-Pro 缓存命中输入 ¥0.025 ¥0.15 ¥0.30 约1100%
V4-Pro 缓存未命中输入 ¥3.0 ¥4.5 ¥9.0 200%
V4-Pro 输出 ¥6.0 ¥13.5 ¥27.0 350%

缓存命中场景涨幅最大(最高约 12 倍 / 1100%+),但绝对金额仍很小;对重度调用者影响更大的是输出价格(350%)和缓存未命中输入。有分析测算:约 8400 万 tokens/月、多在空闲、一半缓存命中的重度负载,账单更接近约 1.8 倍,而不是标题里的 11 倍。

Qwen3.8-2.4T-A95B(Qwen3.8-Max 开源权重)关键规格:

项目 数据
参数规模 2.4万亿总参数,950亿激活(MoE,512个专家,10路由+1共享)
上下文窗口 开源权重原生 26.2 万 tokens,可扩展至约 101 万;云端 Max 版默认 100 万 tokens
发布节奏 8月2日预告 → 8月3日 API 上线 → 8月12日开源权重
API 定价(国际站) 输入 $2 / M tokens,输出 $6 / M tokens
许可证 非 Apache 2.0,自定义「Qwen3.8-Max License」
意义 阿里历史上首次把 Max 级旗舰开源;此前 Qwen3.5 / 3.6 / 3.7 Max 均为闭源 API

GLM-5.3 与 GLM-5.2 同基座、纯靠后训练。以下为智谱官方自测,尚无独立第三方复测:

基准测试 GLM-5.2 GLM-5.3 变化
Terminal-Bench 3.0 4.6% 28.3% +23.7
DeepSWE v1.1 46.2% 66.9% +20.7
Agents' Last Exam(CLI) 23.8% 28.5% +4.7
CyberGym 77.2% 84.5% +7.3
AutomationBench 26.2% 48.2% +22.0

GLM-5.3 在 Terminal-Bench 3.0 上仍落后 GPT-5.6 Sol(34.6%)和 Claude Fable 5(33.7%),是「开源模型第一梯队」,不是全面登顶。

横向比价(输入 / 输出均为每百万 tokens;人民币兑美元按约 ¥7.15/$1 估算,仅供参考):

模型 输入 输出 开源程度
DeepSeek V4-Pro(高峰) ¥9.0(约 $1.26) ¥27.0(约 $3.78) 权重未开源
DeepSeek V4-Pro(空闲) ¥4.5(约 $0.63) ¥13.5(约 $1.89) 权重未开源
Qwen3.8-Max(国际站) $2 $6 开源(自定义许可证)
OpenAI GPT-5.6 Luna $0.20 $1.20 闭源
Claude Opus 5(据阿里披露的倍数关系推算) 约 $5 约 $25 闭源

涨价后 DeepSeek V4-Pro 空闲价仍明显低于 Claude Opus 5,但已经不再是全场最低:阿里国际站 Qwen3.8-Max、OpenAI Luna 都比 DeepSeek 空闲价更便宜。「国产 = 最便宜」的等式正在瓦解,价格竞争进入分层阶段。

三种打法:分时涨价、自定义开源、后训练配方分别在赌什么

DeepSeek:从贴地价到分时定价,本质是算力紧张的显性化。最容易被误读为「跟涨」,细看结构更像一次算力账单透明化。此前不分时段的统一低价,用低价换用户规模,再靠缓存命中和错峰摊薄成本;调用量指数级增长、GPU 产能跟不上时,这套模式撑不住。公告里「鼓励更灵活的工作负载调度」,翻译过来就是:高峰算力已经不够用,请你自己错峰。

阿里:开源权重圈住生态,自定义许可证圈住收入。2.4 万亿参数可公开下载,同时配一份不同于以往 Apache 2.0 的许可证——年营收超 5000 万美元的「模型即服务」或「AI 工作助手」业务,必须单独谈商业授权;月活超 1 亿或月收入超 2000 万美元的产品,必须在界面上显著展示模型名称。用开源换开发者生态和海外口碑,但在真正能产生现金流的大客户身上保留议价权。这和 Meta Muse Glimmer(完全 Apache 2.0、无附加条款)不是一个量级的「开源」。

需要澄清一个流传较广的谣言:网上一度传阿里许可证禁止美国、欧盟、英国、韩国用户下载,这是不实信息,官方许可证原文并无任何地域限制条款。

智谱 GLM-5.3:不换基座,只换后训练配方。基座与 GLM-5.2 完全相同(7430 亿参数),没有重新预训练,仅靠扩大强化学习环境规模,就把 Terminal-Bench 3.0 从 4.6% 拉到 28.3%,接近 6 倍。当预训练 Scaling Law 边际收益放缓,「后训练强化学习规模化」正在成为新杠杆,门槛显著低于重训一个千亿级基座,中小厂商也有机会靠「精装修」追上头部。

核对官方价表与许可证:开发者六步清单

发版信息可能随时间变化,请以官方链接为准。下面六步用来把标题数字落成你自己的账单和合规结论。

  1. 打开官方价表,记下高峰 / 空闲与缓存档:不要只转述媒体百分比。DeepSeek 价表按 cache hit / miss 和 output 分列,先抄下你实际会打到的那几档。
  2. 把调用时区映射到北京高峰:高峰是北京时间 9–12、14–18。用本机时区算一次,避免「我这边半夜」其实落在对方高峰。
  3. 用最近一周日志估缓存命中率:固定系统提示很长的应用,对 cache-hit 涨幅最敏感;命中率低时,输出 350% 和 miss 输入 200% 才是账单主体。
  4. 对照 Qwen 许可证门槛,而不是只看「开源」标签:个人与内部使用基本不受影响;MaaS / AI 工作助手且过去 12 个月该业务收入超 5000 万美元,须单独申请商业授权。
  5. 把 GLM-5.3 分数记成「官方自测、尚未第三方复测」:Terminal-Bench 3.0 仍落后 GPT-5.6 Sol 与 Claude Fable 5,选型时不要写成全面登顶。
  6. 本地下载权重做对照时,用干净可 wipe 的环境:2.4T 级权重不是笔记本能轻松吃下的;若只要在 Apple Silicon 上跑量化小模型、对照 Agent 工作流,用独享、可 root、测完能清空的机器,比共享开发机更干净。
local shell · 核对是否落在北京高峰
TZ=Asia/Shanghai date '+%H:%M %Z'
python3 -c "from datetime import datetime; from zoneinfo import ZoneInfo
h=datetime.now(ZoneInfo('Asia/Shanghai')).hour
print('peak' if (9<=h<12 or 14<=h<18) else 'off-peak')"

第三方转售价可能暂时低于官方高峰价,但额度、合规与断供风险不同;比价时把「谁在供货」和「价签」放在同一行看。

哪些说法还没被独立验证,以及可核对来源

  • 涨价幅度口径混乱:1100% 对应高峰时段缓存命中输入(起步最接近免费的那一档);输出涨 350%,才是多数真实账单的主体。
  • 「震悟 M890 国产芯片」服务:多家中文财经媒体称 Qwen3.8-Max 部分推理跑在阿里自研震悟 M890 和「盘古 AL128」超节点上,目前仅见于中文媒体转述,未见阿里官方独立技术文档或第三方基准确认,属未经独立验证
  • GLM-5.3「发现 Cursor 严重漏洞」:来自 VentureBeat 报道及智谱方面透露,具体漏洞细节未公开,真实性与影响范围有待第三方安全机构确认,属厂商单方面披露
  • 中国商务部可能酝酿反制出口管制:部分报道提及,目前未见官方正式确认,属媒体推测 / 传闻,仅供背景参考。

国内财经媒体普遍将过去一个月「一周三更」解读为国产开源密集发布、倒逼全球重新定价。地缘一层:Kimi K3 开源已引发美方安全审查关注,阿里在这个窗口放出 2.4 万亿旗舰,被部分分析读成「在潜在监管收紧前抢先巩固国际影响力」——带推测性质,但是理解开源潮时机时不可忽略的背景。

官方源(价格、权重、基准以页面当时文本为准):

DeepSeek API Docs — Models & Pricing

Hugging Face — Qwen/Qwen3.8-2.4T-A95B

Z.ai — GLM-5.3: Frontier Coding with Emergent Cyber Capabilities

第三方报道与交叉核对:

CIO — DeepSeek raises some V4 prices by more than 10x

NVIDIA Technical Blog — Serve Qwen3.8-2.4T-A95B

Z.ai Docs — GLM-5.3

常见问题

DeepSeek这次涨价之后,是不是意味着以后用起来更贵了?

要分场景看。如果你的调用大多落在空闲时段(非北京时间 9–12 点、14–18 点),且是缓存命中率较高的重度用户,实际涨幅会明显低于表面的「350%」「1100%」这类 headline 数字(有分析测算重度用户实际账单涨幅约为 1.8 倍左右);但如果集中在高峰时段调用、且缓存命中率低,涨幅会接近甚至达到 headline 数字。

阿里开源的Qwen3.8-Max,个人开发者能免费商用吗?

个人开发者和内部使用基本不受影响。但如果你的业务是「模型即服务」或「AI 工作助手」类产品,且过去 12 个月内该业务累计收入超过 5000 万美元,需要单独向阿里申请商业授权;如果产品月活超 1 亿或月收入超 2000 万美元,需要在界面上显著标注模型名称。

GLM-5.3和GLM-5.2是同一个模型吗?为什么突然变强这么多?

底层基座模型确实完全相同(7430 亿参数),智谱没有重新训练。分数大幅提升的原因是后训练阶段大幅扩大了强化学习环境的规模,这说明当前阶段「后训练规模化」本身就是一个独立、有效的性能杠杆,不一定需要重新预训练一个更大的基座。

网传阿里的Qwen3.8-Max许可证禁止美国、欧盟用户下载,是真的吗?

不是真的。这是网络上流传的不实信息,官方许可证原文中没有任何地域限制条款,主要限制是针对超过特定营收规模的商业化服务,与用户所在地区无关。

Meta这次开源Muse Glimmer,是不是意味着Llama时代的开源精神又回来了?

目前还只能算「部分回归」。Muse Glimmer 本身只是一个 300 亿参数的蒸馏小模型,Meta 真正的旗舰闭源模型 Muse Spark 1.2 尚未开源,扎克伯格只是「预告」未来会开放其权重。如果这一步真的落地,才称得上是美国厂商首次把旗舰级闭源模型转为开源,目前仍需持续关注后续进展。

API 分时涨价、2.4T 级权重下载、后训练配方对照,都会撞上同一类摩擦:共享开发机状态脏、本机磁盘装不下、又不能把对照实验和日常编译混在一台长期开机的电脑上。需要一台干净、可支配、真实 Apple Silicon 硬件来跑量化模型或 Agent 工作流时,KVMFLUX 按天起租的云端 Mac mini 通常更省事——独享物理机、Root、SSH + VNC,租期可对照 按天 / 周 / 月 / 季哪个更划算

错峰对照开源权重,按天租一台真 Mac

独享物理 Mac mini M4,root + SSH,本地跑量化模型或 Agent 工作流,不必和日常开发机抢磁盘、抢状态。

Mac Mini M4 · 16GB / 256GB
日租$19.3 /天
周租$52.2 /周
月租$96.7 /月
季租$263 /季