DeepSeekの1100%値上げ後、請求は実際いくら上がるか

選定を止めるのは「高くなった」という言葉ではなく、数字の定義が揃っていないことです。

  • 見出しは請求書全体ではありません。「11倍」「1100%超」「350%」はいずれも正確ですが、対応するのはキャッシュヒット入力、出力、キャッシュミス入力など別の課金項目です。
  • ピークとオフピークで約2倍の差があります。北京時間9–12時、14–18時がピークです。値上げ告知に「柔軟なワークロードスケジューリング」と書かれたのは、計算資源不足の可視化です。
  • 「公式が最安」は初めて崩れました。ピーク帯ではDeepSeek公式APIが一部リセラー(GMI Cloud、Novitaなど、現時点の提示は公式ピークより低い)を上回っています。
  • オープンウェイトは無料商用を意味しません。Qwen3.8-Maxはダウンロードできますが、ライセンスはApache 2.0ではありません。売上閾値を超えると別途交渉が必要です。

これまでに DeepSeek V4 Flash正式版のベンチと旧低価格構造Qwen3.8-Max発表時の「来週オープン」予告 を書いています。本稿は単品リリースの再掲ではなく、8月中旬の3ラボ同時転換に絞ります。

8月中旬に中国の大規模モデルで何が起きたか:タイムライン

7月中旬から8月17日0時(北京時間)まで、3つの中国ラボと同時期の米国側の動きが同じ窓に重なります。

日付 出来事
7月16日 Moonshot AIがKimi K3(2.8Tパラメータ)をオープンウェイト化。米側の安全保障上の関心を既に招いていました
8月2日–3日 AlibabaがQwen3.8-Maxを予告し、クラウドAPIを公開
8月10日 MetaがオープンモデルMuse Glimmer(30B、Apache 2.0)を公開し、旗艦Muse Spark 1.2のウェイト「近日公開」を予告
8月12日 AlibabaがModelScope / Hugging FaceでQwen3.8-2.4T-A95Bのオープンウェイトを公開。同日xAIがGrok 4.6を発表
8月13日 DeepSeek-V4-ProがGA。8月17日からのAPI値上げを同時告知。Googleは値下げしたGemini 3.7 Flashを発表
8月14日 ZhipuがGLM-5.3を発表。GLM-5.2の7430億パラメータ基盤を踏襲
8月17日 0時(北京時間) DeepSeekの新料金が発効

さらに2週間遡ると、7月30日にOpenAIは最安帯GPT-5.6 Lunaを80%値下げし、8月6–7日にはLunaを無料利用者のデフォルトにし、無制限のテキスト対話を開放しました。中国側が値上げとオープン化で加算する同じ時間帯に、米国側は無料化と値下げで加算しています。同じ価格ゲームの二つの面です。Lunaの値下げは GPT-5.6価格改定の解説 で整理しています。

DeepSeek / Qwen / GLMの核心データ:値上げ後も最安か

DeepSeekの新料金は8月17日0時から適用され、北京時間9–12時、14–18時がピークです。下表の単位は100万トークンあたり、人民元です。

課金項目 値上げ前 オフピーク(新) ピーク(新) ピーク上昇率
V4-Flash キャッシュヒット入力 ¥0.02 ¥0.05 ¥0.10 約400%
V4-Flash キャッシュミス入力 ¥1.0 ¥1.5 ¥3.0 200%
V4-Flash 出力 ¥2.0 ¥4.5 ¥9.0 350%
V4-Pro キャッシュヒット入力 ¥0.025 ¥0.15 ¥0.30 約1100%
V4-Pro キャッシュミス入力 ¥3.0 ¥4.5 ¥9.0 200%
V4-Pro 出力 ¥6.0 ¥13.5 ¥27.0 350%

キャッシュヒットの上昇率が最大です(最大約12倍 / 1100%超)が、絶対額は依然として小さいです。ヘビー利用者への影響が大きいのは出力(350%)とキャッシュミス入力です。分析では、約84Mトークン/月、主にオフピーク、半分がキャッシュヒットのヘビー負荷では、請求増は約1.8倍に近く、見出しの11倍ではありません。

Qwen3.8-2.4T-A95B(Qwen3.8-Maxオープンウェイト)の主要仕様です。

項目 内容
パラメータ規模 総パラメータ2.4T、活性95B(MoE、512エキスパート、10ルーティング+1共有)
コンテキスト窓 オープンウェイトはネイティブ262144トークン、約1.01Mまで拡張可能。クラウドMax版のデフォルトは100万トークン
公開リズム 8月2日予告 → 8月3日API公開 → 8月12日オープンウェイト
API料金(国際サイト) 入力 $2 / Mトークン、出力 $6 / Mトークン
ライセンス Apache 2.0ではなく、独自のQwen3.8-Max License
意味 AlibabaがMax級旗艦をオープンウェイト化した初事例。Qwen3.5 / 3.6 / 3.7 MaxはAPIのみでした

GLM-5.3はGLM-5.2と同一基盤で、事後学習のみです。以下はZhipu公式の自己測定であり、第三者による再測定はまだありません。

ベンチマーク GLM-5.2 GLM-5.3 変化
Terminal-Bench 3.0 4.6% 28.3% +23.7
DeepSWE v1.1 46.2% 66.9% +20.7
Agents' Last Exam(CLI) 23.8% 28.5% +4.7
CyberGym 77.2% 84.5% +7.3
AutomationBench 26.2% 48.2% +22.0

GLM-5.3はTerminal-Bench 3.0でGPT-5.6 Sol(34.6%)とClaude Fable 5(33.7%)にまだ遅れています。オープンモデルの第一集団であり、全面首位ではありません。

横断比較(入力/出力はいずれも100万トークンあたり。人民元対ドルは約¥7.15/$1の概算です):

モデル 入力 出力 オープン度
DeepSeek V4-Pro(ピーク) ¥9.0(約 $1.26) ¥27.0(約 $3.78) ウェイト非公開
DeepSeek V4-Pro(オフピーク) ¥4.5(約 $0.63) ¥13.5(約 $1.89) ウェイト非公開
Qwen3.8-Max(国際サイト) $2 $6 オープン(独自ライセンス)
OpenAI GPT-5.6 Luna $0.20 $1.20 クローズド
Claude Opus 5(Alibaba開示の倍率から推計) 約 $5 約 $25 クローズド

値上げ後もDeepSeek V4-ProのオフピークはClaude Opus 5より明らかに安いですが、最安ではなくなりました。Alibaba国際サイトのQwen3.8-MaxとOpenAI Lunaは、いずれもDeepSeekオフピークより安いです。「中国製=最安」という等式は崩れつつあり、価格競争は階層化しています。

三つの賭け:時間帯別値上げ、独自オープン、事後学習レシピ

DeepSeek:一律安値から時間帯別料金へ。本質は計算資源逼迫の可視化です。「追随値上げ」と誤読されやすいですが、構造は計算資源の請求透明化に近いです。時間帯を分けない一律安値は、安さで規模を取り、キャッシュヒットとオフピークでコストを薄めていました。呼び出しが指数増し、GPU供給が追いつかないと、この型は持ちません。告知の「より柔軟なワークロードスケジューリング」は、ピーク計算資源が足りないのでずらしてください、という意味です。

Alibaba:オープンウェイトで生態系を囲い、独自ライセンスで収入を囲います。2.4Tパラメータは公開ダウンロードできますが、従来のApache 2.0とは異なるライセンスが付きます。直近12か月で売上が5000万ドルを超えるModel-as-a-ServiceまたはAIワークアシスタント事業は、別途商用ライセンス交渉が必要です。月間アクティブ1億超、または月間売上2000万ドル超の製品は、画面上でモデル名を目立つ形で表示しなければなりません。オープンで開発者生態系と海外評価を取り、キャッシュを生む大口では交渉権を残す設計です。MetaのMuse Glimmer(完全なApache 2.0、付加条項なし)とは「オープン」の尺度が違います。

広く流れた噂を訂正します。Alibabaのライセンスが米国、EU、英国、韓国からのダウンロードを禁じているという話は誤情報です。公開本文に地域制限条項はありません。

Zhipu GLM-5.3:基盤は変えず、事後学習レシピだけを変えます。基盤はGLM-5.2と完全同一(7430億パラメータ)で、再事前学習はありません。強化学習環境の規模拡大だけで、Terminal-Bench 3.0を4.6%から28.3%へ、約6倍に引き上げました。事前学習のScaling Lawの限界収益が鈍るなか、「事後学習の強化学習規模化」が新しいレバーになり、千億級基盤の再学習より敷居が低く、中小ベンダーも「仕上げ」で先頭に近づける余地があります。

公式料金表とライセンスを照合する:開発者6ステップ

公開情報は変わります。公式リンクを正とします。次の6ステップで、見出し数字を自社の請求とコンプライアンス結論に落とします。

  1. 公式料金表を開き、ピーク/オフピークとキャッシュ段を控えます。メディアの百分率だけを転記しないでください。DeepSeekはcache hit / missとoutputを分けています。実際に当たる行だけを写します。
  2. 自タイムゾーンを北京ピークに写像します。ピークは北京時間9–12、14–18です。現地の深夜が相手のピークになることがあります。
  3. 直近1週間のログでキャッシュヒット率を見積もります。固定システムプロンプトが長いアプリはcache-hit上昇に敏感です。ヒット率が低いと、出力350%とミス入力200%が請求の本体になります。
  4. 「オープン」ラベルではなくQwenライセンスの閾値を読みます。個人と社内利用はほぼ影響しません。MaaS / AIワークアシスタントで直近12か月の当該事業売上が5000万ドル超なら、別途商用ライセンスが必要です。
  5. GLM-5.3の得点は「公式自己測定、第三者再測定なし」と記録します。Terminal-Bench 3.0はGPT-5.6 SolとClaude Fable 5に遅れています。全面首位とは書かないでください。
  6. ウェイトをローカルにダウンロードして比較するなら、wipe可能な環境を使います。2.4T級はノートPCでは扱えません。Apple Siliconで量子化小モデルやAgentワークフローを比較するなら、専有・root可能・測定後に空にできるマシンの方が、共有開発機より清潔です。
local shell · 北京ピーク判定
TZ=Asia/Shanghai date '+%H:%M %Z'
python3 -c "from datetime import datetime; from zoneinfo import ZoneInfo
h=datetime.now(ZoneInfo('Asia/Shanghai')).hour
print('peak' if (9<=h<12 or 14<=h<18) else 'off-peak')"

リセラー提示はしばらく公式ピークより安く見えることがあります。供給者、枠、供給停止リスクを値札と同じ行で見てください。

未検証の主張と、照合できる出典

  • 値上げ率の定義が乱れています。1100%はピーク帯のキャッシュヒット入力(最も無料に近かった段)です。大半の実請求の本体は、出力の350%です。
  • 「Zhenwu M890国産チップ」上での推論:複数の中国語経済メディアは、Qwen3.8-Maxの一部推論がAlibaba自社Zhenwu M890と「Pangu AL128」スーパーノード上だと伝えています。Alibaba公式の独立技術文書や第三者ベンチでの確認はなく、独立検証されていません
  • GLM-5.3が「Cursorの重大脆弱性を発見」:VentureBeat報道とZhipu側の開示です。技術詳細は非公開で、真偽と影響範囲は第三者セキュリティ機関の確認待ちです。ベンダー一方の開示です。
  • 中国商務部が報復的輸出規制を検討しているとの報道:一部報道にあります。現時点で公式確認はなく、推測/伝聞です。背景参考に限ります。

中国の経済メディアは直近1か月を「週3更新」と呼び、国産オープンの密集公開が世界の再価格設定を迫ったと読むことが多いです。地政学の層もあります。Kimi K3のオープン化は既に米側の安全保障審査の関心を招いており、Alibabaがこの窓で2.4T旗艦を出したことを「規制引き締め前に国際的影響力を固める」と読む分析もあります。推測を含みますが、オープン化のタイミングを理解する背景としては無視できません。

公式ソース(価格、ウェイト、ベンチは掲載時点の本文を正とします):

DeepSeek API Docs — Models & Pricing

Hugging Face — Qwen/Qwen3.8-2.4T-A95B

Z.ai — GLM-5.3: Frontier Coding with Emergent Cyber Capabilities

第三者報道と交差確認:

CIO — DeepSeek raises some V4 prices by more than 10x

NVIDIA Technical Blog — Serve Qwen3.8-2.4T-A95B

Z.ai Docs — GLM-5.3

よくある質問

DeepSeekの値上げ後、請求は必ず大幅に高くなりますか?

用途によります。呼び出しの大半がオフピーク(北京時間9–12時、14–18時以外)で、キャッシュヒット率が高いヘビーワークロードなら、表面の「350%」「1100%」より実効上昇は小さくなります(分析ではヘビー利用の請求増は約1.8倍)。ピークに集中しヒット率が低い場合は、見出しに近づきます。

AlibabaのQwen3.8-Maxオープンウェイトは、個人開発者が商用で無料利用できますか?

個人開発と社内利用はほぼ影響を受けません。ただし事業がModel-as-a-ServiceまたはAIワークアシスタントで、直近12か月の当該事業売上が5000万ドルを超える場合は、Alibabaとの別途商用ライセンスが必要です。月間アクティブ1億超、または月間売上2000万ドル超の製品は、画面上でモデル名を目立つ形で表示する必要があります。

GLM-5.3とGLM-5.2は同じモデルですか。なぜ急に強くなったのですか?

基盤モデルは完全に同一です(7430億パラメータ)。Zhipuは再事前学習していません。得点上昇は事後学習で強化学習環境を大幅に拡充したためであり、現段階では「事後学習の規模化」自体が独立した性能レバーです。より大きな基盤を再学習する必要はありません。

Qwen3.8-Maxのライセンスは米国・EUからのダウンロードを禁じていますか?

いいえ。ネット上で流れた誤情報です。公開ライセンス本文に地域制限はありません。制限は一定売上規模を超える商用サービス向けであり、所在地とは無関係です。

MetaのMuse Glimmer公開は、Llama時代のオープン精神の復活ですか?

現時点では「部分的な回帰」にすぎません。Muse Glimmerは300億パラメータの蒸留モデルであり、本命のクローズド旗艦Muse Spark 1.2は未公開です。Zuckerberg氏はウェイト公開を「予告」しただけです。それが実現して初めて、米国ベンダーが旗艦級クローズドモデルをオープン化したと言えます。現時点では意向であり、確定事実ではありません。

APIの時間帯別値上げ、2.4T級ウェイトのダウンロード、事後学習レシピの比較は、同じ摩擦にぶつかります。共有開発機は状態が汚れ、ローカルディスクは足りず、対照実験と日常コンパイルを長時間稼働の1台に混ぜるべきではありません。量子化モデルやAgentワークフローを走らせるために、清潔で専有でき、実機のApple Siliconが必要なときは、KVMFLUXの日額クラウドMac miniの方が通常は手間が少ないです。物理機の専有、Root、SSH + VNC。期間の選び方は 日/週/月/四半期のどちらが得か を参照してください。

オフピークでオープンウェイトを比較するなら、日額の実機Mac

専有の物理Mac mini M4、root + SSH。量子化モデルやAgentワークフローをローカル実行し、日常の開発機とディスクや状態を奪い合いません。

Mac Mini M4 · 16GB / 256GB
日額$19.3 /日
週額$52.2 /週
月額$96.7 /月
四半期$263 /四半期