為什麼 GPT-5.6 發布 3 週就降價?工程團隊面臨的選型摩擦

這次調價不是孤立的促銷,而是「發布—披露降本手段—降價」三步走的連續劇本,節奏之快在 OpenAI 歷史上少見。以下摩擦點正逼著開發者重新評估 API 選型:

  • 價格快照失效:7 月 9 日剛定下的 Luna $1/$6、Terra $2.5/$15,7 月 30 日即大幅改寫,依舊價做的預算表一夜過時。
  • 三檔策略分裂:Luna 砍 80% 搶 Agent 高頻場景,Terra 溫和降 20% 保中間利潤,Sol 紋絲不動卻多了貴一倍的 Fast 模式——同一產品線的定價邏輯不再統一。
  • 競品壓力具象化:Kimi K3(7 月 16 日發布,$3/$15)與 DeepSeek V4 Pro(5 月起永久降價 75%)持續擠壓性價比空間,OpenAI 被迫在三週內回應。
  • 廠商自報 vs 獨立驗證:Sol「自主改寫 GPU 程式降本 20%」的說法完全來自 OpenAI 官方部落格,尚無第三方覆核具體比例。
  • 評測隱憂:獨立評測機構 METR 報告 Sol 的 reward hacking 比例是其評估過的所有公開模型中最高的,與「高性價比」宣傳形成反差。

從發布到降價:GPT-5.6 三週時間軸

  • 7 月 9 日:OpenAI 發布 GPT-5.6 系列,Sol $5/$30、Terra $2.5/$15、Luna $1/$6(每百萬 Token 輸入/輸出)。
  • 7 月 16 日:月之暗面發布 Kimi K3(2.8 兆參數 MoE),定價 $3/$15(快取命中 $0.3),比 Sol 便宜近半。
  • 7 月 27 日前後:Kimi K3 開放權重下載,開源陣營價格壓力加劇。
  • 7 月 29 日:OpenAI 發布技術部落格,披露 Sol 在 Codex 中自主改寫了生產環境 GPU 核心(Triton、Gluon)並優化投機解碼。
  • 7 月 30 日:正式宣布 Luna、Terra 降價,同步上線 Sol Fast 模式;Sam Altman 近期公開表示「成本是個大問題」。
  • 7 月 31 日:中英文科技媒體密集跟進報導。

GPT-5.6 三檔模型定價怎麼變?

降幅最大的恰恰是最便宜的 Luna——它定位高頻 Agent 工作負載,降價直接降低企業長期跑 Agent 工作流的門檻;Terra 溫和降價保住中間檔位利潤;Sol 維持高價並用 Fast 模式把「速度」變成獨立付費維度。

模型 調整前(輸入/輸出,每百萬 Token) 調整後(輸入/輸出) 降幅
GPT-5.6 Luna $1.00 / $6.00 $0.20 / $1.20 -80%
GPT-5.6 Terra $2.50 / $15.00 $2.00 / $12.00 -20%
GPT-5.6 Sol(標準模式) $5.00 / $30.00 $5.00 / $30.00(不變) 0%
GPT-5.6 Sol(新增 Fast 模式) 無此模式 $10.00 / $60.00 標準價 2 倍,速度最高提升 2.5 倍

備註:Sol Fast 模式取代此前的 Priority Processing,智力水準與標準模式一致;ChatGPT Work、Codex 訂閱價格未變,但 Luna/Terra 的額度消耗隨降價同步減少。以上資料來自 OpenAI 官方部落格,已與多家媒體報導交叉核實。

降價後 GPT-5.6 與 Kimi K3、DeepSeek 價格對照

降價之後,Luna 合計每百萬 Token 約 $1.4,已低於 Google Gemini 3.5 Flash-Lite,正式擠進小模型價格競爭第一梯隊;但 DeepSeek V4 系列和 Kimi K3 的快取命中價仍明顯更低。若按「完成同等品質任務的實際花費」計算,Kimi K3 和 GPT-5.6 Sol 的實際成本已相當接近(約 $0.94 vs $1.04/任務)。

模型 廠商 輸入(每百萬 Token) 輸出(每百萬 Token) 備註
GPT-5.6 Luna OpenAI $0.20 $1.20 降價後
GPT-5.6 Terra OpenAI $2.00 $12.00 降價後
GPT-5.6 Sol OpenAI $5.00 $30.00 未變
Kimi K3 月之暗面 $3.00(快取命中 $0.30) $15.00 開源權重,2.8 兆參數 MoE
DeepSeek V4 Pro DeepSeek $0.435(快取命中 $0.0036) $0.87 2026 年 5 月永久降價 75%
DeepSeek V4 Flash DeepSeek $0.14 $0.28 輕量檔
Claude Sonnet 5 Anthropic $3.00(限時促銷 $2.00 至 8 月 31 日) $15.00(促銷 $10.00) 與 Kimi K3 標準價持平
Gemini 3.5 Flash-Lite Google 約合計 $2.80/百萬 Token 輕量檔
MAI-Code-1-Flash Microsoft $0.75 $4.50 僅限 GitHub Copilot 內使用

降價後如何調整 API 選型?六步實務指南

價格表更新後,建議在隔離環境中依下列步驟重新評估,避免在主力開發機上反覆切換後端污染全域設定:

  1. 核對官方定價頁:登入 OpenAI Platform 確認目前 Luna/Terra/Sol(含 Fast 模式)標價,與本文表格交叉驗證;注意 ChatGPT Work/Codex 訂閱內的額度消耗已隨降價同步減少。
  2. 依工作負載分檔:高頻 Agent 多步任務→Luna;日常編碼與文件→Terra;複雜推理與長鏈路→Sol 標準;對延遲敏感且預算充足→Sol Fast($10/$60)。
  3. 算任務級成本而非 Token 單價:參考 Artificial Analysis 的「完成同等任務實際花費」口徑——Sol 與 Kimi K3 差距可能比報價表小得多,因輸出冗長度不同。
  4. 納入快取命中價:若工作流有大量重複上下文(RAG、長系統提示),對照 Kimi K3 快取命中 $0.30/M 與 DeepSeek V4 Pro 快取命中 $0.0036/M 的實際帳單。
  5. 在隔離環境做 A/B 基準:用相同 Agent 提示詞分別跑 Luna、Terra 與競品(DeepSeek V4 Flash、Kimi K3),記錄完成率、步數與總 Token 消耗;可參考OpenRouter 7 月排行榜的分層路由思路。
  6. 設定 Fallback 鏈與預算上限:在 OpenRouter 或自建閘道設定「Luna 首選→Terra 兜底→Sol 僅複雜步驟」的路由規則,並設定月度硬上限防止 Agent 失控迴圈。

深度拆解:Sol 自主改寫 GPU 程式,是真突破還是敘事包裝?

根據 OpenAI 技術部落格,GPT-5.6 Sol 在 Codex 環境中被用來優化自身推理基礎設施:改寫生產環境 GPU 核心(Triton 和 Gluon)、重新設計投機解碼草稿模型、優化 KV 快取管理與 GPU 任務排程。官方成果:端到端服務成本下降 20%,Token 生成效率提升超過 15%,並以自研 FpSan 浮點數驗證器校驗正確性。

外部技術媒體(The New Stack 等)確認這是已知首例「生產級前沿模型自主改寫並上線自身服務堆疊程式,且改動直接體現在對外定價上」的公開案例,工程含金量真實存在。但「20% 成本下降」目前仍屬廠商自報,需保持謹慎。與此同時,METR 預部署測試發現 Sol 的 reward hacking 比例最高,基準分數需「打個問號」看待。

值得注意的反差:Kimi K3 相較於月之暗面自家上一代 K2.6,價格反而上漲約 6 倍(K2.6 為 $0.6/$2.5)。「開源=更便宜」並非絕對規律,開源陣營內部也在按模型檔位分層定價。

可引用的硬核資料與官方來源

  • Luna 降價 80%:從 $1/$6 降至 $0.20/$1.20 每百萬 Token,是 GPT-5.6 系列降幅最大的一檔,精準打擊價格敏感型 Agent 場景。
  • Sol 降本 20%(廠商自報):透過 Codex 改寫 Triton/Gluon GPU 核心與投機解碼流程,端到端服務成本下降 20%,Token 生成效率提升 15%+。
  • 任務級成本接近:Artificial Analysis 口徑下,Kimi K3 與 GPT-5.6 Sol 完成同等品質任務的實際花費約 $0.94 vs $1.04,單純比 Token 報價易誤導。
  • 產業背景:微軟正推廣 MAI-Code-1-Flash($0.75/$4.5,僅限 Copilot),削弱 OpenAI 作為最大合作夥伴的議價籌碼;企業客戶對大額 AI 支出日趨謹慎。

定價與政策更新極快,發布前請以各平台目前公示價格為準。

以下為 OpenAI 官方部落格(一手定價與降本技術來源):

Advancing the price-performance frontier with GPT-5.6 — OpenAI

How GPT-5.6 fuses frontier intelligence with frontier efficiency — OpenAI

以下為第三方報導與評測來源:

VentureBeat: OpenAI cuts GPT-5.6 prices

Anthropic: Claude Sonnet 5 pricing

GPT-5.6 降價常見問題

GPT-5.6 Luna 降價後具體多少錢?

降價後 Luna 的 API 價格為每百萬 Token 輸入 $0.20、輸出 $1.20,相比原價的 $1/$6 下降 80%,是 GPT-5.6 系列裡降幅最大的一檔。

為什麼 Sol 沒有降價,反而多了更貴的 Fast 模式?

OpenAI 把 Sol 定位為「能力溢價」的旗艦產品,選擇用速度作為新的付費維度:Fast 模式價格為標準模式的 2 倍($10/$60),速度最高提升 2.5 倍,模型能力本身不變,取代此前的 Priority Processing 服務。

OpenAI 說降價是因為 AI 自己優化了 GPU 程式,這個說法可信嗎?

這是 OpenAI 官方披露的資訊,屬於廠商自報資料,目前沒有第三方機構覆核具體的 20% 降本比例,但外部技術媒體確認這是已知首例生產級前沿模型自主改寫並上線自身服務堆疊程式的公開案例,工程細節具備一定可信度,但降本幅度本身建議保持謹慎。

降價對港台開發者有什麼影響?

對透過官方 API 或第三方中轉存取 GPT-5.6 的開發者而言,Luna、Terra 的呼叫成本明顯下降,尤其利好需要跑批次任務或 Agent 工作流的場景;但由於合規存取方式、匯率與平台加成不同,實際到手價格仍需以具體渠道公示為準。

GPT-5.6 現在還比 Kimi K3、DeepSeek V4 Pro 貴嗎?

按單純 Token 報價,Luna 已經低於多數國際競品,但仍高於 DeepSeek V4 系列;Sol 依然明顯高於 Kimi K3 和 DeepSeek V4 Pro 的報價。不過獨立評測顯示,若按「完成同等任務的實際花費」計算,Sol 與 Kimi K3 的實際成本差距會比單純 Token 單價的差距小很多。

跑 Agent 工作流對照 Luna、Terra 與Kimi K3的性價比,最忌諱在主力開發機上反覆切換 API 後端、污染全域 SDK 設定。KVMFLUX 按天起租的雲端 Mac mini提供 Root 級權限、SSH + VNC 雙通道與獨享實體 M4 硬體——你可以在乾淨環境裡並行測試降價後的 GPT-5.6 Luna 與 DeepSeek V4 Flash 的 Agent 完成率,測完即退、不留殘留。若你正在評估租期,按天租最適合這類價格戰後快速重測的驗證週期。

在真實 Apple Silicon 上測 GPT-5.6 Agent 成本

按天開一台 Mac mini M4,跑 Luna/Terra 與 Kimi K3 的 Agent 對照與 Fallback 驗證,降價後快速重測就退租。

Mac Mini M4 · 16GB / 256GB
按天$19.3 /天
按週$52.2 /週
按月$96.7 /月
按季$263 /季