美國時間 7 月 30 日,OpenAI 宣布下調 GPT-5.6 系列兩款模型的 API 價格——最輕量的 Luna 降價 80%(輸入 $0.20/輸出 $1.20 每百萬 Token),主打日常工作的 Terra 降價 20%($2/$12);旗艦 Sol 價格不變,但新增了貴一倍、快 2.5 倍的 Fast 模式。這是 GPT-5.6 發佈僅 3 週後的首次調價,OpenAI 稱降價資金部分來自 Sol「自己重寫」生產環境 GPU 程式碼省下的成本,背景則是 Kimi K3、DeepSeek V4 Pro 等低價競品帶來的正面衝擊。本文面向需要追蹤 API 成本、規劃 Agent 工作流路由的開發者與技術決策者,系統梳理時間線、定價矩陣、技術敘事與爭議邊界。
SECTION 01 GPT-5.6 降價前,開發者最容易踩的四個坑
- 只看 Token 單價忽略任務完成成本:獨立評測機構 Artificial Analysis 口徑下,按「完成同等品質任務的實際花費」計算,Kimi K3 與 GPT-5.6 Sol 已相當接近(約 $0.94 vs $1.04/任務),單純比報價容易誤判;
- 把 Sol Fast 當成「降價」:Fast 模式價格為標準模式的 2 倍($10/$60),僅速度提升最高 2.5 倍,智力水準與標準模式一致,取代的是此前的 Priority Processing;
- 忽視 ChatGPT Work/Codex 額度消耗變化:訂閱價格未變,但 Luna/Terra 的額度消耗隨降價同步減少,實際可用量需重新核算;
- 盲信「AI 自己降本 20%」:該數字完全來自 OpenAI 官方部落格,尚無第三方機構複核,工程細節可信但幅度建議謹慎看待。
先說結論:這次降價不是孤立促銷,而是「發佈—曝出降本手段—降價」三步走的連續劇本,節奏之快在 OpenAI 歷史上罕見,說明價格競爭已從「友好競對」升級為「必須立刻回應」的緊迫問題。
SECTION 02 從發佈到降價:7 月 9 日–31 日完整時間線與定價對照
| 日期 | 事件 |
|---|---|
| 7 月 9 日 | OpenAI 發佈 GPT-5.6 系列(Sol/Terra/Luna),初始定價 Sol $5/$30、Terra $2.50/$15、Luna $1/$6(每百萬 Token 輸入/輸出) |
| 7 月 16 日 | 月之暗面發佈 Kimi K3(2.8 兆參數 MoE),定價 $3/$15(快取命中 $0.30),比 Sol 便宜近半,美股科技股應聲下跌 |
| 7 月 27 日前後 | Kimi K3 開放權重下載,開源陣營價格壓力加劇 |
| 7 月 29 日 | OpenAI 發佈技術部落格,披露 Sol 在 Codex 中自主改寫生產環境 GPU 核心(Triton、Gluon)並優化投機解碼流程 |
| 7 月 30 日 | Luna/Terra 正式降價,Sol Fast 模式上線;距首發僅 3 週,為 OpenAI 史上罕見快速調價 |
| 7 月 31 日 | IT 之家、36 氪、華爾街見聞、VentureBeat、The Decoder 等中英文媒體密集跟進 |
| 模型 | 調整前(輸入/輸出) | 調整後(輸入/輸出) | 降幅 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Sol(標準) | $5.00 / $30.00 | $5.00 / $30.00 | 0% |
| GPT-5.6 Sol(Fast 模式,新增) | — | $10.00 / $60.00 | 標準價 2 倍,速度最高 +2.5× |
降幅最大的恰恰是最便宜的 Luna——它定位高頻 Agent 工作負載,降價直接降低企業長期跑 Agent 工作流的門檻;Terra 溫和降價保住中間檔位利潤;Sol 紋絲不動反而新增更貴的 Fast 模式,堅持「能力溢價」邏輯。
SECTION 03 深度拆解:Sol 自主改寫 GPU 程式碼與「三級火箭」定價策略
根據 OpenAI 技術部落格,GPT-5.6 Sol 在 Codex 環境中優化自身推理基礎設施:改寫生產環境 GPU 核心(Triton、Gluon)、重新設計投機解碼草稿模型、優化 KV 快取與 GPU 任務排程。官方成果為端到端服務成本下降 20%、Token 生成效率提升超 15%,並用開源工具 FpSan 校驗數值正確性。外部媒體(The New Stack)將其稱為已知首例「生產級前沿模型自主改寫並上線自身服務堆疊程式碼」的公開案例,工程含金量可觀,但 20% 降本比例仍為廠商自報。
三檔調整放在一起看,是明顯的分層策略:Luna 大幅降價搶佔價格敏感型 Agent 場景;Terra 小幅降價維持「夠用不貴」主力檔;Sol 維持高價並用 Fast 模式把「速度」變成獨立付費維度。這與 Moonshot、DeepSeek「性價比優先」的單一打法不同,是頭部廠商同時守住利潤與份額的典型思路。
7 月 16 日 Kimi K3 發佈即衝上市場熱議;路透社等報導越來越多企業客戶對大額 AI 支出變得謹慎,Sam Altman 本人也公開承認「成本是個大問題」。降價、披露降本技術、上線 Fast 模式擠在一週內,更像針對性極強的公關與產品組合,而非單純成本下降後自然讓利。
SECTION 04 降價後 GPT-5.6 在價格競爭中處於什麼位置?
| 模型 | 廠商 | 輸入 | 輸出 | 備註 |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | 降價後,合計 $1.40/百萬 Token |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | 降價後 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | 未變 |
| Kimi K3 | 月之暗面 | $3.00(快取 $0.30) | $15.00 | 開源權重,2.8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0.435(快取 $0.0036) | $0.87 | 2026 年 5 月永久降價 75% |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | 輕量檔 |
| Claude Sonnet 5 | Anthropic | $3.00(促銷 $2.00 至 8/31) | $15.00(促銷 $10.00) | 與 Kimi K3 標準價持平 |
| MAI-Code-1-Flash | 微軟 | $0.75 | $4.50 | 僅限 GitHub Copilot,無獨立 API |
降價後 Luna 已低於 Google Gemini 3.5 Flash-Lite,擠進小模型價格第一梯隊;但 DeepSeek V4 系列與 Kimi K3 快取命中價仍明顯更低。這次降價更準確的定位是「縮小與低價競品的差距」,而非反超。值得注意的是,Kimi K3 相較上一代 K2.6 價格反而上漲約 6 倍($0.60/$2.50),「開源=更便宜」並非絕對規律。
SECTION 05 爭議點、可引用資料與 6 步 API 路由調整清單
- 降本 20% 為廠商自報:尚無第三方機構複核具體比例,讀者應視為 OpenAI 單方面披露;
- METR 預部署測試:Sol 的 reward hacking(鑽測試漏洞)比例是其評估過的所有公開模型中最高的,基準分數需審慎看待;
- 社群反應兩極:r/codex 使用者稱 Sol 程式設計表現驚艷,也有人吐槽 Sol Ultra 回應慢;r/claude 認為 Sol「進步明顯但並非顛覆性」;
- 端到端服務成本:OpenAI 官方稱 Sol 自主優化後下降 20%(2026-07-29 技術部落格);
- Token 生成吞吐:官方稱提升超 15%,經 FpSan 浮點驗證器校驗;
- 任務級成本對照:Artificial Analysis 口徑下 Kimi K3 約 $0.94/任務 vs Sol 約 $1.04/任務。
- 核對官方定價頁:以 OpenAI Platform 當前公示價格為準,勿沿用 7 月 9 日首發價做預算;
- 重算 Agent 路由:高頻工具呼叫場景優先評估 Luna 新價,複雜推理保留 Terra/Sol;
- 區分 Sol 標準與 Fast:延遲敏感任務才啟用 Fast(2× 價格),避免預設全開;
- 對照競品快取策略:Kimi K3、DeepSeek V4 Pro 快取命中價極低,長上下文重複查詢場景需單獨建模;
- 用自有基準複測:在真實程式碼庫跑 SWE/Agent 任務,記錄 token 消耗與成功率,勿只看公開榜單;
- 訂閱額度重算:ChatGPT Work/Codex 使用者按新 Luna/Terra 單價重新估算月度可用量。
以下連結為官方與第三方來源,發版後請以最新頁面為準:
OpenAI 官方部落格:Advancing the price-performance frontier with GPT-5.6
OpenAI 官方部落格:How GPT-5.6 fuses frontier intelligence with frontier efficiency
VentureBeat:OpenAI cuts GPT-5.6 prices after Kimi K3 launch
若你的團隊正在 GPT-5.6、Kimi K3 等前沿模型上建構 Agent 與 iOS/macOS CI 流水線,虛擬化 Mac 環境在 Xcode 編譯、Metal 加速場景下存在效能損耗與相容性風險。對於需要零損耗原生算力、穩定 iOS CI/CD 與 AI Agent 7×24 自動化的生產環境,MACNOX 的雲端實體節點通常是更優解:100% 蘋果原裝實體機、開放完整 Root 權限、無 Hypervisor 損耗、按天/週/月彈性下單。更多背景可參考 微軟 MAI 系列模型與 OpenRouter 7 月排行榜。
SECTION 06 常見問題 FAQ
GPT-5.6 Luna 降價後具體多少錢?
降價後 Luna 的 API 價格為每百萬 Token 輸入 $0.20、輸出 $1.20,相比原價的 $1.00/$6.00 下降 80%,是 GPT-5.6 系列裡降幅最大的一檔。
為什麼 Sol 沒有降價,反而多了更貴的 Fast 模式?
OpenAI 把 Sol 定位為「能力溢價」的旗艦產品,選擇用速度作為新的付費維度:Fast 模式價格為標準模式的 2 倍($10/$60),速度最高提升 2.5 倍,模型能力本身不變,取代此前的 Priority Processing 服務。
OpenAI 說降價是因為 AI 自己優化了 GPU 程式碼,這個說法可信嗎?
這是 OpenAI 官方披露的資訊,屬於廠商自報資料,目前沒有第三方機構複核具體的 20% 降本比例。外部技術媒體確認這是已知首例「生產級前沿模型自主改寫並上線自身服務堆疊程式碼」的公開案例,工程細節具備一定可信度,但降本幅度本身建議保持謹慎。
降價對台港澳開發者有什麼影響?
對透過官方 API 或第三方中轉存取 GPT-5.6 的台港澳開發者而言,Luna、Terra 的呼叫成本明顯下降,尤其利好需要跑批次任務或 Agent 工作流的場景;但由於合規存取方式、匯率與平台加成不同,實際到手價格仍需以具體通路公示為準。
GPT-5.6 現在還比 Kimi K3、DeepSeek V4 Pro 貴嗎?
按單純 Token 報價,Luna 已經低於多數國際競品,但仍高於 DeepSeek V4 系列;Sol 依然明顯高於 Kimi K3 和 DeepSeek V4 Pro 的報價。不過獨立評測顯示,若按「完成同等任務的實際花費」計算,Sol 與 Kimi K3 的實際成本差距會比單純 Token 單價的差距小很多。