首頁 / 部落格 / 8月變陣
ENGINEERING_BLOG · 2026.08.17

DeepSeek 漲價+阿里開源 2.4 兆旗艦+GLM-5.3 躍升:
中國大模型 8 月為何同步變陣

8 月 12 日至 17 日這五天,追蹤中國大模型 API 與開源權重的開發者連續碰上三件彼此矛盾、卻又互相呼應的事:DeepSeek 宣布 API 調漲最高超過 1100%,阿里把從未開源過的 Qwen-Max 級旗艦 2.4 兆參數權重公開釋出,智譜則沿用同一基座、只靠後訓練把程式測試分數拉高數倍。本文寫給要核對帳單、授權條款與選型的工程團隊,用時間軸、價目表與三種打法拆同一訊號——中國大模型正從「拚價格」轉向「拚定價權」。

SECTION 01 DeepSeek 調漲後,開發者最容易誤判的五件事

這波變陣最容易把選型帶偏的,不是缺新聞,而是口徑對不上。常見誤判包括:

  • 把「漲超 1100%」當成整張帳單:該數字對應 V4-Pro 尖峰時段快取命中輸入;輸出漲幅是 350%,快取未命中輸入是 200%;
  • 以為官方 API 永遠最便宜:尖峰時段 DeepSeek 官方價已反超部分第三方轉售平台(例如 GMI Cloud、Novita 目前報價仍低於官方尖峰價);
  • 把阿里開源當成 Apache 2.0 慈善:權重可下載,但過去 12 個月營收超過 5000 萬美元的「模型即服務」或「AI 工作助手」須另行洽談商業授權;
  • 相信「美歐英韓禁止下載」謠言:官方授權條款原文並無地域限制,門檻按營收與產品規模,不按使用者所在地;
  • 把 GLM-5.3 當成換了更大基座:7430 億參數基座與 GLM-5.2 完全相同,分數來自後訓練強化學習擴規模,且為廠商自測、尚無獨立複測。

三家公司、三種打法,共同指向同一個訊號:中國大模型正從「拚價格」轉向「拚定價權」。

SECTION 02 一張時間軸看懂這兩週:誰在調漲,誰在開源

把鏡頭拉遠:7 月 30 日 OpenAI 已把最便宜檔 GPT-5.6 Luna 降價 80%,8 月 6–7 日又把 Luna 設為免費使用者的預設模型並開放無限文本對話。中國廠商在調漲與開源上做加法的同一時間,美國廠商正在免費與降價上做加法。這不是巧合,而是同一場定價博弈的兩個側面。更早的單品發佈可對照 Qwen3.8-Max 發佈稿DeepSeek V4 完整版定價

2026 年 7–8 月關鍵節點
日期 事件
7月16日 月之暗面 Kimi K3(2.8 兆參數)開源,此前已引發美方安全關注
8月2日–3日 阿里 Qwen3.8-Max 先預告、後上線雲端 API
8月10日 Meta 發佈開源模型 Muse Glimmer(300 億參數,Apache 2.0),預告旗艦 Muse Spark 1.2 權重「即將開源」
8月12日 阿里正式在 ModelScope / Hugging Face 放出 Qwen3.8-2.4T-A95B 開源權重;同日 xAI 發佈 Grok 4.6
8月13日 DeepSeek-V4-Pro 正式版上線,同步公告 8 月 17 日起 API 調漲;Google 發佈降價的 Gemini 3.7 Flash
8月14日 智譜發佈 GLM-5.3,沿用 GLM-5.2 的 7430 億參數基座
8月17日 0點(北京時間) DeepSeek 新定價正式生效

SECTION 03 DeepSeek、Qwen3.8-Max、GLM-5.3 核心數據對照

DeepSeek 新價自 2026 年 8 月 17 日 0 點(北京時間)起生效,北京時間 09:00–12:00、14:00–18:00 為尖峰時段。快取命中情境漲幅最大(最高約 12 倍/1100%+),但絕對金額仍很小;對重度呼叫者影響更大的其實是輸出價格(350%)與快取未命中輸入價格。

DeepSeek 調漲明細(每百萬 tokens,人民幣)
計費項 調漲前 離峰時段(新) 尖峰時段(新) 漲幅(尖峰)
V4-Flash 快取命中輸入 ¥0.02 ¥0.05 ¥0.10 約 400%
V4-Flash 快取未命中輸入 ¥1.0 ¥1.5 ¥3.0 200%
V4-Flash 輸出 ¥2.0 ¥4.5 ¥9.0 350%
V4-Pro 快取命中輸入 ¥0.025 ¥0.15 ¥0.30 約 1100%
V4-Pro 快取未命中輸入 ¥3.0 ¥4.5 ¥9.0 200%
V4-Pro 輸出 ¥6.0 ¥13.5 ¥27.0 350%
Qwen3.8-2.4T-A95B(Qwen3.8-Max 開源權重)關鍵規格
項目 數據
參數規模 2.4 兆總參數,950 億激活參數(MoE,512 個專家,10 路由 + 1 共享)
上下文視窗 開源權重原生 262144 tokens(約 26.2 萬),可延伸至約 101 萬;雲端 Max 版預設 100 萬 tokens
發佈節奏 8 月 2 日預告 → 8 月 3 日 API 上線 → 8 月 12 日開源權重
API 定價(國際站) 輸入 $2 / M tokens,輸出 $6 / M tokens
授權條款 非 Apache 2.0,自訂「Qwen3.8-Max License」
意義 阿里歷史上首次把 Max 級(旗艦)模型開源,此前 Qwen3.5/3.6/3.7 Max 均為閉源 API
GLM-5.3 vs GLM-5.2:同基座,只靠後訓練(智譜官方自測)
基準測試 GLM-5.2 GLM-5.3 變化
Terminal-Bench 3.0 4.6% 28.3% +23.7
DeepSWE v1.1 46.2% 66.9% +20.7
Agents' Last Exam(CLI) 23.8% 28.5% +4.7
CyberGym 77.2% 84.5% +7.3
AutomationBench 26.2% 48.2% +22.0

以上為智譜官方自測數據,尚無獨立第三方複測結果。GLM-5.3 在 Terminal-Bench 3.0 上仍落後 GPT-5.6 Sol(34.6%)與 Claude Fable 5(33.7%),並非全面登頂,而是「開源模型第一梯隊」。

SECTION 04 三種打法:分時定價、開源圈生態、後訓練換分數

1. DeepSeek:從「貼地價」到「分時定價」,本質是算力緊張的顯性化。這次調漲最容易被誤讀成「跟漲」,細看結構更像一次「算力帳單透明化」。此前長期採用不分時段的統一低價,用低價換使用者規模,再靠快取命中率與錯峰排程攤薄成本。當呼叫量指數級成長、GPU 產能跟不上時,這套模式撐不住了——調漲公告裡「鼓勵更靈活的工作負載排程」,翻譯過來就是「我們的算力已經不夠用了,請你自己錯峰」。尖峰時段官方價反超部分轉售平台,意味著「官方價格最便宜」這個曾經支撐 DeepSeek 護城河的假設,第一次被打破。

2. 阿里:開源權重,圈住生態;自訂授權條款,圈住收入。Qwen3.8-Max 的開源不是單純的「慈善」。阿里同時做了兩件事:把 2.4 兆參數的權重公開下載,同時給這份權重配了一份不同於以往 Apache 2.0 的自訂授權——過去 12 個月營收超過 5000 萬美元的「模型即服務」或「AI 工作助手」業務,必須另行向阿里洽談商業授權;月活躍超過 1 億或月收入超過 2000 萬美元的產品,必須在介面上顯著展示模型名稱。用開源換開發者生態與口碑(尤其是海外開發者),但在真正能產生現金流的大客戶身上繼續保留議價權。這也是為什麼它和 Meta 的 Muse Glimmer(完全 Apache 2.0,無附加條款)在「開源程度」上不是一個量級。網傳授權條款禁止美國、歐盟、英國、韓國使用者下載,是不實資訊,官方原文並無任何地域限制條款。

3. 智譜 GLM-5.3:不換基座,只換「後訓練配方」。最值得關注的不是分數本身,而是怎麼拿到這個分數——基座與 GLM-5.2 完全相同(7430 億參數),沒有重新預訓練,僅靠擴大強化學習環境規模做後訓練,就把 Terminal-Bench 3.0 從 4.6% 拉到 28.3%,接近 6 倍提升。當預訓練 Scaling Law 邊際收益放緩,「後訓練強化學習規模化」正在成為新的性能槓桿,門檻顯著低於重新訓練一個千億級基座,意味著更多中小廠商也有機會靠「精裝修」追上頭部模型。

SECTION 05 調漲之後 DeepSeek 還是最便宜的旗艦嗎?6 步核對清單

換算匯率按約 ¥7.15/$1 估算,僅供參考,實際以官方公告為準。調漲後 DeepSeek V4-Pro 離峰時段價格仍明顯低於 Claude Opus 5,但已經不再是「全場最低」——阿里國際站的 Qwen3.8-Max、OpenAI 的 Luna 都比 DeepSeek 的離峰價更便宜。「中國製=最便宜」的等式正在瓦解,價格競爭進入分層階段。OpenAI 側降價背景見 GPT-5.6 Luna 砍 80%

旗艦檔輸入/輸出價格(每百萬 tokens)
模型 輸入 輸出 開源程度
DeepSeek V4-Pro(尖峰) ¥9.0(約 $1.26) ¥27.0(約 $3.78) 權重未開源
DeepSeek V4-Pro(離峰) ¥4.5(約 $0.63) ¥13.5(約 $1.89) 權重未開源
Qwen3.8-Max(國際站) $2 $6 開源(自訂授權條款)
OpenAI GPT-5.6 Luna $0.20 $1.20 閉源
Claude Opus 5(據阿里披露的倍數關係推算) 約 $5 約 $25 閉源

若你要在正式環境落地這三家的變陣,按下面 6 步核對,而不是只看標題漲幅:

  1. 拆帳單維度:把近 30 天呼叫拆成快取命中輸入、快取未命中輸入、輸出三類,分別套用上表,不要用「1100%」乘總帳單;
  2. 標尖峰視窗:把任務排程對齊北京時間 09:00–12:00、14:00–18:00 之外的離峰時段;公告原話是「鼓勵更靈活的工作負載排程」;
  3. 對比官方與轉售:尖峰時段核對 GMI Cloud、Novita 等第三方報價是否已低於 DeepSeek 官方尖峰價;
  4. 讀授權條款原文:下載 Qwen3.8-2.4T-A95B 前打開 LICENSE,核對 5000 萬美元/1 億月活躍/2000 萬美元月收入三條門檻,勿信地域禁令謠言;
  5. 把 GLM-5.3 當後訓練增量:基座未變,分數為官方自測;在自有 Terminal/SWE 任務上複測後再決定是否替換 5.2;
  6. 分層選型:消費級與低成本文本走 Luna;需要開源權重與生態走 Qwen;需要旗艦推理且能錯峰的走 DeepSeek 離峰價;長程 Agent 與 iOS CI 另算實體機成本。
deepseek-bill-estimate.py
peak = {"in_miss": 9.0, "in_hit": 0.30, "out": 27.0}
off  = {"in_miss": 4.5, "in_hit": 0.15, "out": 13.5}

tokens_m = {"in_miss": 40, "in_hit": 40, "out": 4}
def bill(rate, t):
    return t["in_miss"]*rate["in_miss"] + t["in_hit"]*rate["in_hit"] + t["out"]*rate["out"]

print("off-peak ¥", round(bill(off, tokens_m), 2))
print("peak ¥", round(bill(peak, tokens_m), 2))

SECTION 06 爭議點、兩線戰爭,以及你該核對的官方來源

  • 調漲幅度的口徑混亂:「漲 11 倍」「漲超 1100%」「漲 350%」都對,但對應不同計費維度;
  • 阿里「震悟 M890 國產晶片」服務的說法:多家中文財經媒體報導稱 Qwen3.8-Max 部分推理服務跑在阿里自研震悟 M890 與「盤古 AL128」超節點上,目前僅見於中文媒體轉述,未見阿里官方獨立技術文件或第三方基準測試確認,建議標註為未經獨立驗證
  • GLM-5.3「發現 Cursor 嚴重漏洞」的說法:來自 VentureBeat 報導及智譜方面透露,具體漏洞細節未公開,真實性與影響範圍有待第三方安全機構確認,屬於廠商單方面披露
  • 中國商務部可能醞釀反制出口管制:部分報導提及官方可能針對 AI/半導體技術醞釀反制性出口管制,目前未見官方正式確認,屬於媒體推測/傳聞,僅供背景參考。

過去一個月,中國頭部模型廠商呈現出密集發佈節奏——DeepSeek、阿里、智譜之外,還有月之暗面 Kimi K3(7 月 16 日,2.8 兆參數開源)輪番登場。與此同時,美國廠商走另一條路徑:OpenAI 7 月 30 日大幅降價,8 月 6–7 日把 Luna 設為免費預設;Google 8 月 13 日發佈降價的 Gemini 3.7 Flash。中國廠商在「開源旗艦+梯度調漲」,美國廠商在「消費端免費+降價防守」——兩條路徑同時發生,共同把 2026 年 8 月變成大模型產業定價邏輯重構的關鍵節點。

另一層背景是地緣政治:Kimi K3 的開源此前已引發美方安全審查關注,阿里選擇在這個視窗把 2.4 兆參數旗艦開源,被部分分析解讀為「在潛在監管收緊前,搶先鞏固國產模型的國際影響力與技術對等敘事」。這一判斷帶有推測性質,但是理解這波開源潮時機時不可忽略的背景。

以下為官方與交叉核對來源,涉及價格、授權條款與基準分數,發佈前請再次打開連結核實最新官方公告

DeepSeek 官方 API 定價頁(尖峰/離峰價以該頁為準)

阿里雲社群:Qwen3.8-Max 官方發佈說明

Hugging Face:Qwen3.8-2.4T-A95B 開源權重庫

路透社/MarketScreener:DeepSeek 上調 V4 API 價格

MarkTechPost:GLM-5.3 同基座後訓練報導

自行託管 2.4 兆 MoE,或把 Agent 接到 Xcode/iOS CI,虛擬化 Mac 會把編譯、簽名與長程任務的隱性損耗疊進已經上漲的 token 帳單。對於需要零損耗原生算力、穩定 iOS CI/CD 與 AI Agent 7×24 自動化的正式環境,MACNOX 的雲端物理節點通常是更優解:100% 蘋果原裝實體機、開放完整 Root 權限、無 Hypervisor 損耗、按天/週/月彈性下單。更多中國模型份額背景可參考 OpenRouter 7 月排行榜分析

SECTION 07 常見問題 FAQ

DeepSeek 這次調漲之後,是不是意味著以後用起來更貴了?

要分情境看。如果你的呼叫大多落在離峰時段(非北京時間 09:00–12:00、14:00–18:00),且是快取命中率較高的重度使用者,實際漲幅會明顯低於表面的「350%」「1100%」這類標題數字(有分析估算重度使用者實際帳單漲幅約為 1.8 倍左右);但如果集中在尖峰時段呼叫、且快取命中率低,漲幅會接近甚至達到標題數字。

阿里開源的 Qwen3.8-Max,個人開發者能免費商用嗎?

個人開發者與內部使用基本不受影響。但如果你的業務是「模型即服務」或「AI 工作助手」類產品,且過去 12 個月內該業務累計收入超過 5000 萬美元,需要另行向阿里申請商業授權;如果產品月活躍超過 1 億或月收入超過 2000 萬美元,需要在介面上顯著標示模型名稱。

GLM-5.3 和 GLM-5.2 是同一個模型嗎?為什麼突然變強這麼多?

底層基座模型確實完全相同(7430 億參數),智譜沒有重新訓練。分數大幅提升的原因是後訓練階段大幅擴大了強化學習環境的規模,這說明當前階段「後訓練規模化」本身就是一個獨立、有效的性能槓桿,不一定需要重新預訓練一個更大的基座。

網傳阿里的 Qwen3.8-Max 授權條款禁止美國、歐盟使用者下載,是真的嗎?

不是真的。這是網路上流傳的不實資訊,官方授權條款原文中沒有任何地域限制條款,主要限制是針對超過特定營收規模的商業化服務,與使用者所在地區無關。

Meta 這次開源 Muse Glimmer,是不是意味著 Llama 時代的開源精神又回來了?

目前還只能算「部分回歸」。Muse Glimmer 本身只是一個 300 億參數的蒸餾小型模型,Meta 真正的旗艦閉源模型 Muse Spark 1.2 尚未開源,扎克伯格只是「預告」未來會開放其權重。如果這一步真的落地,才稱得上是美國廠商首次把旗艦級閉源模型轉為開源,目前仍需持續關注後續進展。