ホーム / ブログ / 値上げ解説
ENGINEERING_BLOG · 2026.08.17

DeepSeekはなぜAPIを最大約1,100%値上げしたのか
——Qwen開放とGLM-5.3が重なった週

結論から言うと、DeepSeekの「1,100%」は請求書全体の倍率ではありません。ピーク時間の V4-Pro キャッシュヒット入力だけが、その数字に近い上昇です。出力は 350%、キャッシュミス入力は 200%です。同じ週に阿里巴巴は 2.4T 旗艦をオープンウェイト公開し、智譜は 743B のまま後学習だけで GLM-5.3 を出しました。中国のフロンティア API やウェイトを買うチーム向けに、誤読しやすい点、時系列、料金表、6ステップの監査手順を整理します。共通の信号は、研究所が安さだけでなく価格決定力で競い始めた、という点です。

SECTION 01 DeepSeek値上げでチームが誤読しやすい5つの点

見出しは足りています。足りないのは、請求の切り分けです。

  • 「1,100%」を請求書全体に掛ける:その数字は V4-Pro のピーク時間キャッシュヒット入力です。出力は 350%、キャッシュミス入力は 200%です。
  • 公式 API が常に最安だと決める:ピーク時間では、DeepSeek 公式の表示価格が再販より高くなる場合があります。GMI Cloud や Novita などは、新しい公式ピークより安い V4-Pro を提示し続けることがあります。
  • 阿里巴巴の公開を Apache 2.0 の無償提供と読む:ウェイトはダウンロードできます。ただし Model-as-a-Service または AI Work Assistant 事業で、連続12か月の売上が 5,000万ドルを超える場合は、別途の商用ライセンス交渉が必要です。
  • 地理的なダウンロード禁止を繰り返す:米国、EU、英国、韓国はチェックポイントを落とせない、という主張は誤りです。公開ライセンスに領域条項はありません。
  • GLM-5.3 を新しい基盤モデルと呼ぶ:GLM-5.2 と同じ 743B 基盤を再利用しています。伸びは後学習の強化学習を拡大した結果です。スコアはベンダー報告で、独立した再実行はまだ公開されていません。

3社が別々の打ち手を出しましたが、信号はひとつです。中国のAI研究所は、安さだけでなく価格決定力で競っています。

SECTION 02 2026年7〜8月:何がいつ出荷されたか

視野を広げます。7月30日、OpenAI は最安区分の GPT-5.6 Luna を 80% 値下げしました。8月6〜7日には Luna を無料の既定にし、テキストチャットを無制限にしました。中国側が値上げと旗艦ウェイト公開を進める一方、米国側は消費者層で値下げと無料化を進めています。同じ競争の両面です。先行する製品メモは、Qwen3.8-Max の公開時点DeepSeek V4 GA の料金です。

主な日付(2026年7〜8月)
日付 出来事
2026年7月16日 Moonshot AI が Kimi K3(2.8T)をオープンウェイト公開。米国の安全保障上の注視を招く
2026年8月2〜3日 阿里巴巴が Qwen3.8-Max をプレビューし、ホスト API として投入
2026年8月10日 Meta が Muse Glimmer(30B、Apache 2.0)を公開し、旗艦 Muse Spark 1.2 のオープンウェイトを予告
2026年8月12日 阿里巴巴が Qwen3.8-2.4T-A95B を Hugging Face / ModelScope に公開。xAI が Grok 4.6 を出荷
2026年8月13日 DeepSeek-V4-Pro が GA となり、8月17日発効の値上げを発表。Google が値下げした Gemini 3.7 Flash を出荷
2026年8月14日 智譜が GLM-5.3 を出荷。GLM-5.2 と同じ 743B 基盤を再利用
2026年8月17日 0時(北京時間) DeepSeek の新料金が発効

SECTION 03 DeepSeek新料金・Qwen仕様・GLM-5.3ベンチマーク

DeepSeek の新料金は 8月17日 0時(北京時間)に発効します。ピーク時間は北京時間の午前9時〜12時と午後2時〜6時です。見出しの約 1,100% は、ピーク時のキャッシュヒット入力——もともと無料に近かった区分——に当たります。実請求の大半を占める出力は 350% の上昇です。独立したコスト試算では、現実的なヘビー利用(おおよそ月 8,400万トークン、大半がオフピーク、キャッシュヒット半分)の請求増は約 1.8倍に寄ります。

DeepSeek 値上げ(100万トークンあたり、人民元)
課金項目 新オフピーク 新ピーク ピーク上昇
V4-Flash キャッシュヒット(入力) ¥0.02 ¥0.05 ¥0.10 約400%
V4-Flash キャッシュミス(入力) ¥1.0 ¥1.5 ¥3.0 200%
V4-Flash 出力 ¥2.0 ¥4.5 ¥9.0 350%
V4-Pro キャッシュヒット(入力) ¥0.025 ¥0.15 ¥0.30 約1,100%
V4-Pro キャッシュミス(入力) ¥3.0 ¥4.5 ¥9.0 200%
V4-Pro 出力 ¥6.0 ¥13.5 ¥27.0 350%
Qwen3.8-2.4T-A95B(Qwen3.8-Max オープンウェイト)
項目 内容
パラメータ 総量 2.4T、トークンあたり活性 95B(MoE、専門家 512、ルーティング 10 + 共有 1)
コンテキスト ネイティブ 262,144 トークン(公開チェックポイント)、約 1.01M まで延長可。ホスト Max の既定は 1M
公開の流れ 8月2日プレビュー → 8月3日 API 公開 → 8月12日オープンウェイト
API 料金(国際) 入力 $2/M、出力 $6/M
ライセンス Apache 2.0 ではありません。独自の Qwen3.8-Max License です
位置づけ 阿里巴巴が Max 級旗艦をオープンウェイトにした初回です。Qwen3.5 / 3.6 / 3.7 Max は API のみでした
GLM-5.3 と GLM-5.2:同じ基盤、後学習のみ(智譜報告)
ベンチマーク GLM-5.2 GLM-5.3 変化
Terminal-Bench 3.0 4.6% 28.3% +23.7 pts
DeepSWE v1.1 46.2% 66.9% +20.7 pts
Agents' Last Exam (CLI) 23.8% 28.5% +4.7 pts
CyberGym 77.2% 84.5% +7.3 pts
AutomationBench 26.2% 48.2% +22.0 pts

これらは智譜自身の数字です。GLM-5.3 は Terminal-Bench 3.0 で GPT-5.6 Sol(34.6%)と Claude Fable 5(33.7%)の後ろにいます。オープンウェイトとしては上位ですが、フロンティア全体の首位ではありません。

SECTION 04 時間帯料金、カスタムライセンス、後学習の3つの戦略

DeepSeek:一律の安さから時間帯料金へ——ブランド転換ではなく、供給の問題です。「中国で一番安かったモデルが折れた」と読むのは簡単です。構造は、計算資源の制約が表に出た、と読んだ方が近いです。GPU 供給が追いついているあいだは、常時安い一律料金が獲得策として機能しました。利用が指数的に伸び、供給が追いつかなくなると、どこかを明示する必要が出ます。「より柔軟なワークロードスケジューリングを促す」は、ピーク時間の計算資源が足りない、という企業語です。ピークでは、公式 API が DeepSeek を走らせる最安の道ではなくなりました。その前提は、ここで崩れます。

阿里巴巴:オープンウェイトで認知を取り、カスタムライセンスで売上の天井を守ります。2.4T チェックポイントの公開と、独自ライセンスの添付は一体の打ち手です。Model-as-a-Service または AI Work Assistant 事業で、連続12か月の売上が 5,000万ドルを超える場合は、別途の商用ライセンス交渉が必要です。月間アクティブユーザー 1億超、または月間売上 2,000万ドル超の製品は、モデル名の表示が必要です。狙いは、海外の開発者を取り込みつつ、その上で推論を売れる事業者への交渉力を残すことです。Meta の Muse Glimmer が制限の少ない Apache 2.0 であるのとは、賭け方が違います。地理的禁止の噂は誤りです。発表スレッドではなく、LICENSE ファイルを確認してください。

GLM-5.3:新しい基盤はなく、後学習への賭けを大きくしています。GLM-5.2 と同じ 743B 基盤で、再学習はありません。Terminal-Bench 3.0 では 4.6% から 28.3% へ、およそ 6倍です。伸びは RL 環境の拡大によるものです。事前学習のスケーリング則が頭打ちになるにつれ、後学習の強化学習は、新しい基盤モデルよりコスト床の低い独立したレバーになっています。中堅の研究所でも、OpenAI 級の事前学習予算なしに、エージェント系とコーディング系の差を詰められます。

SECTION 05 DeepSeekはまだ最安のフロンティアか:6ステップ監査

人民元からドルへの換算は、およそ ¥7.15 / $1 です。概算です。オフピークの V4-Pro は Claude Opus 5 を大きく下回りますが、唯一の最安ではなくなりました。Qwen3.8-Max の国際料金と OpenAI の Luna は、少なくとも一方の軸で DeepSeek のオフピークを下回ります。「中国モデル=最安モデル」は 2025年から 2026年前半まで通用しました。いまは安全な前提ではありません。米国側の値下げは、GPT-5.6 Luna の 80% 値下げを参照してください。

入力 / 出力(100万トークンあたり)
モデル 入力 出力 オープンウェイト
DeepSeek V4-Pro(ピーク) ¥9.0(約 $1.26) ¥27.0(約 $3.78) なし
DeepSeek V4-Pro(オフピーク) ¥4.5(約 $0.63) ¥13.5(約 $1.89) なし
Qwen3.8-Max(国際 API) $2.00 $6.00 あり(独自ライセンス)
OpenAI GPT-5.6 Luna $0.20 $1.20 なし
Claude Opus 5(阿里巴巴の比較比からの含意) 約 $5.00 約 $25.00 なし

今週中に出荷しなければならない場合は、見出し倍率を掛けず、次の6ステップでスタックを監査してください。

  1. 請求を分ける:直近30日をキャッシュヒット入力、キャッシュミス入力、出力に分け、新しい料金表を各行に当てます。請求書全体に 1,100% を掛けないでください。
  2. 北京時間のピークを印す:午前9時〜12時と午後2時〜6時(北京時間)です。発表が柔軟なスケジューリングを求めた理由は、ここにあります。
  3. 公式と再販を比べる:ピークでは、GMI Cloud、Novita、その他の再販が、DeepSeek 公式のピーク料金を下回っていないかを確認します。
  4. LICENSE ファイルを読む:Qwen3.8-2.4T-A95B を落とす前に、5,000万ドル / 月間アクティブ 1億 / 月間売上 2,000万ドルの閾値を確認します。地理的禁止のスレッドは無視してください。
  5. GLM-5.3 を後学習の差分として扱う:基盤は 5.2 と同じです。ベンチはベンダー報告のみです。入れ替える前に、自前のターミナル作業と SWE 作業を再実行してください。
  6. 層ごとに振り分ける:安い消費者向けテキストは Luna、オープンウェイトと生態系は Qwen、ピークをずらせるフロンティア推論は DeepSeek のオフピーク、長時間エージェントと iOS CI は Hypervisor ではなく実機 Mac へ回します。
deepseek-bill-estimate.py
peak = {"in_miss": 9.0, "in_hit": 0.30, "out": 27.0}
off  = {"in_miss": 4.5, "in_hit": 0.15, "out": 13.5}

tokens_m = {"in_miss": 40, "in_hit": 40, "out": 4}
def bill(rate, t):
    return t["in_miss"]*rate["in_miss"] + t["in_hit"]*rate["in_hit"] + t["out"]*rate["out"]

print("off-peak CNY", round(bill(off, tokens_m), 2))
print("peak CNY", round(bill(peak, tokens_m), 2))

SECTION 06 未確認情報と、ふたつの価格戦の読み方

  • 1,100% の見出しは正確で、かつ不完全です:ピーク時のキャッシュヒット入力だけです。実請求の大半を占める出力は 350% の上昇です。
  • Zhenwu M890 / Pangu AL128 の主張:中国の複数の金融メディアは、Qwen3.8-Max 推論の一部が阿里巴巴の自社チップ上で走ると伝えています。阿里巴巴は独立した技術文書や第三者ベンチを公開していません。未確認として扱ってください。
  • GLM-5.3 と「深刻な Cursor 脆弱性」:VentureBeat と智譜自身の開示です。技術詳細は公開されていません。ベンダー由来であり、独立監査ではありません
  • 報復的な輸出規制:中国商務部が AI / 半導体の対抗措置を準備しうる、という報道は推測メディアであり、公式発表ではありません。

この1か月、中国の上位研究所は、国内の金融メディアが「一周三更」(週に3回のモデル更新)と呼ぶペースで出荷しています。DeepSeek、阿里巴巴、智譜に加え、Moonshot のKimi K3(7月16日オープンウェイト、2.8T)と MiniMax H3 です。中国側の報道は、オープンウェイト公開が世界の再価格設定を迫っている、と枠づけます。米国の研究所は消費者層で逆の打ち手を取りました。OpenAI の Luna 80% 値下げと、その後の無料・無制限テキスト、Google の 8月13日 Gemini 3.7 Flash 半額です。計算資源が足りない上層では旗艦オープンウェイトと段階的な値上げ、消費者端では無料と安さです。どちらも実在します。最適化している漏斗の位置が違います。

地政学の層もあります。Kimi K3 はすでに米国の安全保障上の注視を招いています。一部の分析は、この窓での阿里巴巴 2.4T 公開を、規制が締まる前に海外の認知と「技術的対等」の物語を固定する動き、と読みます。これは根拠のある解釈であり、確定事実ではありません。英語の製品投稿だけを読むと、見落としやすい点です。

公式源と、突き合わせ済みの源です。料金やライセンス条項を再掲する前に、次のページを開き直してください。

DeepSeek 公式 API 料金(ピーク / オフピーク表)

Alibaba Cloud Community:Qwen3.8-Max 投入メモ

Hugging Face:Qwen3.8-2.4T-A95B チェックポイント

Reuters / MarketScreener:DeepSeek が V4 API を値上げ

MarkTechPost:GLM-5.3 は同じ基盤の後学習

2.4T MoE を自前ホストする場合も、エージェントを Xcode と iOS CI に繋ぐ場合も、値上がりしたトークン請求の上に Hypervisor の損失が重なります。ゼロ損失のネイティブ算力、安定した iOS CI/CD、7×24 のエージェント自動化が必要な本番では、MACNOX のクラウド物理ノードが通常はより適した選択です。純正 Apple、フル Root、Hypervisor なし、日 / 週 / 月で選べます。周辺の文脈はOpenRouter 7月ランキングです。

SECTION 07 よくある質問 FAQ

値上げ後も DeepSeek は GPT-5.6 や Claude より安いですか?

オフピークは Claude Opus 5 より安い一方、全体の唯一の最安ではなくなりました。OpenAI の GPT-5.6 Luna(100万トークンあたり $0.20 / $1.20)と、阿里巴巴の国際 Qwen3.8-Max($2 / $6)は、少なくとも一方の軸で DeepSeek の新オフピークを下回ります。DeepSeek はフロンティア級としては依然として相対的に安い一方、唯一の最安ではなくなりました。

阿里巴巴の Qwen3.8-Max オープンウェイトを商用製品で無料利用できますか?

ほとんどの用途ではできます。個人プロジェクトと社内利用は影響を受けません。条件が付くのは、Model-as-a-Service または AI Work Assistant 事業で、連続12か月の売上が 5,000万ドルを超える場合だけです。その層は阿里巴巴との別途商用ライセンスが必要です。月間アクティブユーザー 1億超、または月間売上 2,000万ドル超の製品は、モデル名の表示が必要です。

Qwen3.8-Max は米国、EU、英国の利用者に禁止されていますか?

いいえ。オンラインで回った主張は誤りです。公開ライセンスに地理的制限はありません。制限は売上に基づき、所在地には結び付いていません。

GLM-5.3 と GLM-5.2 の実体的な違いは何ですか?

基盤モデルの層では違いはありません。どちらも同じ 7430億パラメータの基盤です。性能の伸び(Terminal-Bench 3.0 でおよそ 6倍)は、後学習で強化学習を拡大した結果であり、基盤の再学習はありません。

Meta は Muse Glimmer だけでなく、旗艦も本当にオープンソースにしますか?

まだです。Muse Glimmer は 30B の蒸留モデルであり、Meta の本旗艦ではありません。Mark Zuckerberg は、より大きく閉じている Muse Spark 1.2 のオープンウェイトが「まもなく」来ると述べています。実現すれば、米国の旗艦級モデルが公開される初回になります。執筆時点では、表明された意図であり、確定事実ではありません。