2026年8月12日–17日 · ピーク値上げ1100%超 · 2.4兆重み公開 · 同一基盤の後学習
導入:8月12日から17日までの5日間、中国の大規模モデル勢は矛盾して見える三手を同時に打ちました。DeepSeekは一部帯でAPIを最大1100%超値上げし、阿里はこれまで公開したことのないQwen-Max級・2.4兆パラメータの重みを出し、智譜は同じ基盤のまま後学習だけでコーディング指標を数倍伸ばしました。三社三様の打ち手は、同じ合図を指しています。国産モデルは「価格競争」から「価格支配権」の競争へ移っています。時系列・料金表・三つの論理と検証手順を、当サイトのV4-Flash評測、Qwen3.8-Max解説、GPT-5.6値下げと併せて読んでください。
見出しの上げ幅は請求の上げ幅ではない。「1100%超」はV4-Proピークのキャッシュヒット入力だけです。実請求を動かすのは出力(350%)とキャッシュミス入力です。
公式が最安、ではなくなりました。ピーク時の公式APIは、GMI CloudやNovitaなど一部再販より高くなっています。
重み公開はApache 2.0ではありません。Qwen3.8-Maxは独自ライセンスで大口の収益を残しています。
「中国製=最安」は崩れ始めています。オフピークのDeepSeekはまだClaude Opus 5より安い一方、Qwen国際とLunaは少なくとも一軸で下回ります。
| 日付 | 出来事 |
|---|---|
| 7月16日 | 月之暗面がKimi K3(2.8兆パラメータ)を公開。米側の安全保障上の関心を既に招いていた |
| 8月2–3日 | 阿里がQwen3.8-Maxを予告し、クラウドAPIを公開 |
| 8月10日 | MetaがMuse Glimmer(300億、Apache 2.0)を公開し、旗艦Muse Spark 1.2の重み公開を予告 |
| 8月12日 | 阿里がModelScope/Hugging FaceでQwen3.8-2.4T-A95Bを公開。同日xAIがGrok 4.6を出荷 |
| 8月13日 | DeepSeek-V4-Pro正式版。8月17日からの値上げを告知。Googleは値下げしたGemini 3.7 Flashを公開 |
| 8月14日 | 智譜がGLM-5.3を公開。基盤はGLM-5.2と同じ7430億 |
| 8月17日0時(北京時間) | DeepSeekの新料金が発効 |
さらに引くと、7月30日にOpenAIは最安帯のGPT-5.6 Lunaを80%値下げし、8月6–7日には無料ユーザーの既定モデルにしてテキスト無制限にしました。中国勢が値上げと旗艦公開を足している同じ週に、米国勢は無料と値下げを足しています。偶然ではなく、同じ価格戦争の両面です。
| 課金項目(100万tokensあたり) | 旧価格 | オフピーク(新) | ピーク(新) | ピーク上昇 |
|---|---|---|---|---|
| V4-Flash キャッシュヒット入力 | ¥0.02 | ¥0.05 | ¥0.10 | 約400% |
| V4-Flash キャッシュミス入力 | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 出力 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro キャッシュヒット入力 | ¥0.025 | ¥0.15 | ¥0.30 | 約1100% |
| V4-Pro キャッシュミス入力 | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 出力 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
出典はDeepSeek公式告知を、華爾街見聞・IT之家・V2EXなどで突き合わせたものです。ヒット入力の上げ幅が最大(約12倍/1100%超)でも絶対額は小さく、実請求を動かすのは出力350%とミス入力です。第三者の試算では、月約8400万tokens・オフピーク多め・ヒット約半分のヘビー利用で請求は約1.8倍です。
| 項目 | 内容 |
|---|---|
| パラメータ | 総2.4兆、活性950億(MoE、専門家512、ルーティング10+共有1) |
| コンテキスト | 公開重みは原生26.2万tokens、約101万まで拡張可。クラウドMaxは既定100万 |
| 公開リズム | 8月2日予告→3日API→12日重み公開 |
| 国際API | 入力$2/出力$6(100万tokens) |
| ライセンス | Apache 2.0ではない独自「Qwen3.8-Max License」 |
| 意味 | 阿里がMax級旗艦を初めて公開。3.5/3.6/3.7 MaxはAPIのみだった |
| ベンチマーク | GLM-5.2 | GLM-5.3 | 変化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 |
| Agents' Last Exam(CLI) | 23.8% | 28.5% | +4.7 |
| CyberGym | 77.2% | 84.5% | +7.3 |
| AutomationBench | 26.2% | 48.2% | +22.0 |
いずれも智譜の自社測定で、第三者の再走はありません。Terminal-Bench 3.0ではGPT-5.6 Sol(34.6%)とClaude Fable 5(33.7%)にまだ届かず、「開源の第一集団」です。
「追随値上げ」と読むのは簡単ですが、構造は計算資源の請求書を初めて表に出した動きに近いです。従来の一律安値は利用者規模を取り、ヒット率とオフピークで原価を薄めていました。呼び出しが指数で伸び、GPUが追いつかなくなると持ちません。告知の「より柔軟なワークロードスケジューリングを促す」は、「ピークの計算資源が足りないので、負荷をずらしてください」という意味です。
ピーク時の公式APIが、GMI CloudやNovitaなど一部再販より高くなった点は海外報道があまり触れていません。「公式が最安」という評判の前提が、初めて崩れました。
Qwen3.8-Maxの公開は慈善ではありません。2.4兆のチェックポイントを無料配布する一方、従来のApache 2.0ではない独自ライセンスを付けました。直近12か月で5000万ドル超の「モデル・アズ・ア・サービス」または「AIワークアシスタント」は別途商用許諾が必要で、月間アクティブ1億超または月商2000万ドル超はモデル名の明示が必要です。
開発者の心証(とくに海外)を取りつつ、推論事業を建てられる大口には交渉力を残す、という二段構えです。完全Apache 2.0のMuse Glimmerとは「開源の度合い」が違います。米欧英韓からのダウンロード禁止という噂は誤りで、公式本文に地域条項はありません。
注目すべきは点数より取り方です。基盤はGLM-5.2と同じ7430億で再事前学習はなく、強化学習環境を広げた後学習だけでTerminal-Bench 3.0を4.6%から28.3%へ、約6倍に伸ばしました。事前学習の限界収益が鈍るなか、後学習RLの規模化は新しいレバーであり、千億級基盤の再学習より敷居が低い。中堅ラボでも「内装」で追いつける、という含意です。
| モデル | 入力(100万tokens) | 出力(100万tokens) | 重み公開 |
|---|---|---|---|
| DeepSeek V4-Pro(ピーク) | ¥9.0(約$1.26) | ¥27.0(約$3.78) | なし |
| DeepSeek V4-Pro(オフピーク) | ¥4.5(約$0.63) | ¥13.5(約$1.89) | なし |
| Qwen3.8-Max(国際) | $2 | $6 | あり(独自ライセンス) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | なし |
| Claude Opus 5(阿里開示の倍率からの推計) | 約$5 | 約$25 | なし |
換算は約¥7.15/$1の目安です。オフピークのV4-ProはまだOpus 5より安い一方、最安ではなくなりました。Qwen国際とLunaがオフピークを下回ります。「中国製=最安」は2025年から2026年初まで成り立ちましたが、もう安全な前提ではありません。
過去1か月、中国の先頭ラボは国内金融メディアが「一週三更」と呼ぶ密度で出荷しています。DeepSeek・阿里・智譜に加え、7月16日のKimi K3(2.8兆公開)やMiniMax H3も続きました。国内報道は「中国の開源が世界のAI価格を再設定している」と強めに枠付けます。
米国勢は逆です。OpenAIは7月30日に最安帯を80%下げ、翌週無料・無制限にし、Googleは8月13日に3週間前の先行モデルの半額でGemini 3.7 Flashを出しました。中国は旗艦公開と段階的値上げ、米国は消費端の無料と値下げ。両方とも本物の戦略で、漏斗の違う層を最適化しています。
地政学の層もあります。Kimi K3公開はすでに米側の審査関心を呼び、この窓で2.4兆旗艦を出す阿里の判断は「規制が締まる前に国際的な心証と技術対等の物語を固める」と読む分析があります。確定事実ではなく解釈ですが、英語圏の製品ニュースだけを読むと見えにくい文脈です。
見出しの上げ幅が、ヒット入力・ミス入力・出力のどれかを料金表で切り分ける
バッチ可能なAgent・評価・回帰を、北京時間9–12時と14–18時の外へ移す
システムプロンプトを固定し、長い接頭辞を再利用してヒット率を上げ、ミス+出力の二重課金を避ける
Qwen3.8-Maxライセンスを読む。個人・社内は通常問題なく、MaaS/AIアシスタントで年商5000万ドル超は別途交渉
コーディングAgentを基盤サイズだけで選ばない。GLM-5.3は同一基盤の後学習でTerminal-Benchを約6倍伸ばした
独立した遠隔MacのGUIでOpenClawを走らせ、DeepSeekオフピーク・Qwen国際・GLMを同じワークフローで1週間突き合わせ、既定モデルを決める
場面によります。北京時間9–12時・14–18時以外のオフピークが多く、キャッシュヒット率が高いヘビーユーザーなら、見出しの「350%」「1100%」より実請求の伸びは小さく、第三者試算では約1.8倍程度です。ピーク集中かつヒット率が低いと、見出し数字に近づきます。
個人開発と社内利用はほぼ影響しません。ただし「モデル・アズ・ア・サービス」や「AIワークアシスタント」で直近12か月の当該事業売上が5000万ドルを超える場合は阿里との別途商用許諾が必要です。月間アクティブ1億超、または月商2000万ドル超の製品はモデル名の明示表示が求められます。
基盤は同じ7430億パラメータで、再事前学習はありません。後学習で強化学習環境を大幅に広げた結果です。いまは後学習の規模化そのものが独立した性能レバーになっています。
いいえ。公式ライセンス本文に地域制限はありません。制限は売上規模に紐づく商用条項であり、所在地とは無関係です。
部分的な回帰にすぎません。Glimmerは300億パラメータの蒸留モデルで、旗艦のMuse Spark 1.2は未公開です。ザッカーバーグ氏は重み公開を予告しただけであり、実現して初めて「米国旗艦の開源」と呼べます。
時間帯別料金が発効すると、ノートPCや長期保有マシン上のAgentは二つの弱点を晒します。ピークをずらせないことと、三社の請求を同じGUIセッションで並べられないことです。見出しの1100%だけを追うか、公開重みを「自由な商用」と読むと、隠れたコストが翌月の請求になります。DeepSeek/Qwen/GLMの経路、キャッシュ接頭辞、オフピーク作業は、実験が終われば止められる遠隔Macに分けた方が見えます。VNCMacの遠隔MacでOpenClawを走らせ、オフピークとピークを突き合わせてから既定を決めてください。Macプランから始められ、計算資源の請求が価格にどう伝わるかはDeepSeek第二ラウンド資金調達も参照できます。
出典:DeepSeek公式料金告知(華爾街見聞、IT之家、AIGC.cn、V2EXで突合)、阿里Qwen公式リポジトリ(Hugging Face/ModelScope)とSCMPのライセンス報道、智譜(Z.ai)GLM-5.3公式ページおよびVentureBeat・StableLearn、Meta AI Research公式とVentureBeatのMuse Glimmer報道、第一財経・搜狐財経など。価格・ライセンス・ベンチは公開情報の整理です。再掲前に公式を再確認し、国産チップ・Cursor脆弱性・輸出規制の伝聞は未検証として扱ってください。