2026 中国AI
NEAGE_
KAIHOU_
HENSEN.
8月12日から17日までの5日間、中国の大規模モデル各社は、見た目には食い違う三手を同時に打ちました。DeepSeekは一部の課金項目でAPIを最大1100%超値上げすると発表し、同じ週にアリババはこれまで一度も出していなかったQwen-Max級の2.4兆パラメータ重みを公開し、智譜はGLM-5.2と同一のベースのまま、後訓練だけでコーディングベンチをおよそ6倍に引き上げました。痛点:見出しの百分率は実請求と一致せず、「中国製=最安」ももう成り立ちません。結論:各社は単価そのものではなく、価格決定権を取りにいっています。構成:時系列、料金・仕様・ベンチ表、三つの戦略、横比較、未検証情報、5ステップ確認、FAQ。
1. この週に変わった三つの制約
- 1100%という見出しは、請求書の一行にすぎません。対象はピーク帯のキャッシュヒット入力——もともとほぼ無料に近かった行です。実請求の大半を占める出力は350%、キャッシュミス入力は200%です。日本の日中稼働は、北京時間9-12時・14-18時(日本時間10-13時・15-19時)と重なりやすく、見出し数字をそのまま掛け算すると見積もりが崩れます。
- 公式APIが自動的に最安ホストではなくなりました。ピーク帯では、DeepSeek公式の表示価格がGMI Cloud、Novitaなど第三者再販の現行提示を上回っています。オフピークのV4-ProはいまもClaude Opus 5より十分安い一方、国際向けQwen3.8-Max($2/$6)とOpenAI GPT-5.6 Luna($0.20/$1.20)は、少なくとも一項目でDeepSeekのオフピークを下回ります。
- 公開重みはApache 2.0ではありません。アリババが付けたのは独自のQwen3.8-Max Licenseです。Model-as-a-ServiceまたはAI Work Assistantで、任意の12か月に$50Mを超える売上がある場合は、別途の商用許諾が必要です。米国・EU・英国・韓国からのダウンロードを禁じる、という噂は誤りで、公開テキストに地理条項はありません。
2. 時系列:何が、いつ起きたか
| 日付 | 出来事 |
|---|---|
| 2026年7月16日 | Moonshot AIがKimi K3(2.8兆パラメータ)を公開。米側の安全保障上の関心を招く |
| 2026年8月2–3日 | アリババがQwen3.8-Maxを予告し、続けてホストAPIとして投入 |
| 2026年8月10日 | MetaがMuse Glimmer(30B、Apache 2.0)を公開し、旗艦Muse Spark 1.2の重み公開を予告 |
| 2026年8月12日 | アリババがQwen3.8-2.4T-A95BをHugging Face / ModelScopeへ公開。同日xAIがGrok 4.6を投入 |
| 2026年8月13日 | DeepSeek-V4-Proが正式版になり、8月17日発効の値上げを告知。Googleは値下げしたGemini 3.7 Flashを投入 |
| 2026年8月14日 | 智譜がGLM-5.3を投入。ベースはGLM-5.2と同じ743B |
| 2026年8月17日 0:00(北京時間) | DeepSeekの新料金が発効 |
もう一段引いて見ると、構図はさらにはっきりします。7月30日、OpenAIは最安帯のGPT-5.6 Lunaを80%値下げし、8月6–7日には無料ユーザーの既定モデルにしてテキスト対話を無制限にしました。中国側が旗艦重みの公開と段階的な値上げを進めた同じ週に、米国側は消費層で無料と値下げを重ねています。偶然の並走ではなく、同じ価格戦争の表と裏です。
3. 数字:何が実際に変わったか
DeepSeekの値上げ明細(2026年8月17日 0:00 北京時間発効。ピークは北京時間9-12時・14-18時)
| 課金項目(100万トークンあたり) | 値上げ前 | オフピーク(新) | ピーク(新) | ピーク上昇率 |
|---|---|---|---|---|
| V4-Flash キャッシュヒット入力 | ¥0.02 | ¥0.05 | ¥0.10 | 約400% |
| V4-Flash キャッシュミス入力 | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 出力 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro キャッシュヒット入力 | ¥0.025 | ¥0.15 | ¥0.30 | 約1100% |
| V4-Pro キャッシュミス入力 | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 出力 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
見出しの1100%は、ピーク帯のキャッシュヒット入力にだけ当てはまります。第三者のコスト試算では、月間およそ84Mトークン、大半がオフピーク、キャッシュヒット半分という重い実負荷でも、請求の伸びは1.8x前後に収まります。痛い数字ではありますが、11倍という見出しからは離れます。
Qwen3.8-2.4T-A95B(Qwen3.8-Max公開重み)の要点
| 項目 | 内容 |
|---|---|
| パラメータ | 総量2.4T、トークンあたり活性95B(MoE、専門家512、ルーティング10+共有1) |
| コンテキスト | 公開チェックポイントはネイティブ262144トークン、約1.01Mまで延長可。ホストMax版の既定は1M |
| 投入の流れ | 8月2日予告 → 8月3日API公開 → 8月12日重み公開 |
| API価格(国際) | 入力$2 / 出力$6(100万トークンあたり) |
| ライセンス | Apache 2.0ではない。独自のQwen3.8-Max License |
| 意味 | アリババがMax級旗艦の重みを公開したのは初めて。Qwen3.5 / 3.6 / 3.7 MaxはAPI専売のままでした |
GLM-5.3とGLM-5.2:ベースは同じ、後訓練だけ
| ベンチマーク | GLM-5.2 | GLM-5.3 | 変化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 pts |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 pts |
| Agents' Last Exam(CLI) | 23.8% | 28.5% | +4.7 pts |
| CyberGym | 77.2% | 84.5% | +7.3 pts |
| AutomationBench | 26.2% | 48.2% | +22.0 pts |
以上は智譜の自己報告です。独立した第三者の再走は、本稿執筆時点では公開されていません。Terminal-Bench 3.0では、GPT-5.6 Sol(34.6%)とClaude Fable 5(33.7%)の後ろにいます。公開重みとしては先頭集団ですが、フロンティア全体の頂点ではありません。
4. 三つの戦略を分解する
DeepSeek:時間帯別料金は戦略転換ではなく、供給制約の可視化です
いちばん安易な読みは、「中国で一番安かったモデルが、ついに粗利に屈した」です。料金表の形を見ると、むしろ逆です。計算資源の逼迫を、価格表の上で初めて見えるようにした、という読みの方が自然です。終日一律の安値は、GPU供給が需要に追いついているあいだは顧客獲得の道具として機能していました。呼び出しが指数的に伸び、供給が追いつかなくなると、どこかを明示せざるを得ません。公式告知の「より柔軟なワークロードスケジューリングを促す」は、企業広報の言い回しで、「ピーク帯の計算資源はもう足りないので、負荷は各自でずらしてください」という意味です。
海外報道がほとんど拾わなかった一点があります。ピーク帯では、DeepSeek公式APIがGMI Cloud、Novitaなど複数の再販より高くなっています。「DeepSeekを走らせるなら公式が最安」という前提は、ここで初めて崩れました。日本から昼に叩く呼び出しは、北京ピークに入りやすいので、この逆転は机上の話ではありません。
アリババ:重み公開で生態系を取り、独自ライセンスで上限を守ります
アリババは同時に二手を打ちました。2.4Tパラメータのチェックポイントを無料ダウンロードできる形で出し、そのうえで独自ライセンスを付けました。Model-as-a-ServiceまたはAI Work Assistantで、任意の12か月に$50Mを超える売上がある事業者は、別途の商用許諾を交渉しなければなりません。月間アクティブ100M以上、または月次売上$20M超の製品は、画面上でモデル名を目立つ位置に出す必要があります。
狙いははっきりしています。重みを渡して開発者の認知を取り(とくに海外では「中国製モデル」へのためらいが残ります)、そのうえで推論事業を上に載せられるごく少数の大口からは、価格交渉の余地を残す、という設計です。MetaのMuse Glimmerが無制限のApache 2.0で出ているのとは、公開の意味が違います。「オープンウェイト」という言葉だけでは、両者を同じ棚に置けません。
ここで一度、広く回った噂を切ります。アリババのライセンスが米国・EU・英国・韓国からのダウンロードを禁じている、という話は誤りです。公開されたライセンス本文に、地理・領域の条項はありません。告知スレッドではなく、LICENSEファイルを読む方が速い、というだけの話です。
GLM-5.3:新しい基盤モデルはありません。後訓練の賭け幅を広げただけです
いちばん面白いのは点数ではなく、取り方です。ベースはGLM-5.2と同じ743Bで、再学習はありません。後訓練で強化学習環境を広げただけで、Terminal-Bench 3.0は4.6%→28.3%、およそ6倍です。事前学習のScaling Lawが収穫逓減に入るなか、後訓練のRL規模は独立した性能レバーになりつつあり、千億級の基盤を作り直すより床が低いのです。中堅ラボでも、エージェントとコーディングのベンチでは差を詰められる、という意味です。
5. 横比較:値上げ後も、DeepSeekは最安の旗艦でしょうか
| モデル | 入力(100万トークン) | 出力(100万トークン) | 公開重み |
|---|---|---|---|
| DeepSeek V4-Pro(ピーク) | ¥9.0(約$1.26) | ¥27.0(約$3.78) | なし |
| DeepSeek V4-Pro(オフピーク) | ¥4.5(約$0.63) | ¥13.5(約$1.89) | なし |
| Qwen3.8-Max(国際API) | $2.00 | $6.00 | あり(独自ライセンス) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | なし |
| Claude Opus 5(アリババ開示の倍率からの推計) | 約$5.00 | 約$25.00 | なし |
人民元からドルへの換算は約¥7.15/$1です。目安であり、公式告知が優先します。値上げ後も、V4-ProのオフピークはClaude Opus 5より十分安い一方、もう「場内最安」ではありません。国際向けQwen3.8-MaxとOpenAIのLunaは、DeepSeekのオフピークを下回ります。「中国製=最安」は2025年から2026年前半まではおおむね正しく、いまは安全な前提ではありません。
引用用:V4-Proピークのキャッシュヒット入力は¥0.025 → ¥0.30(約1100%)。出力は¥6.0 → ¥27.0(350%)。Qwen3.8-Max国際は$2/$6。GLM-5.3のTerminal-Bench 3.0は、同じ743Bベース・再学習なしで4.6%→28.3%。
6. 争点と、まだ検証されていない話
- 1100%という見出しは、文脈なしでは誤解を招きます。技術的には正しくても、対象はピーク帯のキャッシュヒット入力だけです。実請求の大半を占める出力は350%です。媒体ごとに別の行を、全体の話として引用しています。
- Qwen3.8-Maxがアリババ自社のZhenwu M890(震悟M890)と「盤古AL128」超ノードで動いている、という報道は、複数の中国系経済媒体に出ています。アリババ自身の技術文書や第三者ベンチでの独立確認は、本稿執筆時点ではありません。ベンダー隣接の未検証情報として扱ってください。
- GLM-5.3がCursorの「重大な脆弱性」を見つけた、という話は、VentureBeatと智譜側の開示に依拠しています。技術的な詳細は公開されておらず、独立監査ではありません。ベンダー由来のセキュリティ知見として読んでください。
- 中国商務部がAI/半導体で報復的な輸出規制を準備している、という報道は、公式発表ではなく、未確認の媒体報道に依拠した推測です。背景として置くことはできますが、確定事実ではありません。
7. 5ステップ確認:スタックの再価格付け
- 課金行を分けます。請求書全体に1100%を掛けないでください。キャッシュヒット入力、キャッシュミス入力、出力は、上昇率が三つあります。ピークは北京時間9-12時・14-18時です。
- バッチをオフピークへ移します。公式告知は、より柔軟なワークロードスケジューリングを求めています。重い負荷で、大半がオフピーク、キャッシュヒット半分、という試算では、請求は1.8x前後です。11倍ではありません。
- Qwenは告知スレッドではなく、ライセンス本文を読みます。個人プロジェクトと社内利用は、ほぼ影響を受けません。引っかかるのは、Model-as-a-ServiceまたはAI Work Assistantで、連続する12か月に$50M超の売上がある場合です。地理的な禁止はありません。
- GLM-5.3の点数は、ベンダー自己報告として扱います。Terminal-Bench 3.0の4.6%→28.3%は後訓練だけの結果です。独立再走は公開されていません。GPT-5.6 Sol(34.6%)とClaude Fable 5(33.7%)には届いていません。
- 「いちばん安い中国製」ではなく、層別に振り分けます。オフピークのDeepSeek V4-Proは、いまもClaude Opus 5を下回ります。国際向けQwen3.8-MaxとGPT-5.6 Lunaは、少なくとも一項目でDeepSeekのオフピークを下回ります。ピーク帯では、GMI CloudとNovitaを公式表示と並べてください。
8. なぜ重要か:並行して走る、二つの価格戦争
過去およそ1か月、中国の先頭ラボは、国内の経済媒体が「一周三更」(週に三度の大型更新)と呼び始めた密度で旗艦を出しています。DeepSeek、アリババ、智譜に加え、7月16日に重みを公開したMoonshotのKimi K3(2.8兆パラメータ)、その前のMiniMax H3も同じ列に並びます。中国語圏の報道は、この公開ラッシュを「世界のAI業界に再価格付けを強いている」と読む傾向が強く、英語圏の製品ニュースより主張が前に出ます。週次の更新そのものより、更新が価格表とライセンス条項と同時に動いている点が、今回の核心です。
米国側は、消費層で逆の手を打っています。OpenAIは7月30日に最安帯を80%下げ、1週間後の8月6–7日にはそのモデルを全ユーザー無料・テキスト無制限にしました。Googleは8月13日、投入から3週間の前世代の半額で、コーディング寄りのGemini 3.7 Flashを出しています。中国側は旗艦重みを開き、計算資源が逼迫した上端では段階的に高くします。米国側は消費層で無料と安値へ走ります。どちらも本物の戦略ですが、最適化しているファネルの位置が違います。日本の開発現場から見ると、昼のバッチは北京ピークに入りやすく、夜のオフピークと無料帯のLunaが、同じ週の選択肢として並ぶ、という歪んだ時刻表になります。
地政の層も、慎重に名前を付ける必要があります。7月のKimi K3公開は、すでに米側の安全保障審査の関心を引いていました。その窓でアリババが2.4T旗艦を出したことを、一部の分析は、規制が締まる前に国際的な認知と「技術的な対等」という物語を固定する動きだと読みます。確認された事実ではなく、情報に基づく解釈です。ただし英語圏のテック報道だけを追うと見えにくい文脈でもあります。あちらでは各社の投入が、個別の製品ニュースとして扱われ、国家単位のパターンとしてはほとんど書かれません。
Metaの一手は、Llama期の公開姿勢への部分的な回帰にすぎません。Muse Glimmerは30Bの蒸留モデルであり、本命の旗艦ではありません。Mark Zuckerberg氏は、より大きく閉じたMuse Spark 1.2の重みを「まもなく」出すと言っています。それが本当に実現すれば、米国の旗艦級モデルが初めて公開されることになります。本稿執筆時点では、その投入は起きていません。表明された意図であり、確定事実ではありません。Apache 2.0の30Bと、独自ライセンスの2.4Tを同じ「オープン」で括ると、ライセンス条項の読み落としが起きます。
運用側の答えは、陣営を選ぶことではありません。台帳を分けることです。ピークとオフピーク、キャッシュヒットとミス、ライセンスの閾値、$50M / 100M MAU / $20M、ベンダー自己報告と第三者再走。クラウドAPIは、バーストと旗艦のA/Bにはまだ向いています。公式ピークが最安ホストでなくなり、公開チェックポイントが兆パラメータ級のMoEになると、ノートPCのユニファイドメモリと常時稼働のエージェントが先に壊れます。長コンテキストと24時間常駐は、公式ピークSKUへすべてのトークンを流し続けるより、計量できるリモートMacノードへ置いた方が、制御経路はきれいになります。APIの上限が見えたら、まず本機Macの常時負荷を切り、足りない分はMACGPUのリモートMacを借りる、という順が実務的です。
9. FAQ
値上げ後も、DeepSeekはGPT-5.6やClaudeより安いですか。
オフピークは、いまもClaude Opus 5より安いです。ただし全体の最安ではなくなりました。OpenAIのGPT-5.6 Luna(100万トークンあたり$0.20/$1.20)と、アリババ国際のQwen3.8-Max($2/$6)は、少なくとも一項目でDeepSeekの新しいオフピークを下回ります。旗艦級としてはまだ相対的に安い一方、無条件の最安ではありません。
アリババのQwen3.8-Max公開重みを、商用製品で無料利用できますか。
多くの用途ではできます。個人プロジェクトと社内利用は、ほぼ影響を受けません。引っかかるのは、Model-as-a-ServiceまたはAI Work Assistantで、連続する12か月に$50M超の売上がある場合だけです。その層は、アリババとの別途商用許諾が必要です。月間アクティブ100M、または月次売上$20M超なら、画面上のモデル名表示も必要です。
Qwen3.8-Maxは、米国・EU・英国の利用者に禁じられていますか。
禁じられていません。ネット上で回った主張は誤りです。公開ライセンスに地理制限はありません。制限は売上規模に紐づき、所在地には紐づきません。
GLM-5.3とGLM-5.2の実体は、どこが違いますか。
ベースレベルでは違いません。どちらも同じ743Bの基盤モデルです。性能差(Terminal-Bench 3.0でおよそ6倍)は、後訓練で強化学習を広げた結果であり、基盤の再学習はありません。
Metaは、小さなMuse Glimmerだけでなく、旗艦も本当に公開しますか。
まだです。Muse Glimmerは30Bの蒸留モデルであり、本命の旗艦ではありません。Zuckerberg氏はMuse Spark 1.2の重みを「まもなく」出すと言っています。本稿執筆時点では投入は起きておらず、表明された意図として扱ってください。
10. 出典
- DeepSeek公式の料金告知。華爾街見聞、IT之家、AIGC.cn、V2EXの議論と突き合わせ
- アリババ公式のQwenリポジトリ(Hugging Face / ModelScope)と、南華早報(SCMP)のライセンス条項報道
- 智譜(Z.ai)公式のGLM-5.3技術ページ、ならびにVentureBeatとStableLearnの報道
- Meta AI Research公式ブログと、VentureBeatのMuse Glimmer報道
- 中国の経済媒体(第一財経、搜狐財経)による、公開サイクルの密度と枠組みの整理
料金、ライセンス条項、ベンチ数字は、公開時点の公開情報です。再掲の前に、最新の公式料金とライセンスを確認してください。上文で未検証とした細部(国産チップの主張、Cursor脆弱性の報告、輸出規制の噂)は、独立確認されていません。
11. 結び:ピーク料金が動いたあと、制御用の計算はどこかに着地させます
ホストAPIは、まだ使えます。制約だけが明示されました。ピークの公式表示は最安保証ではなく、独自ライセンスは大口商用を回収し、2.4TのMoEチェックポイントはノートPCの仕事ではありません。WindowsやLinuxのGPU箱はスループット推論には向きますが、Cursorのツールチェーン、常時稼働のOpenClaw、MLXの量子化照合、グラフィックス隣接の作業では不利になりがちです。DeepSeekのオフピーク振り分け、Qwen公開重みの試走、GLM-5.3のコーディングベンチを、同じ再現環境に置くなら、長コンテキストとエージェント常駐はMACGPUリモートMacへ置いてください。SSHで入り、ノードを計量し、本機は編集に残し、すべてのトークンを公式ピークSKUへ流し続けないようにします。