OPENROUTER 7月榜
XIAOMI_
TOP1_
CHINA_46%.
7月も終盤に差し掛かりました。数ヶ月前の常識で「最適なLLM」を選んでいるなら、すでに時代遅れの可能性があります。課題:OpenRouterのランキングはベンチマークではなく、実際の有料トークン消費量を反映しています。1位=最高品質ではありません。結論:7月25日時点で中国ベンダー合計シェアは約46%、Xiaomi Mimo V2.5が日次1.4Tトークンで首位。市場は「低コスト大量処理」と「クローズド高難度タスク」の二極化構造へ移行しています。本記事の構成:Top12表 → ベンダーシェア → 用量≠品質 → Agentアプリ榜 → 価格比較 → 8月予測 → 5ステップ実装 → Mac三層アーキテクチャ。
1. 課題の整理:7月ランキングがルーティング戦略を覆す理由
1)消費量≠品質:低価格モデルは高トラフィックアプリの背後でランキングを押し上げますが、複雑推論ではクローズド旗艦が支出シェアを維持しています。2)月間チャンピオンの頻繁な交代:DeepSeekのベンダーシェアは最も安定(約16%–18%)ですが、モデル首位は MiniMax M2.5 → MiMo-V2-Pro → 現 Mimo V2.5 と入れ替わり続けています。3)見えない市場:ロールプレイ/コンパニオン系アプリがOSSモデル流量の相当部分を占めますが、エンタープライズ報道ではほぼ触れられません。4)最大35倍の価格差:DeepSeek V4 Flash 入力約 $0.05–0.14/M に対し GPT-5.5 は約 $5/M——開発者はコストで投票しています。5)セキュリティが新変数:OpenAIサンドボックス脱出事件以降、ベンダーのセキュリティ実績は選定基準に必須です。
2. 7月モデル トークン消費量 Top 12(2026-07-25時点)
| 順位 | モデル | ベンダー | 日次トークン | 直近30日累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | Tencent | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(無料) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智譜 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 階躍星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新規入榜) |
| 10 | Ling 3.0 Flash | Ant InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
上位10位のうち中国ベンダーモデルは7席。米国陣営は Nemotron、Claude、Gemini が防衛線を維持しています。Kimi K3 の伸びが最も顕著で、7月最大の注目変数です。
3. ベンダーシェア:中国合計約46%、1年前は2%未満
| ベンダー | 地域 | トークンシェア(概算) |
|---|---|---|
| DeepSeek | 🇨🇳 中国 | 16%–18%(多くの集計で第1位) |
| Xiaomi | 🇨🇳 中国 | 8%–18%(Mimo V2.5急伸、変動最大) |
| Anthropic | 🇺🇸 米国 | 10%–15% |
| Tencent | 🇨🇳 中国 | 8%–13% |
| 🇺🇸 米国 | 8%–13% | |
| 智譜 Z.ai | 🇨🇳 中国 | 4%–7% |
| OpenAI | 🇺🇸 米国 | 6%–8% |
中国ベンダー合計約 46%(1年前 <2%)。米国三巨頭合計約 30%–36%(1年前約70%)。過去12ヶ月で最も急峻なシェア移行の一つです。
4. ランキングの裏側:高用量≠高品質、二極化市場の確立
タスク種別の支出金額シェア(トークン量ではなく)を見ると:汎用対話35.7%、Agentワークフロー30.4%、コード26.5%、データ処理7.5%。しかし「分類/複雑推論」の高難度領域では構図が一変——Claude Sonnet 4.6 と Claude Opus 4.7 が各13.5%で並び1位、GPT-5.5が11.6%で3位。総量ランキングを独占する低価格OSSモデルは、ここではほぼ姿を見せません。
7月24日、Anthropicは Claude Opus 5 を発表。FrontierBench v0.1 で 43.3%(GPT-5.6 Sol の37.5%を逆転)、価格は Opus 帯 $5/$25 per M(Fable 5 入力価格の半額)を維持——「高いが、その価値がある」という明確なポジショニングです。
| モデル | 入力/M | 出力/M | ポジション |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | コスパ最強、Agentic Coding推奨 |
| MiniMax M3 | $0.10 | $1.21 | 長コンテキスト多モーダルの予算向け |
| GLM 5.2 | $0.45 | $3.31 | OSS内 Opus 級プランニング品質 |
| Kimi K3 | ~$3 | ~$15 | 1.4TB OSS重み、クローズド級能力 |
| Claude Opus 5 | $5(高速$10) | $25(高速$50) | クローズド旗艦、7月最強ベンチ |
5. アプリ層の秘密:コーディングAgentが覇権、見えない半分はロールプレイ
| 順位 | アプリ | 種別 | シェア(概算) |
|---|---|---|---|
| 1 | Hermes Agent | 個人エージェント/CLI Agent | ~45% |
| 2 | Kilo Code | コーディングAgent | ~13% |
| 3 | OpenClaw | 汎用Agent | ~9% |
| 4 | Claude Code | コーディングAgent | ~6% |
| 5 | Descript | コンテンツ制作 | ~4.5% |
| 7 | Lemonade | コンパニオン/ゲーム | ~2.1%(新規入榜) |
| 8 | ISEKAI ZERO | ロールプレイ | ~2.0%(新規入榜) |
| 10 | Cline | コーディングAgent(IDE拡張) | ~1.7% |
Cline → Roo Code → Kilo Code は同一コード系譜の3回のフォークです。「孫」にあたる Kilo Code が祖先を上回る流量を獲得しています。OpenRouter × a16z『State of AI』によれば、創造的ロールプレイがOSSモデル総用量の半数超を占めます——エンタープライズAI報道だけでは、この半分は見えません。
6. 8月トレンド予測:注視すべき5つのシグナル
- 中国OSSモデル合計シェアは50%突破に向かう見込み——米国ベンダーが積極的な値下げに動かない限り。
- 月間チャンピオンの交代は継続——Xiaomi、DeepSeek、Tencent、智譜、MiniMax、月之暗面の価格競争とイテレーション速度は衰えていません。
- Anthropicは低価格帯モデルを投入する可能性——Opus 5は2ヶ月で4つ目の旗艦(Mythos 5、Fable 5、Sonnet 5に続く)であり、単一突破から全価格帯カバーへ戦略転換しています。
- Kimi K3の1.4TB重みは2–4週間でコミュニティ量子化版が登場する可能性——中小チームの本格導入はその後。現時点の受益者は大手とFireworks AI等の推論クラウドです。
- セキュリティとコンプライアンスが選定変数に——OpenAIサンドボックス脱出、米国「AIキルスイッチ法案」、ホワイトハウス事前審査枠組みにより、「ベンダーセキュリティ評価」が企業スコアカードに正式組み込まれます。
7. 5ステップ実装:タスク種別に基づく階層ルーティング
- チェーン分解とマッピング:雑談/創作/ロールプレイ → DeepSeek V4 Flash / Mimo V2.5。分類/複雑推論/高リスクAgent → Claude Opus 5 / GPT-5.6。
- コスト上限の設定:クローズド旗艦に日次トークン予算を設け、閾値超過時は GLM 5.2 または DeepSeek Flash へ自動ダウングレード。
- 週次で openrouter.ai/rankings を照合:ランキングは日次変動。リリース前に必ずTop10を確認。急騰モデルはプレビュー価格終了と連動することが多い。
- オープンウェイトのローカルバックアップ:GLM 5.2 / Kimi K3 を Mac 上の MLX でオフライン待機。APIレート制限やコンプライアンス切替に対応。
- 20タスク検証セットの構築:同一タスクセットを低価格モデルと旗艦モデルで各実行し、通過率とタスク単価を記録。チームSOPに反映。
8. 深層洞察:capability と popularity の分岐
7月ランキングで最も記憶すべき一文:能力(capability)と流行度(popularity)は分岐しつつある。中国OSSモデルは価格で流量の半分を獲得——DeepSeek V4 Flash と GPT-5.5 の価格差は約35倍。日常タスクの80–90%が「十分」なら、請求データは嘘をつきません。米国クローズド旗艦は高難度タスクの価格決定力を維持:Claude Opus 5 の FrontierBench 43.3%、および Anthropic の比較的クリーンなセキュリティ実績が、企業のプレミアム支払いの根拠です。
アプリ層の物語も深刻です。Hermes Agent がアプリトークンシェア 45% で独走し、コーディングAgentファミリー(Kilo Code、OpenClaw、Claude Code、Cline)がランキングの大半を占めます。Mac開発者にとって、ルーティング表は「モデル」だけでなく「アプリワークロード」でも分ける必要があります——Cursorの補完チェーン、OpenClawのAgentチェーン、Hermesの自己反復チェーンでは、最適モデルIDがまったく異なります。
日本のチーム向け補足:OpenRouterの平均レイテンシは約180–250msで、日本向けインボイスは提供されていません。本番環境では国内準拠のAPIプロキシを検討してください。OpenRouterは「技術検証サンドボックス」とマルチモデルA/B比較に最適です。
9. まとめ:階層ルーティング + Mac統一メモリの三層アーキテクチャ
Windows/Linuxクラウドサーバーでも OpenRouter API は呼べますが、ローカルMLX推論、Cursorツールチェーン連携、7×24 Agent常駐、グラフィックワークフローでは Apple Silicon Mac に及びません。「DeepSeek 50セント vs Claude 10ドル/時」のコスト差に揺られつつ、予測可能なローカルバックアップとリモートピーク分流が必要なら、三層構成を推奨します:ローカルMLXで GLM 5.2 / Kimi K3 を日常処理、OpenRouter APIで Opus 5 と DeepSeek Flash をシーン別ルーティング、MACGPUリモートMacノードで夜間バッチAgentと統一メモリ逼迫の長コンテキストタスクを処理——8月のモデル潮到来前に、制御可能な算力が最良のヘッジです。