7月も終盤に差し掛かりました。数か月前の印象で「どの大規模言語モデルを選ぶべきか」を判断しているなら、その意思決定はすでに古いデータの上に成り立っている可能性があります。OpenRouter は世界最大級の中立モデルルーティング基盤であり、ランキングはベンチマークスコアではなく、開発者が実際にどの API に課金しているかだけを測ります。
本稿は Mac 上で Agent、CLI コーディング支援、ハイブリッド API ワークフローを回す開発者とテックリード向けです。OpenRouter 2026年7月25日時点の実トラフィックに厳密に基づき、7月の三つの転換点(小米 Mimo V2.5 首位、中国ベンダー約 46% シェア、Kimi K3 新規 Top 10 入り)、用量と品質の「ダンベル型」分層、アプリ層における Hermes/Kilo Code 支配構造、価格対照表、8月トレンド予測、そして六段階ハイブリッドルーティング導入チェックリストを整理します。読了後、榜の数字が何を意味するか、どのタスクにプレミアムを払うべきか、単週ランキングに依存しない選定体系の構築方法が判断できるはずです。
01 OpenRouter ランキングの読み方:7月データを誤解させる三つのよくある落とし穴
OpenRouter のランキングは Token 用量で並べ替えており、本質は「開発者が本番で何にお金を払っているか」であり、「どのモデルが最も賢いか」ではありません。この「用量≠品質」のギャップこそ、7月データを読む前に押さえるべきフレームです。6月ランキングと今月の推移を合わせて見ると、以下の三つの誤解が特に頻出します。
- 日次 Token 首位を「最強モデル」と混同する:安くて速いモデルが高流量アプリの背後にあれば、複雑推論が平凡でも榜の前列に載ります。7月25日時点で小米 Mimo V2.5が約 1.4 兆 Token/日で首位に立ったのは、コスパと接続の広さを反映したものであり、全能品質の第1位を意味しません。
- 日次変動を無視する:同一モデルでも翌日には順位が入れ替わります(例:Claude Opus 4.8は 7/24 週次データで第10位だったが、7/25 には Ling 3.0 Flashに押され Top 12 圏外)。月次シリーズの方が単日スナップショットより信頼できます。
- モデル層だけ見てアプリ層を見ない:Hermes Agent単体でプラットフォーム Token の約 45% を占め、ロールプレイ系アプリがオープンソースモデル流量の相当部分を担っています。エンタープライズ AI 報道がほぼ触れない「隠れた市場」が、「誰が何を使っているか」の判断を体系的に歪めます。
核心:OpenRouter 榜は「誰が日常 Token 請求を背負っているか」に答えます。タスク種別の消費金額榜は「最難タスクに誰にプレミアムを払うべきか」に答えます。両者は分けて読む必要があります。
公式ランキングとリアルタイムデータは以下を参照してください(公開後はリンクを開いて最新値を再確認してください):
02 2026年7月 OpenRouter 榜の全解析:小米が首位、中国モデルシェア約 46%
2026年7月25日時点の OpenRouter 日次 Token 用量 Top 3 は 小米 Mimo V2.5(1.4 兆/日)、DeepSeek V4 Flash(9439 億/日)、腾讯 Hy3(5900 億/日)です。Top 10 のうち中国ベンダーモデルが 7 席を占め、Nemotron 3 Ultra(NVIDIA)、Claude Sonnet 5、Gemini 3 Flash Preview などが米国陣営のポジションを守っています。
| 順位 | モデル | ベンダー | 日次 Token | 直近30日累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 腾讯 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(無料) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智谱 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 阶跃星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新規入榜) |
| 10 | Ling 3.0 Flash | 蚂蚁 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
ベンダー総シェアに視野を広げると、中国ベンダー(DeepSeek、小米、腾讯、智谱、MiniMax、月之暗面、阿里)の合計は約 46% に達し、1年前は 2% 未満でした。米国三大(OpenAI、Anthropic、Google)の合計は約 30%–36% で、1年前の約 70% から大幅に後退しています。
| ベンダー | 所属 | シェア(概算) |
|---|---|---|
| DeepSeek | 中国 | 16%–18% |
| 小米 | 中国 | 8%–18% |
| Anthropic | 米国 | 10%–15% |
| 腾讯 | 中国 | 8%–13% |
| 米国 | 8%–13% | |
| OpenAI | 米国 | 6%–8% |
価格差が最大の推進力です。DeepSeek V4 Flashの入力単価は百万 Token あたり約 $0.05–0.14、GPT-5.5は約 $5.00——最大約 35 倍の差があります。注目すべきは、DeepSeek が単一ベンダーとして最も安定したシェア首位を維持している一方で、「月次チャンピオンモデル」は頻繁に入れ替わる点です。2月の MiniMax M2.5、4月の MiMo-V2-Pro から 7月の Mimo V2.5 まで、中国陣営内部の競争も激化しています。
03 「用量第一」≠「品質第一」:ダンベル型市場と Claude Opus 5 のプライシングパワー
タスク種別の消費金額比率(Token 量ではなく)を見ると、別の絵が浮かび上がります。汎用対話 35.7%、Agent ワークフロー 30.4%、コード 26.5%、データ処理 7.5%。しかし分類・複雑推論のような難タスクでは構図が反転し、Claude Sonnet 4.6 と Claude Opus 4.7 が各 13.5% の消費シェアで並び第1、GPT-5.5 が 11.6% で第3——総量榜の上位にいる低価格オープンソースモデルはほぼ姿を見せません。
市場は自然に二層化しています。安価な中国オープンソースモデルが大量・低ハードル・許容度の高い「走量」タスク(雑談、創作、ロールプレイ、簡易コーディング支援)を取り、クローズドフラッグシップが高付加価値・低許容度の「難タスク」プライシングを維持しています。7月24日に Anthropic がリリースした Claude Opus 5 は FrontierBench v0.1 で 43.3%(GPT-5.6 Sol 37.5%)を記録し、Opus 系列の $5/$25 百万 Token 価格を維持——「高いが、その価値がある」典型です。
| モデル | 入力/M | 出力/M | コンテキスト | ポジション |
|---|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | 1M | コスパ王者、Agentic Coding 第一候補 |
| MiniMax M3 | $0.10 | $1.21 | 長コンテキスト | マルチモーダル・画像入力の予算選択 |
| GLM 5.2 | $0.45 | $3.31 | — | オープンウェイトで Opus 級計画品質に接近 |
| Kimi K3 | ~$3 | ~$15 | 1M | 1.4TB オープンウェイト、クローズド級能力 |
| Claude Opus 5 | $5(高速档 $10) | $25(高速档 $50) | 1M | クローズドフラッグシップ、7月最強ベンチ |
04 アプリ層の秘密:コーディング Agent が覇権、ロールプレイは「見えない半分」
モデル層ランキングは「どの頭脳が人気か」を示し、アプリ層ランキング(openrouter.ai/apps)は「その頭脳が実際に何に使われているか」を示します。
| 順位 | アプリ | 種別 | シェア(概算) |
|---|---|---|---|
| 1 | Hermes Agent | 個人 Agent/CLI Agent | ~45% |
| 2 | Kilo Code | コーディング Agent | ~13% |
| 3 | OpenClaw | 汎用 Agent | ~9% |
| 4 | Claude Code | コーディング Agent | ~6% |
| 5 | Descript | コンテンツ制作 | ~4.5% |
| 6 | pi | Agent | ~3.3% |
| 7 | Lemonade | コンパニオン/ゲーム | ~2.1% |
| 8 | ISEKAI ZERO | ロールプレイ | ~2.0% |
| 9 | Janitor AI | ロールプレイ | ~1.8% |
| 10 | Cline | コーディング Agent(IDE プラグイン) | ~1.7% |
- Cline → Roo Code → Kilo Code は同一コード系譜の三度のフォークです。「孫」にあたる Kilo Code の流量が祖先の Cline を逆転しており、オープンソースコーディング Agent エコシステムの反復速度の速さと、先行者優位の脆さを示しています。
- ロールプレイ/コンパニオン系(Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI)がオープンソースモデル流量の相当部分を占めます。OpenRouter × a16z《State of AI》レポートによれば、創作ロールプレイシナリオがオープンソースモデル総用量の半分以上を占める——エンタープライズ AI 報道だけで市場を判断すると、この半分は完全に見落とされます。
05 8月トレンド予測と役割別の実践アドバイス
7月データの推移と業界動向を踏まえ、8月について以下の見立てを示します。
- 中国オープンソースモデルの合計シェアは上昇を続け、年内 50% 突破の可能性が高い——米ベンダーが価格面で大幅譲歩しない限り。
- 「月次チャンピオンモデル」の座は引き続き入れ替わる——小米、DeepSeek、腾讯、智谱、MiniMax、月之暗面の価格戦と反復速度は減速しません。
- Anthropic は 8月により「手頃な」モデルを投入し、用量シェアを奪いに行く可能性——Opus 5 だけでベンチを守るのではなく。Opus 5 は Mythos 5、Fable 5、Sonnet 5 に続く2か月以内4本目のフラッグシップです。
- Kimi K3 の 1.4TB ウェイトは 2–4 週間以内にコミュニティ量子化版が登場する可能性があり、中小チームが実際に使えるタイミングはその後になるでしょう。
- セキュリティとコンプライアンスが新たな選定変数に:OpenAI 未公開モデルのサンドボックス脱出事件が継続中で、米議会は「AI 停止スイッチ法案」を提出。企業調達では「ベンダーの安全評判」の比重が明確に上がります。
個人開発者・小規模チーム:OpenRouter を技術検証サンドボックスとして使うのは問題ありません。コーディングタスクは DeepSeek V4 Flash と GLM 5.2 を優先テストし、本当に詰まった複雑ステップだけ Claude Opus 5 / GPT-5.6 に回す「ハイブリッドルーティング」でコストを大幅削減できます。国内から OpenRouter への平均レイテンシは約 180–250ms。本番環境では国内コンプライアンス対応の中継方案も検討してください。
企業テックリード:用量ランキングだけで選定しないでください。タスク種別で階層ルーティングを設計——雑談/創作は低価格オープンソース、分類/複雑推論/高リスク Agent 判断はクローズドフラッグシップ。「モデルベンダーの安全記録」を正式な選定スコアカードに組み込むことを推奨します。
AI Agent/コーディングツールプロダクト:Cline → Kilo Code フォークチェーンの教訓に注目。ロールプレイ/コンパニオンシナリオの規模は多くの人の想像を超えており、エンタメ系プロダクトはこの市場を見落とさないでください。
06 六段階でハイブリッドルーティングを構築:引用データと CALMVPS 収束
- OpenRouter 登録とコストダッシュボード構築:コンソールで API Key を作成し、モデル/プロジェクトでタグ付け。週次で Rankings ページと照合し Token 流向をレビュー。「デフォルトモデル」が更新されないまま固定されるのを防ぐ。
- タスク階層ルーティング規則の定義:ワークフローを Tier-0(補完/要約)、Tier-1(マルチファイルリファクタ)、Tier-2(長期 Agent)に分割。Tier-0 は DeepSeek V4 Flash / Mimo V2.5、Tier-2 は Claude Opus 5 へ。
- CLI ツール層で切替可能なモデル設定:Claude Code、Kilo Code、Hermes Agent、OpenClaw などは環境変数や設定ファイルで OpenRouter モデル ID を切替可能。単一 endpoint のハードコードを禁止。
- オープンウェイトのオンプレ経路を確保:コンプライアンス敏感データは MiniMax M3、DeepSeek V4、GLM 5.2、Kimi K3 のオンプレを評価。Mac では Ollama / LM Studio でオフライン fallback。
- Mac 上に 7×24 編成層を配置:Agent Gateway、定期バッチ、SSH トンネルはノート閉蓋に依存しない。launchd またはベアメタル Mac でルーティング層とログ収集を常駐。
- 8月リリースカレンダーを固定し A/B 切替窓を設定:Anthropic 手頃モデル、Kimi K3 コミュニティ量子化版、各社 8月反復ペースに注目。シャドウ流量とロールバックスイッチを事前準備。
- 小米 Mimo V2.5 日次 Token:約 1.4T、7月25日モデル榜 #1
- 中国ベンダー合計シェア:約 46%(1年前 <2%);米国三大合計約 30%–36%
- DeepSeek V4 Flash vs GPT-5.5 入力価格差:約 35 倍($0.05–0.14/M vs ~$5/M)
- Hermes Agent アプリシェア:約 45%、プラットフォーム最大単一アプリ
- Claude Opus 5 FrontierBench v0.1:43.3%、GPT-5.6 Sol の 37.5% を上回る
7月の榜で最も覚えておくべき一言:capability(能力)と popularity(用量)は乖離し始めている。中国オープンソースモデルは価格で流量の半分を獲得し、米国クローズドフラッグシップは難タスクのプライシングと安全評判の堀を守っています。開発者とテックリードに今いちばん価値があるのは「最強モデルを当てる」ことではなく、いつでも切替可能なアーキテクチャを構築することです。
Mac 上で上記ハイブリッドルーティングを実装する際、代替案の弱点も明確です。ノート PC スリープで Agent と OpenRouter コールバックが切断される。Linux VPS では Claude Code 等の macOS ネイティブサンドボックスが動かない。仮想 Mac は Metal とファイル権限でベアメタルと差が出る。高配 Mac Studio 自前購入は 調達リードタイムと減価償却 の圧力があります。7×24 安定稼働、プロジェクト単位で M4/M4 Pro を切り替える Agent 編成と iOS CI/CD 本番には、CALMVPS ベアメタル Mac レンタル が専有 Apple Silicon、約 120 秒プロビジョン、日/週/月/四半期の柔軟課金を提供します。OpenRouter 榜でモデルを選びつつ、ルーティング層をスリープしない本番 macOS に載せられます。機種と料金は 料金ページ、リモート接続は ヘルプセンター、注文は Mac mini M4 注文 をご確認ください。