Рейтинг OpenRouter июнь 2026 в деталях:
китайские модели захватывают developer-трафик — на кого ставить во второй половине года?

Июнь 2026 даёт жёсткие сигналы: Claude Fable 5 снят глобально из-за export controls, у OpenAI и Anthropic — IPO-намерения, а доля китайских моделей на OpenRouter превысила 60%. Выбор по рамке 2025 года — решения на устаревших допущениях.

Статья для разработчиков и tech-лидеров на Mac с agent-, CLI- или hybrid API-workflows. На базе реального трафика OpenRouter июнь 2026, Artificial Analysis Intelligence Index и SWE-bench Pro — полные рейтинги компаний и моделей, годовой сдвиг долей, слой качества vs объёма, матрица сценариев, прогнозы Q3 2026, пять макротрендов и чеклист из шести шагов для model-agnostic архитектуры. После прочтения: что значат цифры, за какие задачи платить premium и как ставить во второй половине года без привязки к недельному рейтингу.

01 Как читать рейтинг OpenRouter: три ошибки, ведущие к неверному выбору модели

OpenRouter агрегирует реальные API-вызовы миллионов разработчиков — не самооценку вендоров, а голосование кодом. Одна из самых показательных источников реального использования моделей. Перед интерпретацией июня — три частые ошибки:

  • Недельный объём токенов как «сильнейшая модель»: рейтинг измеряет интенсивность production-вызовов, не потолок одной инференции. Ежедневные completion, перевод и summary системно поднимают cost-efficient модели — это не обязательно совпадает с вершиной SWE-bench.
  • Китайская доля как «локальный эхо-чембер»: пользователи OpenRouter глобальны — США, Европа, Индия. DeepSeek, Xiaomi и MiniMax выбирают потому что дёшево, быстро и достаточно — экономика, не геополитика.
  • Hard-bind к одному вендору: в июне параллельно delisting Fable 5, IPO-слухи и плотное Q3-release окно. Сегодняшний лидер через три месяца может смениться — model-agnostic routing layer ценнее вопроса «кто сильнейший».

Ключевой тезис: OpenRouter отвечает «кто несёт ежедневный token bill»; quality rankings — «кто заслуживает premium за самые сложные 5%». Читать раздельно.

Официальные рейтинги и live-данные:

https://openrouter.ai/rankings

https://artificialanalysis.ai/

02 OpenRouter июнь 2026 полностью: рейтинги компаний и моделей

Данные на июнь 2026: измерение по компаниям — недельный объём токенов; по моделям — дневной объём Top 10 (актуальные rolling values на сайте OpenRouter).

По компаниям (недельный объём токенов, июнь 2026)
Ранг Компания Происхождение Недельные токены Доля рынка
1 DeepSeek Китай 5,13T 17,6%
2 Anthropic США 4,34T 14,8%
3 Google США 3,66T 12,5%
4 OpenAI США 2,46T 8,4%
5 Xiaomi Китай 2,42T 8,3%
6 MiniMax Китай 2,37T 8,1%
7 Tencent Китай 2,36T 8,1%
8 Alibaba Qwen Китай 1,26T 4,3%

Указанные китайские вендоры в Top 10 суммарно ~46%; с учётом всех китайских моделей на платформе доля превышает 60%.

По моделям (дневной объём токенов Top 10)
Ранг Модель Вендор Дневные токены
1 DeepSeek V4 Flash DeepSeek 619B
2 Hy3 Preview Tencent 451B
3 MiniMax M3 MiniMax 447B
4 MiMo-V2.5 Xiaomi 327B
5 DeepSeek V4 Pro DeepSeek 300B
6 Claude Opus 4.7 Anthropic 263B
7 Claude Opus 4.8 Anthropic ~200B
8 Claude Sonnet 4.6 Anthropic 178B
9 Gemini 3 Flash Preview Google 156B
10 Kimi K2.6 Moonshot AI ~150B

Рейтинг отражает не только популярность — какой модели глобальные разработчики доверяют в production для ежедневного token bill.

03 Год перемен: доля US-моделей на OpenRouter с 70% до 30%

Bloomberg цитирует данные OpenRouter и Exponential View:

  • Июнь 2025: US-модели (Google + OpenAI + Anthropic) ~70% token share на OpenRouter
  • Июнь 2026: та же дефиниция ~30%

Исчезнувшие 40 процентных пунктов почти полностью ушли китайским open-weight и cost-efficient closed-source моделям. Разработчик из Сан-Диего формулирует так:

«С Claude кодить — около $10 в час. С DeepSeek — меньше 50 центов.»

Три причины высокой китайской доли:

  1. Цена: MiniMax M3 API ~$0,60/M input tokens — примерно 1/8 от Claude Opus 4.8 ($5,00/M)
  2. Достаточно: для coding assist, completion, перевода и summary китайские модели часто дают 80–90% top quality
  3. Open weight: DeepSeek V4, MiniMax M3 и др. позволяют on-prem deployment — снижение privacy risk

Разработчик из Далласа описывает типичный hybrid stack: «Сложные задачи ~$500/мес Claude + ChatGPT; 90% ежедневного coding и speech recognition MiniMax + Kimi + MiMo, ~$200.» — routing по сложности, оптимизация по cost — норма 2026.

04 «Объём №1» ≠ «качество №1»: Claude Opus 4.8 держит потолок

По Artificial Analysis Intelligence Index (конец мая 2026) и field tests:

Общее качество и coding benchmarks (выборка)
Модель Индекс качества SWE-bench Pro Примечание
Claude Opus 4.8 61,4 (#1) 69,2% Long context и agent tasks лидируют
GPT-5.5 59–60 63,1% Экосистема и tool calls быстры
Gemini 3.1 Pro 57 Силён в hard reasoning
Qwen 3.7 Max 57 Китайский closed-source frontier
Claude Sonnet 4.6 80,8% (Verified) Сильны writing и instruction following

Инженер сравнил 20 одинаковых задач: Claude Opus 4.8 выиграл 16, GPT-5.5 — пять, Gemini 3.1 Pro — четыре; на long context Opus доминирует.

Также Claude Fable 5: максимальная quality rating (100/100), SWE-bench Verified ~95%, но глобально снят середина июня 2026 из-за export controls — статус неясен. US frontier всё ещё лидирует по чистой capability, но accessibility и compliance перестраивают supply.

Ясная стратегия: closed-source frontier для самых сложных 5%, китайские open-weight — для оставшихся 95% daily volume.

05 Выбор по сценариям и пять макротрендов на H2 2026

Быстрый выбор по сценарию (июнь 2026)
Сценарий Рекомендуемая модель Обоснование
Сложный код / agent Claude Opus 4.8 Общее качество #1, long context
Ежедневный coding assist DeepSeek V4 Flash / MiMo-V2.5 Отличное соотношение цена/качество, быстро
Максимально эффективный API MiniMax M3 $0,60/M, open weight, on-prem возможен
Long context Kimi K2.6 (1M context) Очень длинное окно, разумная цена
Google-экосистема Gemini 3.5 Flash Нативная интеграция Google Workspace
Real-time web search Grok 4.3 Live-контент X/Twitter
Локальный self-hosting GLM 5.2 / Kimi K2.6 Top open-weight модели
Генерация изображений ChatGPT Images 2.0 Сильнейший text rendering

Q3 2026 вероятно станет самым плотным кварталом релизов в истории AI. Подтверждено или высоковероятно:

Прогнозы релизов Q3 2026 (высокая уверенность)
Модель Вендор Ожидаемая дата Ключевой фокус
GPT-6 OpenAI авг.–сент. 2026 Слух 1,5M token context, сильнее agents
Claude Opus 5 Anthropic около сент. 2026 Long-running agent tasks переработаны
Gemini 4 Google Q3 2026 Multimodal upgrade, video и audio
DeepSeek V5 DeepSeek Q3 2026 Open weight, параметры возможно >1T
GLM 5.2 Z.ai Уже выпущен Top open weight, сильный coding

Пять макротрендов:

  • Ось конкуренции от «кто сильнейший» к «кто подходит сценарию»: пять labs релизят за ~90 дней — единого «лучшего модели» больше нет.
  • Китайская доля растёт, enterprise compliance — потолок: individual adoption без торможения; Fortune 500 procurement под data security и US Congress pressure.
  • Agents — настоящее поле боя: Anthropic State of AI Agents 2026: ~44% Claude API calls — math и CS; SWE-bench Pro и long-run stability решают enterprise budgets.
  • Двойное IPO OpenAI и Anthropic: слухи июня 2026 переоценивают сектор; listing pressure может сделать pricing прозрачнее и ускорить price war с Китаем.
  • Local inference пробьёт consumer hardware threshold: к 2027 local models на 32GB consumer GPU могут превысить 80% SWE-bench coding bar и disrupt routine API market.

US-вендоры реагируют по-разному: OpenAI — ecosystem bet; Anthropic — quality leadership; Google — speed и multimodal. Средняя позиция «не плохо, но дорого» исчезает — маржи на model layer сжимаются.

06 Шесть шагов model-agnostic архитектуры: данные и CALMVPS wrap-up

  1. Регистрация OpenRouter и cost dashboard: API key, теги по модели/проекту; еженедельно сверять Rankings с token flow — не застревать на устаревшем default model.
  2. Определить task-tier routing: Tier-0 (completion/summary), Tier-1 (multi-file refactor), Tier-2 (long-run agent); Tier-0 → DeepSeek V4 Flash / MiMo, Tier-2 → Claude Opus 4.8.
  3. CLI tools с переключаемой model config: Claude Code, Kilo Code, Hermes Agent, Aider поддерживают OpenRouter model IDs через env или config — без hardcoded endpoint.
  4. On-prem path для open weight: для compliance-sensitive data оценить MiniMax M3, DeepSeek V4, GLM 5.2 on-prem; на Mac — Ollama / LM Studio как offline fallback.
  5. 7×24 orchestration на Mac: Agent Gateway, batch jobs и SSH tunnels не должны зависеть от закрытого laptop; launchd или bare-metal Mac для постоянного routing и logging.
  6. Q3 release calendar и A/B windows: GPT-6, Opus 5, Gemini 4, DeepSeek V5 ожидаются авг.–сент.; shadow traffic и rollback switches до release weeks.
  • DeepSeek weekly tokens: ~5,13T, OpenRouter company #1, 17,6% share
  • US three labs combined: июнь 2025 ~70% → июнь 2026 ~30%
  • Claude Opus 4.8 Intelligence Index: 61,4, overall #1; MiniMax M3 pricing ~1/8 Opus 4.8
  • Claude API agent share: math/CS ~44% (Anthropic State of AI Agents 2026)
  • DeepSeek V4 Flash daily: ~619B, model ranking #1

Июньские данные OpenRouter — не «Китай победил», а переписанная экономика model layer: DeepSeek в начале 2025 показал, что frontier performance не требует frontier compute; Xiaomi, Tencent, MiniMax и Moonshot обрушили base pricing. Ценнее всего — архитектура с мгновенной сменой моделей: сегодняшний лидер через три месяца может смениться.

На Mac hybrid routing ломается на альтернативах: MacBook sleep рвёт agent и OpenRouter callbacks; Linux VPS без macOS-native agent sandboxes; virtual Mac с Metal и permission gaps; покупка Mac Studio — procurement cycle и depreciation. Для 7×24 stability и elastic M4/M4 Pro configs per project в agent orchestration и iOS CI аренда bare-metal Mac CALMVPS даёт dedicated Apple Silicon, provisioning ~120 секунд и flexible day/week/month/quarter billing — routing на бодрствующем production macOS, пока вы выбираете модели по OpenRouter. Цены: цены аренды, эксплуатация: центр помощи, заказ: оформить заказ Mac mini M4.