Июнь 2026 даёт жёсткие сигналы: Claude Fable 5 снят глобально из-за export controls, у OpenAI и Anthropic — IPO-намерения, а доля китайских моделей на OpenRouter превысила 60%. Выбор по рамке 2025 года — решения на устаревших допущениях.
Статья для разработчиков и tech-лидеров на Mac с agent-, CLI- или hybrid API-workflows. На базе реального трафика OpenRouter июнь 2026, Artificial Analysis Intelligence Index и SWE-bench Pro — полные рейтинги компаний и моделей, годовой сдвиг долей, слой качества vs объёма, матрица сценариев, прогнозы Q3 2026, пять макротрендов и чеклист из шести шагов для model-agnostic архитектуры. После прочтения: что значат цифры, за какие задачи платить premium и как ставить во второй половине года без привязки к недельному рейтингу.
01 Как читать рейтинг OpenRouter: три ошибки, ведущие к неверному выбору модели
OpenRouter агрегирует реальные API-вызовы миллионов разработчиков — не самооценку вендоров, а голосование кодом. Одна из самых показательных источников реального использования моделей. Перед интерпретацией июня — три частые ошибки:
- Недельный объём токенов как «сильнейшая модель»: рейтинг измеряет интенсивность production-вызовов, не потолок одной инференции. Ежедневные completion, перевод и summary системно поднимают cost-efficient модели — это не обязательно совпадает с вершиной SWE-bench.
- Китайская доля как «локальный эхо-чембер»: пользователи OpenRouter глобальны — США, Европа, Индия. DeepSeek, Xiaomi и MiniMax выбирают потому что дёшево, быстро и достаточно — экономика, не геополитика.
- Hard-bind к одному вендору: в июне параллельно delisting Fable 5, IPO-слухи и плотное Q3-release окно. Сегодняшний лидер через три месяца может смениться — model-agnostic routing layer ценнее вопроса «кто сильнейший».
Ключевой тезис: OpenRouter отвечает «кто несёт ежедневный token bill»; quality rankings — «кто заслуживает premium за самые сложные 5%». Читать раздельно.
Официальные рейтинги и live-данные:
02 OpenRouter июнь 2026 полностью: рейтинги компаний и моделей
Данные на июнь 2026: измерение по компаниям — недельный объём токенов; по моделям — дневной объём Top 10 (актуальные rolling values на сайте OpenRouter).
| Ранг | Компания | Происхождение | Недельные токены | Доля рынка |
|---|---|---|---|---|
| 1 | DeepSeek | Китай | 5,13T | 17,6% |
| 2 | Anthropic | США | 4,34T | 14,8% |
| 3 | США | 3,66T | 12,5% | |
| 4 | OpenAI | США | 2,46T | 8,4% |
| 5 | Xiaomi | Китай | 2,42T | 8,3% |
| 6 | MiniMax | Китай | 2,37T | 8,1% |
| 7 | Tencent | Китай | 2,36T | 8,1% |
| 8 | Alibaba Qwen | Китай | 1,26T | 4,3% |
Указанные китайские вендоры в Top 10 суммарно ~46%; с учётом всех китайских моделей на платформе доля превышает 60%.
| Ранг | Модель | Вендор | Дневные токены |
|---|---|---|---|
| 1 | DeepSeek V4 Flash | DeepSeek | 619B |
| 2 | Hy3 Preview | Tencent | 451B |
| 3 | MiniMax M3 | MiniMax | 447B |
| 4 | MiMo-V2.5 | Xiaomi | 327B |
| 5 | DeepSeek V4 Pro | DeepSeek | 300B |
| 6 | Claude Opus 4.7 | Anthropic | 263B |
| 7 | Claude Opus 4.8 | Anthropic | ~200B |
| 8 | Claude Sonnet 4.6 | Anthropic | 178B |
| 9 | Gemini 3 Flash Preview | 156B | |
| 10 | Kimi K2.6 | Moonshot AI | ~150B |
Рейтинг отражает не только популярность — какой модели глобальные разработчики доверяют в production для ежедневного token bill.
03 Год перемен: доля US-моделей на OpenRouter с 70% до 30%
Bloomberg цитирует данные OpenRouter и Exponential View:
- Июнь 2025: US-модели (Google + OpenAI + Anthropic) ~70% token share на OpenRouter
- Июнь 2026: та же дефиниция ~30%
Исчезнувшие 40 процентных пунктов почти полностью ушли китайским open-weight и cost-efficient closed-source моделям. Разработчик из Сан-Диего формулирует так:
«С Claude кодить — около $10 в час. С DeepSeek — меньше 50 центов.»
Три причины высокой китайской доли:
- Цена: MiniMax M3 API ~$0,60/M input tokens — примерно 1/8 от Claude Opus 4.8 ($5,00/M)
- Достаточно: для coding assist, completion, перевода и summary китайские модели часто дают 80–90% top quality
- Open weight: DeepSeek V4, MiniMax M3 и др. позволяют on-prem deployment — снижение privacy risk
Разработчик из Далласа описывает типичный hybrid stack: «Сложные задачи ~$500/мес Claude + ChatGPT; 90% ежедневного coding и speech recognition MiniMax + Kimi + MiMo, ~$200.» — routing по сложности, оптимизация по cost — норма 2026.
04 «Объём №1» ≠ «качество №1»: Claude Opus 4.8 держит потолок
По Artificial Analysis Intelligence Index (конец мая 2026) и field tests:
| Модель | Индекс качества | SWE-bench Pro | Примечание |
|---|---|---|---|
| Claude Opus 4.8 | 61,4 (#1) | 69,2% | Long context и agent tasks лидируют |
| GPT-5.5 | 59–60 | 63,1% | Экосистема и tool calls быстры |
| Gemini 3.1 Pro | 57 | — | Силён в hard reasoning |
| Qwen 3.7 Max | 57 | — | Китайский closed-source frontier |
| Claude Sonnet 4.6 | — | 80,8% (Verified) | Сильны writing и instruction following |
Инженер сравнил 20 одинаковых задач: Claude Opus 4.8 выиграл 16, GPT-5.5 — пять, Gemini 3.1 Pro — четыре; на long context Opus доминирует.
Также Claude Fable 5: максимальная quality rating (100/100), SWE-bench Verified ~95%, но глобально снят середина июня 2026 из-за export controls — статус неясен. US frontier всё ещё лидирует по чистой capability, но accessibility и compliance перестраивают supply.
Ясная стратегия: closed-source frontier для самых сложных 5%, китайские open-weight — для оставшихся 95% daily volume.
05 Выбор по сценариям и пять макротрендов на H2 2026
| Сценарий | Рекомендуемая модель | Обоснование |
|---|---|---|
| Сложный код / agent | Claude Opus 4.8 | Общее качество #1, long context |
| Ежедневный coding assist | DeepSeek V4 Flash / MiMo-V2.5 | Отличное соотношение цена/качество, быстро |
| Максимально эффективный API | MiniMax M3 | $0,60/M, open weight, on-prem возможен |
| Long context | Kimi K2.6 (1M context) | Очень длинное окно, разумная цена |
| Google-экосистема | Gemini 3.5 Flash | Нативная интеграция Google Workspace |
| Real-time web search | Grok 4.3 | Live-контент X/Twitter |
| Локальный self-hosting | GLM 5.2 / Kimi K2.6 | Top open-weight модели |
| Генерация изображений | ChatGPT Images 2.0 | Сильнейший text rendering |
Q3 2026 вероятно станет самым плотным кварталом релизов в истории AI. Подтверждено или высоковероятно:
| Модель | Вендор | Ожидаемая дата | Ключевой фокус |
|---|---|---|---|
| GPT-6 | OpenAI | авг.–сент. 2026 | Слух 1,5M token context, сильнее agents |
| Claude Opus 5 | Anthropic | около сент. 2026 | Long-running agent tasks переработаны |
| Gemini 4 | Q3 2026 | Multimodal upgrade, video и audio | |
| DeepSeek V5 | DeepSeek | Q3 2026 | Open weight, параметры возможно >1T |
| GLM 5.2 | Z.ai | Уже выпущен | Top open weight, сильный coding |
Пять макротрендов:
- Ось конкуренции от «кто сильнейший» к «кто подходит сценарию»: пять labs релизят за ~90 дней — единого «лучшего модели» больше нет.
- Китайская доля растёт, enterprise compliance — потолок: individual adoption без торможения; Fortune 500 procurement под data security и US Congress pressure.
- Agents — настоящее поле боя: Anthropic State of AI Agents 2026: ~44% Claude API calls — math и CS; SWE-bench Pro и long-run stability решают enterprise budgets.
- Двойное IPO OpenAI и Anthropic: слухи июня 2026 переоценивают сектор; listing pressure может сделать pricing прозрачнее и ускорить price war с Китаем.
- Local inference пробьёт consumer hardware threshold: к 2027 local models на 32GB consumer GPU могут превысить 80% SWE-bench coding bar и disrupt routine API market.
US-вендоры реагируют по-разному: OpenAI — ecosystem bet; Anthropic — quality leadership; Google — speed и multimodal. Средняя позиция «не плохо, но дорого» исчезает — маржи на model layer сжимаются.
06 Шесть шагов model-agnostic архитектуры: данные и CALMVPS wrap-up
- Регистрация OpenRouter и cost dashboard: API key, теги по модели/проекту; еженедельно сверять Rankings с token flow — не застревать на устаревшем default model.
- Определить task-tier routing: Tier-0 (completion/summary), Tier-1 (multi-file refactor), Tier-2 (long-run agent); Tier-0 → DeepSeek V4 Flash / MiMo, Tier-2 → Claude Opus 4.8.
- CLI tools с переключаемой model config: Claude Code, Kilo Code, Hermes Agent, Aider поддерживают OpenRouter model IDs через env или config — без hardcoded endpoint.
- On-prem path для open weight: для compliance-sensitive data оценить MiniMax M3, DeepSeek V4, GLM 5.2 on-prem; на Mac — Ollama / LM Studio как offline fallback.
- 7×24 orchestration на Mac: Agent Gateway, batch jobs и SSH tunnels не должны зависеть от закрытого laptop; launchd или bare-metal Mac для постоянного routing и logging.
- Q3 release calendar и A/B windows: GPT-6, Opus 5, Gemini 4, DeepSeek V5 ожидаются авг.–сент.; shadow traffic и rollback switches до release weeks.
- DeepSeek weekly tokens: ~5,13T, OpenRouter company #1, 17,6% share
- US three labs combined: июнь 2025 ~70% → июнь 2026 ~30%
- Claude Opus 4.8 Intelligence Index: 61,4, overall #1; MiniMax M3 pricing ~1/8 Opus 4.8
- Claude API agent share: math/CS ~44% (Anthropic State of AI Agents 2026)
- DeepSeek V4 Flash daily: ~619B, model ranking #1
Июньские данные OpenRouter — не «Китай победил», а переписанная экономика model layer: DeepSeek в начале 2025 показал, что frontier performance не требует frontier compute; Xiaomi, Tencent, MiniMax и Moonshot обрушили base pricing. Ценнее всего — архитектура с мгновенной сменой моделей: сегодняшний лидер через три месяца может смениться.
На Mac hybrid routing ломается на альтернативах: MacBook sleep рвёт agent и OpenRouter callbacks; Linux VPS без macOS-native agent sandboxes; virtual Mac с Metal и permission gaps; покупка Mac Studio — procurement cycle и depreciation. Для 7×24 stability и elastic M4/M4 Pro configs per project в agent orchestration и iOS CI аренда bare-metal Mac CALMVPS даёт dedicated Apple Silicon, provisioning ~120 секунд и flexible day/week/month/quarter billing — routing на бодрствующем production macOS, пока вы выбираете модели по OpenRouter. Цены: цены аренды, эксплуатация: центр помощи, заказ: оформить заказ Mac mini M4.