Команды, которые гонят прод через китайские API, потеряли простое правило. За пять дней DeepSeek поднял отдельные ступени до 1100 %, Alibaba выложила веса флагмана на 2,4 трлн параметров, а Zhipu выпустила GLM-5.3 с примерно шестикратным скачком на кодовых бенчах на той же базе. Общий сигнал — не «Китай снова дешевле», а переход от борьбы за пол к борьбе за право задавать цену.
Текст держится исходного брифа: таймлайн, прайс в юанях, спецификации Qwen, бенчи GLM, три логики, сравнительная таблица, спорные пункты и шесть проверок. После чтения должно быть ясно, какой строке соответствуют 1100 %, кто может коммерчески использовать Qwen3.8-Max и является ли GLM-5.3 новой базой.
01 Таймлайн подорожания DeepSeek: что и когда
Операционная боль конкретна. Заголовки ставят 11×, 1100 % и 350 % как одно число. Слух запрещал скачивание из США, ЕС, Великобритании и Кореи. Оба узла режутся датой и строкой биллинга.
| Дата | Событие |
|---|---|
| 16 июля 2026 | Moonshot AI открывает Kimi K3 (2,8 Т); уже есть интерес США по безопасности |
| 30 июля 2026 | OpenAI режет GPT-5.6 Luna на 80 % |
| 2–3 августа 2026 | Alibaba анонсирует и затем поднимает Qwen3.8-Max как облачный API |
| 6–7 августа 2026 | OpenAI делает Luna бесплатной моделью по умолчанию с безлимитным текстом |
| 10 августа 2026 | Meta выпускает Muse Glimmer (30B, Apache 2.0) и обещает веса флагмана Muse Spark 1.2 |
| 12 августа 2026 | Alibaba кладёт Qwen3.8-2.4T-A95B на Hugging Face / ModelScope; xAI отдаёт Grok 4.6 |
| 13 августа 2026 | DeepSeek-V4-Pro в GA и рост цен с 17 августа; Google режет Gemini 3.7 Flash |
| 14 августа 2026 | Zhipu выпускает GLM-5.3 на той же базе 743B, что и GLM-5.2 |
| 17 августа 2026, 00:00 Пекин | Новый прайс DeepSeek вступает в силу |
В том же окне американские лаборатории режут цены и делают потребительский слой бесплатным. Китайская деловая пресса называет ритм «три обновления в неделю» и собирает DeepSeek, Alibaba, Zhipu, Kimi K3 и MiniMax H3 в давление на глобальный пересчёт цен.
Одна лаборатория тарифицирует час суток. Другая отдаёт веса с потолком выручки. Третья масштабирует только посттренинг. Вместе они задают, кто определяет цену.
02 Новый прайс DeepSeek, спецификации Qwen3.8, бенчи GLM-5.3
Пик: 9–12 и 14–18 по пекинскому времени. Единица: юань за 1 млн токенов. Источник — официальное объявление DeepSeek, в брифе скрещено с Wall Street CN, IT Home и V2EX.
| Позиция (за 1 млн токенов) | Было | Новое, вне пика | Новое, пик | Рост в пике |
|---|---|---|---|---|
| V4-Flash вход, cache hit | ¥0,02 | ¥0,05 | ¥0,10 | ~400 % |
| V4-Flash вход, cache miss | ¥1,0 | ¥1,5 | ¥3,0 | 200 % |
| V4-Flash выход | ¥2,0 | ¥4,5 | ¥9,0 | 350 % |
| V4-Pro вход, cache hit | ¥0,025 | ¥0,15 | ¥0,30 | ~1100 % |
| V4-Pro вход, cache miss | ¥3,0 | ¥4,5 | ¥9,0 | 200 % |
| V4-Pro выход | ¥6,0 | ¥13,5 | ¥27,0 | 350 % |
Заголовочные 1100 % — это вход cache hit в пике, ступень, которая начиналась почти с нуля. Выход, который тянет реальный счёт, вырос на 350 %. Модель в английской версии брифа (около 84 млн токенов/мес, в основном вне пика, половина hit) даёт ближе к 1,8×.
| Поле | Значение |
|---|---|
| Параметры | 2,4 Т всего, 95 млрд активных (MoE, 512 экспертов, 10 маршрутизируемых + 1 общий) |
| Контекст | 262 144 токена нативно, до ~1,01 млн; облачный Max по умолчанию 1 млн |
| Ритм | Анонс 2 авг. → API 3 авг. → веса 12 авг. |
| Международный API | $2 / M вход, $6 / M выход |
| Лицензия | Не Apache 2.0 — своя «Qwen3.8-Max License» |
| Смысл | Первый Max-флагман Alibaba в открытых весах; 3.5 / 3.6 / 3.7 Max оставались только API |
| Бенч | GLM-5.2 | GLM-5.3 | Дельта |
|---|---|---|---|
| Terminal-Bench 3.0 | 4,6 % | 28,3 % | +23,7 |
| DeepSWE v1.1 | 46,2 % | 66,9 % | +20,7 |
| Agents' Last Exam (CLI) | 23,8 % | 28,5 % | +4,7 |
| CyberGym | 77,2 % | 84,5 % | +7,3 |
| AutomationBench | 26,2 % | 48,2 % | +22,0 |
Независимого прогона нет. На Terminal-Bench 3.0 GLM-5.3 отстаёт от GPT-5.6 Sol (34,6 %) и Claude Fable 5 (33,7 %). Верх открытых весов, не победа frontier.
Заголовок цитирует вход cache hit. Счёт следует за выходом и входом cache miss.
03 Тариф по часам, своя лицензия, посттренинг — три механизма
DeepSeek вынес дефицит compute на прайс. Плоский дешёвый тариф работал, пока GPU успевали. Когда вызовы растут экспоненциально, фраза «более гибкое планирование нагрузки» значит: сдвиньте пик сами. В пике официальный API, по брифу, уже дороже реселлеров вроде GMI Cloud и Novita. Допущение «официал всегда самый дешёвый» сломано впервые.
Alibaba покупает экосистему и держит потолок выручки. Веса 2,4 Т качаются свободно. Лицензия требует отдельного коммерческого разрешения для MaaS или «AI Work Assistant» с выручкой свыше $50 млн за 12 месяцев. Продукты с 100+ млн MAU или $20+ млн месячной выручки должны явно показывать имя модели. Это другой уровень открытости, чем Muse Glimmer под чистым Apache 2.0. Географического запрета в тексте нет.
GLM-5.3 не переучивает базу. Те же 743 млрд, что у 5.2. Terminal-Bench 3.0 с 4,6 % до 28,3 % — около 6× — только за счёт масштаба RL в посттренинге. Когда отдача pretraining падает, посттренинг становится рычагом с более низким порогом, чем новая фундаментная модель. Для агентов это меняет, где крутить inference: не только API, но и локальный контур с предсказуемым планировщиком и Metal-стеком на своей машине.
China labs · Aug 12–17 2026
DeepSeek TOD pricing · cache-hit input ~1100%
Qwen3.8 2.4T-A95B weights + custom license
GLM-5.3 same 743B base · post-training only
US labs Luna -80% then free default · Gemini 3.7 Flash cut
Signal pricing power, not floor price
- V4-Pro вход cache hit: ¥0,025 → ¥0,30 в пике, около 1100 %.
- Qwen3.8-Max: 2,4 Т / 95 млрд активных; международный API $2 / $6; своя лицензия.
- GLM-5.3 Terminal-Bench 3.0: 4,6 % → 28,3 % (самозамер); ниже Sol 34,6 % и Fable 5 33,7 %.
04 Остался ли DeepSeek самым дешёвым флагманом: шесть проверок
Курс в брифе: около ¥7,15 / $1. Только ориентир.
| Модель | Вход (за 1 млн) | Выход (за 1 млн) | Открытые веса |
|---|---|---|---|
| DeepSeek V4-Pro (пик) | ¥9,0 (~$1,26) | ¥27,0 (~$3,78) | Нет |
| DeepSeek V4-Pro (вне пика) | ¥4,5 (~$0,63) | ¥13,5 (~$1,89) | Нет |
| Qwen3.8-Max (международный) | $2 | $6 | Да (своя лицензия) |
| OpenAI GPT-5.6 Luna | $0,20 | $1,20 | Нет |
| Claude Opus 5 (по кратности Alibaba) | ~$5 | ~$25 | Нет |
Вне пика V4-Pro всё ещё заметно ниже Claude Opus 5. Это уже не абсолютный минимум. Международный Qwen и Luna дешевле внепикового DeepSeek. «Китайская модель = самая дешёвая» больше не безопасное допущение.
В брифе помечено как неподтверждённое:
- 1100 % верны и неполны. Только вход cache hit в пике. Выход +350 %.
- Zhenwu M890 / Pangu AL128 — пересказ китайских финансовых СМИ, без техдокумента Alibaba и стороннего бенча.
- Уязвимость Cursor от GLM-5.3 — VentureBeat и Zhipu, технических деталей нет.
- Ответные экспортные ограничения Минкоммерции КНР — без официального подтверждения.
Шесть проверок:
- Открыть официальный прайс DeepSeek. Разнести cache hit, cache miss и выход по внепику и пику. Пик 9–12 и 14–18 Пекин, старт 17 августа 00:00.
- Вернуть каждый заголовок к строке. ~1100 % = вход cache hit V4-Pro в пике. 350 % = выход. 200 % = cache miss.
- Прочитать файл Qwen3.8-Max License. Нет территориального запрета. Отдельная коммерческая лицензия выше $50 млн MaaS / AI Work Assistant за 12 месяцев. Имя модели на экране выше 100 млн MAU или $20 млн месячной выручки.
- Считать бенчи GLM самозамером. Та же база 743B. Terminal-Bench 3.0 4,6 % → 28,3 %. Ниже Sol и Fable 5. Стороннего прогона нет.
- Собрать свою матрицу. DeepSeek вне пика / пик, Qwen $2 / $6, Luna $0,20 / $1,20, Opus 5 ~$5 / ~$25.
- Разнести нагрузку по часам. Вне пика + высокий hit ≈ 1,8×. Пик + miss ≈ заголовок. Свой хостинг весов требует лицензии и узла, не только скачивания.
Первичные источники (после публикации снова открыть ссылки и сверить живой текст):
05 FAQ подорожания DeepSeek: счёт, лицензия, где крутить агентов
FAQ
- DeepSeek всё ещё дешевле GPT-5.6 или Claude? Вне пика — да относительно Claude Opus 5. Уже не самый дешёвый в целом. Luna ($0,20 / $1,20) и международный Qwen ($2 / $6) подрезают хотя бы одно измерение нового внепика.
- Можно ли бесплатно коммерчески использовать веса Qwen3.8-Max? В большинстве случаев да. Личные проекты и внутреннее использование без доп. лицензии. MaaS или AI Work Assistant свыше $50 млн за 12 месяцев требует отдельного разрешения.
- Есть ли запрет для пользователей США, ЕС или Великобритании? Нет. Географической оговорки нет. Ограничения завязаны на выручку.
- Чем GLM-5.3 отличается от 5.2? На уровне базы — ничем. Те же 743 млрд. Скачок около 6× — из масштаба RL в посттренинге.
- Meta реально откроет флагман, а не только Glimmer? Пока нет. Glimmer — дистиллят 30B. Muse Spark 1.2 закрыт; Цукерберг сказал «скоро». Намерение, не файл на диске.
Бриф осторожно называет и геополитический слой. Открытие Kimi K3 уже вызвало интерес американской проверки. Часть аналитиков читает выкладку 2,4 Т в этом окне как закрепление международного веса до возможного ужесточения. Это интерпретация, не установленный факт. Англоязычная техпресса чаще разбирала релизы как отдельные продукт-новости, а не как национальный паттерн.
Гнаться только за официальным дешёвым API — значит попасть под пиковый TOD. Скачать 2,4 Т MoE без стабильного узла — не получить прод. Общие GPU-облака смешивают изоляцию, показ лицензии и логи 7×24; для локального контура важнее предсказуемый планировщик, цепочка компиляции и Metal, а не «склад» чужих карт. Командам, которым нужен полный macOS для Cursor, локальных открытых весов и iOS CI/CD при узлах онлайн, аренда bare-metal Mac Mini у CALMVPS обычно сильнее: выделенный Apple Silicon, помесячная эластичность, выдача примерно за 120 секунд. Цены на странице тарифов CALMVPS.
Источники: официальное объявление DeepSeek о ценах, скрещено с Wall Street CN, IT Home, AIGC.cn, V2EX; официальные репозитории Qwen (Hugging Face / ModelScope) и SCMP по лицензии; техническая страница GLM-5.3 Zhipu (Z.ai), VentureBeat, StableLearn; блог Meta AI Research и VentureBeat по Muse Glimmer; Yicai и Sohu Finance по ритму китайских релизов. Цены, лицензия и бенчи на момент публикации. Перед перепечаткой сверить актуальный официальный текст. Чипы, находка в Cursor и слухи об экспорте в брифе остаются неподтверждёнными.