Подорожание DeepSeek, открытые веса Qwen 2,4 Т и GLM-5.3:
почему китайские лаборатории в августе сменили строй

Команды, которые гонят прод через китайские API, потеряли простое правило. За пять дней DeepSeek поднял отдельные ступени до 1100 %, Alibaba выложила веса флагмана на 2,4 трлн параметров, а Zhipu выпустила GLM-5.3 с примерно шестикратным скачком на кодовых бенчах на той же базе. Общий сигнал — не «Китай снова дешевле», а переход от борьбы за пол к борьбе за право задавать цену.

Текст держится исходного брифа: таймлайн, прайс в юанях, спецификации Qwen, бенчи GLM, три логики, сравнительная таблица, спорные пункты и шесть проверок. После чтения должно быть ясно, какой строке соответствуют 1100 %, кто может коммерчески использовать Qwen3.8-Max и является ли GLM-5.3 новой базой.

01 Таймлайн подорожания DeepSeek: что и когда

Операционная боль конкретна. Заголовки ставят 11×, 1100 % и 350 % как одно число. Слух запрещал скачивание из США, ЕС, Великобритании и Кореи. Оба узла режутся датой и строкой биллинга.

Июль–август 2026 по исходному брифу
Дата Событие
16 июля 2026Moonshot AI открывает Kimi K3 (2,8 Т); уже есть интерес США по безопасности
30 июля 2026OpenAI режет GPT-5.6 Luna на 80 %
2–3 августа 2026Alibaba анонсирует и затем поднимает Qwen3.8-Max как облачный API
6–7 августа 2026OpenAI делает Luna бесплатной моделью по умолчанию с безлимитным текстом
10 августа 2026Meta выпускает Muse Glimmer (30B, Apache 2.0) и обещает веса флагмана Muse Spark 1.2
12 августа 2026Alibaba кладёт Qwen3.8-2.4T-A95B на Hugging Face / ModelScope; xAI отдаёт Grok 4.6
13 августа 2026DeepSeek-V4-Pro в GA и рост цен с 17 августа; Google режет Gemini 3.7 Flash
14 августа 2026Zhipu выпускает GLM-5.3 на той же базе 743B, что и GLM-5.2
17 августа 2026, 00:00 ПекинНовый прайс DeepSeek вступает в силу

В том же окне американские лаборатории режут цены и делают потребительский слой бесплатным. Китайская деловая пресса называет ритм «три обновления в неделю» и собирает DeepSeek, Alibaba, Zhipu, Kimi K3 и MiniMax H3 в давление на глобальный пересчёт цен.

Одна лаборатория тарифицирует час суток. Другая отдаёт веса с потолком выручки. Третья масштабирует только посттренинг. Вместе они задают, кто определяет цену.

02 Новый прайс DeepSeek, спецификации Qwen3.8, бенчи GLM-5.3

Пик: 9–12 и 14–18 по пекинскому времени. Единица: юань за 1 млн токенов. Источник — официальное объявление DeepSeek, в брифе скрещено с Wall Street CN, IT Home и V2EX.

Рост DeepSeek (с 17 августа, 00:00 Пекин)
Позиция (за 1 млн токенов) Было Новое, вне пика Новое, пик Рост в пике
V4-Flash вход, cache hit¥0,02¥0,05¥0,10~400 %
V4-Flash вход, cache miss¥1,0¥1,5¥3,0200 %
V4-Flash выход¥2,0¥4,5¥9,0350 %
V4-Pro вход, cache hit¥0,025¥0,15¥0,30~1100 %
V4-Pro вход, cache miss¥3,0¥4,5¥9,0200 %
V4-Pro выход¥6,0¥13,5¥27,0350 %

Заголовочные 1100 % — это вход cache hit в пике, ступень, которая начиналась почти с нуля. Выход, который тянет реальный счёт, вырос на 350 %. Модель в английской версии брифа (около 84 млн токенов/мес, в основном вне пика, половина hit) даёт ближе к 1,8×.

Qwen3.8-2.4T-A95B (открытые веса)
Поле Значение
Параметры2,4 Т всего, 95 млрд активных (MoE, 512 экспертов, 10 маршрутизируемых + 1 общий)
Контекст262 144 токена нативно, до ~1,01 млн; облачный Max по умолчанию 1 млн
РитмАнонс 2 авг. → API 3 авг. → веса 12 авг.
Международный API$2 / M вход, $6 / M выход
ЛицензияНе Apache 2.0 — своя «Qwen3.8-Max License»
СмыслПервый Max-флагман Alibaba в открытых весах; 3.5 / 3.6 / 3.7 Max оставались только API
GLM-5.3 против 5.2: та же база, только посттренинг (самозамер Zhipu)
Бенч GLM-5.2 GLM-5.3 Дельта
Terminal-Bench 3.04,6 %28,3 %+23,7
DeepSWE v1.146,2 %66,9 %+20,7
Agents' Last Exam (CLI)23,8 %28,5 %+4,7
CyberGym77,2 %84,5 %+7,3
AutomationBench26,2 %48,2 %+22,0

Независимого прогона нет. На Terminal-Bench 3.0 GLM-5.3 отстаёт от GPT-5.6 Sol (34,6 %) и Claude Fable 5 (33,7 %). Верх открытых весов, не победа frontier.

Заголовок цитирует вход cache hit. Счёт следует за выходом и входом cache miss.

03 Тариф по часам, своя лицензия, посттренинг — три механизма

DeepSeek вынес дефицит compute на прайс. Плоский дешёвый тариф работал, пока GPU успевали. Когда вызовы растут экспоненциально, фраза «более гибкое планирование нагрузки» значит: сдвиньте пик сами. В пике официальный API, по брифу, уже дороже реселлеров вроде GMI Cloud и Novita. Допущение «официал всегда самый дешёвый» сломано впервые.

Alibaba покупает экосистему и держит потолок выручки. Веса 2,4 Т качаются свободно. Лицензия требует отдельного коммерческого разрешения для MaaS или «AI Work Assistant» с выручкой свыше $50 млн за 12 месяцев. Продукты с 100+ млн MAU или $20+ млн месячной выручки должны явно показывать имя модели. Это другой уровень открытости, чем Muse Glimmer под чистым Apache 2.0. Географического запрета в тексте нет.

GLM-5.3 не переучивает базу. Те же 743 млрд, что у 5.2. Terminal-Bench 3.0 с 4,6 % до 28,3 % — около 6× — только за счёт масштаба RL в посттренинге. Когда отдача pretraining падает, посттренинг становится рычагом с более низким порогом, чем новая фундаментная модель. Для агентов это меняет, где крутить inference: не только API, но и локальный контур с предсказуемым планировщиком и Metal-стеком на своей машине.

aug-2026-pricing-power.txt
China labs · Aug 12–17 2026
DeepSeek  TOD pricing · cache-hit input ~1100%
Qwen3.8   2.4T-A95B weights + custom license
GLM-5.3   same 743B base · post-training only
US labs   Luna -80% then free default · Gemini 3.7 Flash cut
Signal    pricing power, not floor price
  • V4-Pro вход cache hit: ¥0,025 → ¥0,30 в пике, около 1100 %.
  • Qwen3.8-Max: 2,4 Т / 95 млрд активных; международный API $2 / $6; своя лицензия.
  • GLM-5.3 Terminal-Bench 3.0: 4,6 % → 28,3 % (самозамер); ниже Sol 34,6 % и Fable 5 33,7 %.

04 Остался ли DeepSeek самым дешёвым флагманом: шесть проверок

Курс в брифе: около ¥7,15 / $1. Только ориентир.

Сравнение после роста
Модель Вход (за 1 млн) Выход (за 1 млн) Открытые веса
DeepSeek V4-Pro (пик)¥9,0 (~$1,26)¥27,0 (~$3,78)Нет
DeepSeek V4-Pro (вне пика)¥4,5 (~$0,63)¥13,5 (~$1,89)Нет
Qwen3.8-Max (международный)$2$6Да (своя лицензия)
OpenAI GPT-5.6 Luna$0,20$1,20Нет
Claude Opus 5 (по кратности Alibaba)~$5~$25Нет

Вне пика V4-Pro всё ещё заметно ниже Claude Opus 5. Это уже не абсолютный минимум. Международный Qwen и Luna дешевле внепикового DeepSeek. «Китайская модель = самая дешёвая» больше не безопасное допущение.

В брифе помечено как неподтверждённое:

  • 1100 % верны и неполны. Только вход cache hit в пике. Выход +350 %.
  • Zhenwu M890 / Pangu AL128 — пересказ китайских финансовых СМИ, без техдокумента Alibaba и стороннего бенча.
  • Уязвимость Cursor от GLM-5.3 — VentureBeat и Zhipu, технических деталей нет.
  • Ответные экспортные ограничения Минкоммерции КНР — без официального подтверждения.

Шесть проверок:

  1. Открыть официальный прайс DeepSeek. Разнести cache hit, cache miss и выход по внепику и пику. Пик 9–12 и 14–18 Пекин, старт 17 августа 00:00.
  2. Вернуть каждый заголовок к строке. ~1100 % = вход cache hit V4-Pro в пике. 350 % = выход. 200 % = cache miss.
  3. Прочитать файл Qwen3.8-Max License. Нет территориального запрета. Отдельная коммерческая лицензия выше $50 млн MaaS / AI Work Assistant за 12 месяцев. Имя модели на экране выше 100 млн MAU или $20 млн месячной выручки.
  4. Считать бенчи GLM самозамером. Та же база 743B. Terminal-Bench 3.0 4,6 % → 28,3 %. Ниже Sol и Fable 5. Стороннего прогона нет.
  5. Собрать свою матрицу. DeepSeek вне пика / пик, Qwen $2 / $6, Luna $0,20 / $1,20, Opus 5 ~$5 / ~$25.
  6. Разнести нагрузку по часам. Вне пика + высокий hit ≈ 1,8×. Пик + miss ≈ заголовок. Свой хостинг весов требует лицензии и узла, не только скачивания.

Первичные источники (после публикации снова открыть ссылки и сверить живой текст):

https://api-docs.deepseek.com/quick_start/pricing

https://huggingface.co/Qwen

https://www.modelscope.cn/

https://z.ai/

https://ai.meta.com/blog/

05 FAQ подорожания DeepSeek: счёт, лицензия, где крутить агентов

FAQ

  • DeepSeek всё ещё дешевле GPT-5.6 или Claude? Вне пика — да относительно Claude Opus 5. Уже не самый дешёвый в целом. Luna ($0,20 / $1,20) и международный Qwen ($2 / $6) подрезают хотя бы одно измерение нового внепика.
  • Можно ли бесплатно коммерчески использовать веса Qwen3.8-Max? В большинстве случаев да. Личные проекты и внутреннее использование без доп. лицензии. MaaS или AI Work Assistant свыше $50 млн за 12 месяцев требует отдельного разрешения.
  • Есть ли запрет для пользователей США, ЕС или Великобритании? Нет. Географической оговорки нет. Ограничения завязаны на выручку.
  • Чем GLM-5.3 отличается от 5.2? На уровне базы — ничем. Те же 743 млрд. Скачок около 6× — из масштаба RL в посттренинге.
  • Meta реально откроет флагман, а не только Glimmer? Пока нет. Glimmer — дистиллят 30B. Muse Spark 1.2 закрыт; Цукерберг сказал «скоро». Намерение, не файл на диске.

Бриф осторожно называет и геополитический слой. Открытие Kimi K3 уже вызвало интерес американской проверки. Часть аналитиков читает выкладку 2,4 Т в этом окне как закрепление международного веса до возможного ужесточения. Это интерпретация, не установленный факт. Англоязычная техпресса чаще разбирала релизы как отдельные продукт-новости, а не как национальный паттерн.

Гнаться только за официальным дешёвым API — значит попасть под пиковый TOD. Скачать 2,4 Т MoE без стабильного узла — не получить прод. Общие GPU-облака смешивают изоляцию, показ лицензии и логи 7×24; для локального контура важнее предсказуемый планировщик, цепочка компиляции и Metal, а не «склад» чужих карт. Командам, которым нужен полный macOS для Cursor, локальных открытых весов и iOS CI/CD при узлах онлайн, аренда bare-metal Mac Mini у CALMVPS обычно сильнее: выделенный Apple Silicon, помесячная эластичность, выдача примерно за 120 секунд. Цены на странице тарифов CALMVPS.

Источники: официальное объявление DeepSeek о ценах, скрещено с Wall Street CN, IT Home, AIGC.cn, V2EX; официальные репозитории Qwen (Hugging Face / ModelScope) и SCMP по лицензии; техническая страница GLM-5.3 Zhipu (Z.ai), VentureBeat, StableLearn; блог Meta AI Research и VentureBeat по Muse Glimmer; Yicai и Sohu Finance по ритму китайских релизов. Цены, лицензия и бенчи на момент публикации. Перед перепечаткой сверить актуальный официальный текст. Чипы, находка в Cursor и слухи об экспорте в брифе остаются неподтверждёнными.