DeepSeek-Preiserhöhung, Alibabas 2,4-Bio.-Flagschiff und GLM-5.3:
Warum Chinas Modelllabore im August die Formation wechseln

Wer Produktionslast über chinesische APIs routet, verliert eine einfache Faustregel. In fünf Tagen hat DeepSeek einzelne API-Stufen um bis zu 1100 % angehoben, Alibaba hat ein 2,4-Billionen-Parameter-Flagschiff als Open Weights veröffentlicht, und Zhipu hat GLM-5.3 mit einem rund sechsfachen Coding-Sprung auf derselben Basis ausgeliefert. Das gemeinsame Signal ist nicht „China wird billiger“, sondern der Wechsel vom Bodenpreis zur Preismacht.

Der Text bleibt im Quellenbrief: Zeitlinie, RMB-Preistabelle, Qwen-Specs, GLM-Benches, drei Logiken, Vergleichstabelle, strittige Punkte und sechs Prüfschritte. Am Ende sollte klar sein, welche Zeile die 1100 % meint, wer Qwen3.8-Max kommerziell nutzen darf und ob GLM-5.3 ein neues Fundament ist.

01 DeepSeek-Preiserhöhung: Zeitlinie der fünf Tage

Der operative Schmerz ist messbar. Schlagzeilen setzen 11×, 1100 % und 350 % gleich. Ein Gerücht behauptete ein Downloadverbot für USA, EU, UK und Südkorea. Beides lässt sich mit Datum und Zeile trennen.

Juli–August 2026 laut Quellenbrief
Datum Ereignis
16. Juli 2026Moonshot AI veröffentlicht Kimi K3 (2,8 Bio. Parameter); bereits US-Sicherheitsinteresse
30. Juli 2026OpenAI senkt GPT-5.6 Luna um 80 %
2.–3. August 2026Alibaba kündigt Qwen3.8-Max an und schaltet die Cloud-API frei
6.–7. August 2026OpenAI macht Luna zum kostenlosen Standard mit unbegrenztem Textchat
10. August 2026Meta veröffentlicht Muse Glimmer (30B, Apache 2.0) und kündigt Gewichte für Muse Spark 1.2 an
12. August 2026Alibaba legt Qwen3.8-2.4T-A95B auf Hugging Face / ModelScope; xAI liefert Grok 4.6
13. August 2026DeepSeek-V4-Pro GA und Preiserhöhung ab 17. August; Google senkt Gemini 3.7 Flash
14. August 2026Zhipu liefert GLM-5.3 auf derselben 743-Mrd.-Basis wie GLM-5.2
17. August 2026, 00:00 PekingNeue DeepSeek-Preise gelten

Im gleichen Fenster senken US-Labore und machen Consumer-Schichten kostenlos. Chinesische Wirtschaftsmedien nennen den Takt „drei Modellupdates pro Woche“ und gruppieren DeepSeek, Alibaba, Zhipu, Kimi K3 und MiniMax H3 als Druck auf eine globale Neubepreisung.

Ein Labor bepreist die Uhrzeit. Eines veröffentlicht Gewichte mit Umsatzdeckel. Eines skaliert nur Nachtraining. Zusammen definieren sie, wer den Preis setzt.

02 Neue DeepSeek-Sätze, Qwen3.8-Specs, GLM-5.3-Benches

Spitzenzeiten: 9–12 und 14–18 Uhr Peking. Einheit: RMB je 1 Mio. Tokens. Quelle: offizielle DeepSeek-Mitteilung, im Brief gegen Wall Street CN, IT Home und V2EX gekreuzt.

DeepSeek-Erhöhung (ab 17. August, 00:00 Peking)
Position (je 1 Mio. Tokens) Alt Neu, Nebenzeit Neu, Spitze Spitzenplus
V4-Flash Cache-Hit Eingabe¥0,02¥0,05¥0,10~400 %
V4-Flash Cache-Miss Eingabe¥1,0¥1,5¥3,0200 %
V4-Flash Ausgabe¥2,0¥4,5¥9,0350 %
V4-Pro Cache-Hit Eingabe¥0,025¥0,15¥0,30~1100 %
V4-Pro Cache-Miss Eingabe¥3,0¥4,5¥9,0200 %
V4-Pro Ausgabe¥6,0¥13,5¥27,0350 %

Die 1100 % gelten nur für Cache-Hit-Eingabe in der Spitze. Die Ausgabe, die reale Rechnungen trägt, stieg um 350 %. Eine im englischen Brief zitierte Modellrechnung (rund 84 Mio. Tokens/Monat, überwiegend Nebenzeit, etwa die Hälfte Hits) landet näher bei 1,8×.

Qwen3.8-2.4T-A95B (Open Weights)
Merkmal Wert
Parameter2,4 Bio. gesamt, 95 Mrd. aktiv (MoE, 512 Experten, 10 geroutet + 1 geteilt)
Kontext262.144 Tokens nativ, erweiterbar auf ~1,01 Mio.; gehostetes Max standardmäßig 1 Mio.
TaktVorschau 2. Aug. → API 3. Aug. → Gewichte 12. Aug.
Internationale API$2 / M Eingabe, $6 / M Ausgabe
LizenzNicht Apache 2.0 — eigene „Qwen3.8-Max License“
BedeutungErstes Max-Flagschiff von Alibaba als Open Weights; 3.5 / 3.6 / 3.7 Max blieben API-only
GLM-5.3 vs. 5.2: gleiche Basis, nur Nachtraining (Zhipu-Selbsttest)
Bench GLM-5.2 GLM-5.3 Delta
Terminal-Bench 3.04,6 %28,3 %+23,7
DeepSWE v1.146,2 %66,9 %+20,7
Agents' Last Exam (CLI)23,8 %28,5 %+4,7
CyberGym77,2 %84,5 %+7,3
AutomationBench26,2 %48,2 %+22,0

Keine unabhängige Wiederholung. Auf Terminal-Bench 3.0 liegt GLM-5.3 hinter GPT-5.6 Sol (34,6 %) und Claude Fable 5 (33,7 %). Spitze der Open-Weight-Gruppe, kein Frontier-Sieg.

Die Schlagzeile zitiert Cache-Hit-Eingabe. Die Rechnung folgt Ausgabe und Cache-Miss-Eingabe.

03 Tageszeitpreis, eigene Lizenz, Nachtraining — drei Wetten

DeepSeek macht Knappheit sichtbar. Die flache Billigpreisung funktionierte, solange GPUs mithielten. Steigt die Last exponentiell, fordert die Mitteilung „flexiblere Workload-Planung“ — also: Spitzenlast selbst verschieben. In der Spitze liegt die offizielle API laut Brief über Wiederverkäufern wie GMI Cloud und Novita. „Offiziell ist immer am günstigsten“ gilt nicht mehr.

Alibaba kauft Mindshare und behält die Decke. Die 2,4-Bio.-Gewichte sind frei ladbar. Die Lizenz verlangt für MaaS- oder „AI Work Assistant“-Geschäfte über 50 Mio. USD in 12 Monaten eine gesonderte Handelslizenz. Produkte mit über 100 Mio. MAU oder über 20 Mio. USD Monatsumsatz müssen den Modellnamen sichtbar zeigen. Das ist ein anderes Offenheitsmaß als Metas Muse Glimmer unter uneingeschränktem Apache 2.0. Ein geografisches Downloadverbot steht nicht im Text.

GLM-5.3 trainiert die Basis nicht neu. Dieselben 743 Mrd. Parameter wie 5.2. Terminal-Bench 3.0 von 4,6 % auf 28,3 % allein durch größeres RL im Nachtraining. Wenn Pretraining-Skalierung abflacht, ist Nachtraining ein Hebel mit niedrigerer Kostenschwelle als ein neues Fundament.

aug-2026-pricing-power.txt
China labs · Aug 12–17 2026
DeepSeek  TOD pricing · cache-hit input ~1100%
Qwen3.8   2.4T-A95B weights + custom license
GLM-5.3   same 743B base · post-training only
US labs   Luna -80% then free default · Gemini 3.7 Flash cut
Signal    pricing power, not floor price
  • V4-Pro Cache-Hit Eingabe: ¥0,025 → ¥0,30 Spitze, etwa 1100 %.
  • Qwen3.8-Max: 2,4 Bio. / 95 Mrd. aktiv; internationale API $2 / $6; eigene Lizenz.
  • GLM-5.3 Terminal-Bench 3.0: 4,6 % → 28,3 % (Selbsttest); hinter Sol 34,6 % und Fable 5 33,7 %.

04 Ist DeepSeek nach der Erhöhung noch am günstigsten? Sechs Checks

Umrechnung im Brief: etwa ¥7,15 / $1. Nur Orientierung.

Vergleich nach der Erhöhung
Modell Eingabe (je 1 Mio.) Ausgabe (je 1 Mio.) Open Weights
DeepSeek V4-Pro (Spitze)¥9,0 (~$1,26)¥27,0 (~$3,78)Nein
DeepSeek V4-Pro (Nebenzeit)¥4,5 (~$0,63)¥13,5 (~$1,89)Nein
Qwen3.8-Max (international)$2$6Ja (eigene Lizenz)
OpenAI GPT-5.6 Luna$0,20$1,20Nein
Claude Opus 5 (aus Alibaba-Verhältnis)~$5~$25Nein

Nebenzeit-V4-Pro bleibt klar unter Claude Opus 5. Es ist nicht mehr das billigste Angebot. Internationale Qwen-Preise und Luna unterbieten DeepSeeks Nebenzeit. „Chinesisches Modell = billigstes Modell“ ist keine sichere Annahme mehr.

Im Brief als unbestätigt markiert:

  • 1100 % sind korrekt und unvollständig. Nur Spitzen-Cache-Hit-Eingabe. Ausgabe +350 %.
  • Zhenwu M890 / Pangu AL128 nur in chinesischen Finanzmedien, ohne Alibaba-Technikdokument oder Drittbench.
  • Cursor-Schwachstelle durch GLM-5.3 laut VentureBeat und Zhipu, ohne öffentliche Technikdetails.
  • Gegenseitige Exportkontrollen des Handelsministeriums ohne offizielle Bestätigung.

Sechs Prüfschritte:

  1. Offizielle DeepSeek-Liste öffnen. Cache-Hit, Cache-Miss, Ausgabe getrennt für Nebenzeit und Spitze. Spitze 9–12 und 14–18 Uhr Peking, Start 17. August 00:00.
  2. Jede Schlagzeile einer Zeile zuordnen. ~1100 % = V4-Pro Spitzen-Cache-Hit. 350 % = Ausgabe. 200 % = Cache-Miss.
  3. Qwen3.8-Max-License-Datei lesen. Kein Gebietsverbot. Extra-Lizenz ab 50 Mio. USD MaaS / AI Work Assistant in 12 Monaten. Modellname sichtbar ab 100 Mio. MAU oder 20 Mio. USD Monatsumsatz.
  4. GLM-Benches als Selbsttest behandeln. Gleiche 743-Mrd.-Basis. Terminal-Bench 3.0 4,6 % → 28,3 %. Hinter Sol und Fable 5. Keine Drittwiederholung.
  5. Eigene Matrix bauen. DeepSeek Nebenzeit/Spitze, Qwen $2/$6, Luna $0,20/$1,20, Opus 5 ~$5/$25.
  6. Last zeitlich legen. Nebenzeit plus Hits kann bei ~1,8× landen. Spitze plus Misses nähert sich der Schlagzeile. Selbsthosting braucht Lizenz und Knoten, nicht nur den Download.

Primärquellen (nach Veröffentlichung erneut öffnen und den Live-Text prüfen):

https://api-docs.deepseek.com/quick_start/pricing

https://huggingface.co/Qwen

https://www.modelscope.cn/

https://z.ai/

https://ai.meta.com/blog/

05 DeepSeek-Preise FAQ: Rechnung, Lizenz, wo Agenten laufen

FAQ

  • Ist DeepSeek nach der Erhöhung noch günstiger als GPT-5.6 oder Claude? In der Nebenzeit ja gegenüber Claude Opus 5. Nicht mehr das billigste Gesamtangebot. Luna ($0,20 / $1,20) und internationales Qwen ($2 / $6) unterbieten mindestens eine Dimension der neuen Nebenzeit.
  • Darf ich Qwen3.8-Max-Gewichte kostenlos kommerziell nutzen? Für die meisten Fälle ja. Privat und intern ohne Extra-Lizenz. MaaS oder AI Work Assistant über 50 Mio. USD in 12 Monaten braucht eine gesonderte Handelslizenz.
  • Gibt es ein Downloadverbot für US-, EU- oder UK-Nutzer? Nein. Keine Gebietsklausel. Grenzen sind umsatzbasiert.
  • Was unterscheidet GLM-5.3 von 5.2? Nichts auf Basis-Ebene. Dieselben 743 Mrd. Parameter. Der etwa sechsfache Terminal-Bench-Sprung kommt aus skaliertem RL im Nachtraining.
  • Öffnet Meta wirklich das Flagschiff, nicht nur Glimmer? Noch nicht. Glimmer ist ein 30B-Destillat. Muse Spark 1.2 bleibt geschlossen; Zuckerberg hat „bald“ angekündigt. Absicht, kein Fakt auf der Platte.

Der Brief nennt vorsichtig eine geopolitische Schicht. Kimi K3 zog bereits US-Sicherheitsprüfung auf sich. Manche Analysten lesen den 2,4-Bio.-Drop in diesem Fenster als Sicherung internationaler Sichtbarkeit vor möglicher Regulierungsenge. Das ist Interpretation, kein bestätigter Fakt.

Wer nur die offizielle Billig-API jagt, trifft die Spitzen-Tageszeitpreise. Wer 2,4-Bio.-MoE-Gewichte ohne stabilen Knoten lädt, hat keine Produktionsumgebung. Geteilte GPU-Clouds vermischen Isolation, Lizenzhinweis und 7×24-Logs; bei personenbezogenen Prompts und Telemetrie gilt zusätzlich die DSGVO — Auftragsverarbeitung, Speicherort und Löschfristen müssen nachweisbar sein. Für Teams, die Cursor, lokale Open Weights und iOS-CI/CD auf vollem macOS brauchen und Knoten dauerhaft online halten wollen, ist die Bare-Metal-Mac-Mini-Miete bei CALMVPS meist die bessere Lösung: dediziertes Apple Silicon, monatliche Elastizität, Übergabe in etwa 120 Sekunden. Preise auf der CALMVPS-Preisseite.

Quellen: Offizielle DeepSeek-Preismitteilung, gekreuzt mit Wall Street CN, IT Home, AIGC.cn, V2EX; Alibaba-Qwen-Repositorien (Hugging Face / ModelScope) und SCMP zur Lizenz; Zhipu (Z.ai) GLM-5.3-Technikseite, VentureBeat, StableLearn; Meta-AI-Research-Blog und VentureBeat zu Muse Glimmer; Yicai und Sohu Finance zum Takt der Open-Weight-Welle. Preise, Lizenz und Benches Stand Veröffentlichung. Vor einer Weiterverwendung den aktuellen Amtstext prüfen. Chip-Behauptungen, Cursor-Fund und Exportgerüchte bleiben im Brief unbestätigt.