DeepSeek 인상+알리바바 2.4조 플래그십 공개+GLM-5.3:
중국 대규모 모델은 8월 왜 한꺼번에 전열을 바꿨는가

8월 12일부터 17일까지 닷새 동안 중국 API 청구서와 공개 가중치를 보는 사람은 모순처럼 보이는 세 사건을 동시에 만납니다. DeepSeek는 일부 API를 최대 1100% 넘게 올렸고, 알리바바는 한 번도 공개하지 않았던 Qwen-Max급 2.4조 파라미터 가중치를 풀었으며, 지푸는 같은 기반으로 후학습만으로 코딩 점수를 수 배 끌어올렸습니다. 세 회사, 세 수법은 같은 신호를 가리킵니다. 바닥 가격 경쟁에서 가격 결정권 경쟁으로 옮겨 갔습니다.

이 글은 소재고 범위에서 타임라인, 위안화 요금표, Qwen 스펙, GLM 벤치, 세 논리, 횡비교, 미검증 항목, FAQ를 정리합니다. 읽고 나면 1100%가 어느 과금 항목인지, 개인 개발자가 Qwen3.8-Max를 무료 상용할 수 있는지, GLM-5.3이 새 기반인지 답할 수 있어야 합니다.

01 DeepSeek 인상 타임라인: 무엇이, 언제 떨어졌는가

현장의 고통은 분명합니다. 헤드라인은 「11배」「1100% 초과」「350%」를 한 숫자처럼 쓰고, 라이선스는 미·EU·영·한 다운로드 금지라는 소문이 돌았습니다. 날짜와 행 항목을 한 장에 놓으면 갈라집니다.

2026년 7–8월 핵심 시점(소재고 타임라인)
날짜 사건
7월 16일문샷 AI가 Kimi K3(2.8조 파라미터)를 공개. 이미 미측 안보 관심을 불렀습니다
7월 30일OpenAI가 최저 구간 GPT-5.6 Luna를 80% 인하
8월 2–3일알리바바가 Qwen3.8-Max를 예고한 뒤 클라우드 API를 올렸습니다
8월 6–7일OpenAI가 Luna를 무료 사용자 기본 모델로 두고 텍스트 대화를 무제한으로 열었습니다
8월 10일Meta가 Muse Glimmer(300억, Apache 2.0)를 공개하고 플래그십 Muse Spark 1.2 가중치 공개를 예고
8월 12일알리바바가 Qwen3.8-2.4T-A95B를 ModelScope / Hugging Face에 공개. 같은 날 xAI가 Grok 4.6을 출고
8월 13일DeepSeek-V4-Pro 정식판과 8월 17일부터의 인상을 발표. Google은 인하한 Gemini 3.7 Flash를 출고
8월 14일지푸가 GLM-5.3을 발표. 기반은 GLM-5.2와 같은 7430억 파라미터
8월 17일 0시(베이징)DeepSeek 새 요금이 발효

거리를 두면 같은 싸움의 양면이 보입니다. 중국 쪽은 인상과 플래그십 가중치 공개를 더하고, 미국 쪽은 같은 창에서 인하와 무료화를 더했습니다. 중국 경제 매체는 DeepSeek, 알리바바, 지푸에 Kimi K3와 MiniMax H3를 묶어 「일주삼경」이라 부르며 글로벌 AI 산업에 재가격 설정을 강요한다고 씁니다.

한 곳은 시간대 요금, 한 곳은 매출 한도가 있는 가중치 공개, 한 곳은 후학습만입니다. 합치면 누가 가격을 정의하느냐의 경쟁입니다.

02 DeepSeek 새 요금, Qwen3.8 스펙, GLM-5.3 벤치 대조

피크는 베이징 시간 9–12시, 14–18시입니다. 단위는 백만 토큰당 위안입니다. 출처는 DeepSeek 공식 공고이며, 소재고는 월스트리트견문, IT之家, V2EX로 교차 확인했습니다.

DeepSeek 인상 명세(8월 17일 0시부터)
과금 항목(백만 토큰) 인상 전 오프피크(신) 피크(신) 피크 상승
V4-Flash 캐시 히트 입력¥0.02¥0.05¥0.10약 400%
V4-Flash 캐시 미스 입력¥1.0¥1.5¥3.0200%
V4-Flash 출력¥2.0¥4.5¥9.0350%
V4-Pro 캐시 히트 입력¥0.025¥0.15¥0.30약 1100%
V4-Pro 캐시 미스 입력¥3.0¥4.5¥9.0200%
V4-Pro 출력¥6.0¥13.5¥27.0350%

헤드라인 1100%는 피크 캐시 히트 입력입니다. 실제 청구를 움직이는 것은 출력(350%)과 캐시 미스 입력입니다. 소재고가 인용한 시산에서 오프피크 중심·히트율이 높은 중사용자의 청구 상승은 약 1.8배입니다.

Qwen3.8-2.4T-A95B(Qwen3.8-Max 공개 가중치)
항목 내용
파라미터총 2.4조, 활성 950억(MoE, 전문가 512, 라우팅 10+공유 1)
컨텍스트공개 가중치 원생 26.2만 토큰, 약 101만까지 확장. 클라우드 Max 기본 100만
공개 리듬8월 2일 예고 → 8월 3일 API → 8월 12일 가중치
국제 API입력 $2 / M, 출력 $6 / M
라이선스Apache 2.0이 아닌 맞춤 「Qwen3.8-Max License」
의미알리바바 최초 Max급 플래그십 가중치 공개. Qwen3.5 / 3.6 / 3.7 Max는 API만
GLM-5.3 vs 5.2: 같은 기반, 후학습만(지푸 자체 측정)
벤치 GLM-5.2 GLM-5.3 변화
Terminal-Bench 3.04.6%28.3%+23.7
DeepSWE v1.146.2%66.9%+20.7
Agents' Last Exam(CLI)23.8%28.5%+4.7
CyberGym77.2%84.5%+7.3
AutomationBench26.2%48.2%+22.0

제3자 재측정은 아직 없습니다. Terminal-Bench 3.0에서 GPT-5.6 Sol(34.6%)과 Claude Fable 5(33.7%)에 뒤집니다. 전면 1위가 아니라 공개 가중치 1군입니다.

헤드라인은 캐시 히트 입력, 청구서는 출력과 캐시 미스 입력을 보십시오.

03 시간대 요금, 맞춤 라이선스, 후학습 — 세 회사가 건 것

DeepSeek는 연산 부족을 요금표에 드러냈습니다. 「가장 싼 모델이 마진에 굴복했다」는 읽기는 쉽습니다. 구조를 보면 호출이 지수로 늘고 GPU가 못 따라간 국면에서, 균일 저가를 접고 피크를 이용자 쪽으로 옮기라고 합니다. 공고의 「더 유연한 워크로드 스케줄링」이 그 번역입니다. 피크에는 공식 API가 GMI Cloud, Novita 등 제3자 재판매보다 비싸진다는 소재고 지적도 있습니다. 「공식이 항상 최저」라는 가정은 처음 깨졌습니다.

알리바바는 생태계를 사고 매출 천장은 남겼습니다. 2.4조 가중치를 공개하는 동시에, 연매출 5000만 달러 초과의 「모델 애즈 어 서비스」 또는 「AI 업무 도우미」는 별도 상용 허가가 필요합니다. 월간 활성 1억 초과 또는 월수입 2000만 달러 초과 제품은 화면에 모델명을 뚜렷이 표시해야 합니다. Meta Muse Glimmer(제한 없는 Apache 2.0)와는 공개 정도가 다릅니다. 미·EU·영·한 다운로드 금지 소문은 거짓이며, 공식문에 지역 조항은 없습니다.

GLM-5.3은 기반을 다시 만들지 않았습니다. 7430억은 5.2와 같습니다. 사전학습 재실행 없이 강화학습 환경만 키운 후학습으로 Terminal-Bench 3.0이 4.6%에서 28.3%로, 약 6배입니다. 사전학습 한계 수익이 둔해지는 국면에서 후학습 규모화는 천억급 기반을 처음부터 만드는 것보다 낮은 문턱의 레버입니다.

aug-2026-pricing-power.txt
China labs · Aug 12–17 2026
DeepSeek  TOD pricing · cache-hit input ~1100%
Qwen3.8   2.4T-A95B weights + custom license
GLM-5.3   same 743B base · post-training only
US labs   Luna -80% then free default · Gemini 3.7 Flash cut
Signal    pricing power, not floor price
  • V4-Pro 캐시 히트 입력: ¥0.025 → 피크 ¥0.30, 약 1100%.
  • Qwen3.8-Max: 총 2.4조 / 활성 950억. 국제 API $2 / $6. 맞춤 라이선스.
  • GLM-5.3 Terminal-Bench 3.0: 4.6% → 28.3%(자체 측정). Sol 34.6%, Fable 5 33.7%에는 못 미칩니다.

04 인상 후에도 DeepSeek가 최저가인가: 6단계 확인

환산은 약 ¥7.15 / $1입니다. 참고용이며 공식 공고가 우선입니다.

횡비교: 인상 후에도 「가장 싼 플래그십」인가
모델 입력(백만 토큰) 출력(백만 토큰) 가중치 공개
DeepSeek V4-Pro(피크)¥9.0(약 $1.26)¥27.0(약 $3.78)미공개
DeepSeek V4-Pro(오프피크)¥4.5(약 $0.63)¥13.5(약 $1.89)미공개
Qwen3.8-Max(국제)$2$6공개(맞춤 라이선스)
OpenAI GPT-5.6 Luna$0.20$1.20비공개
Claude Opus 5(알리바바 배수 관계 추산)약 $5약 $25비공개

오프피크 V4-Pro는 여전히 Claude Opus 5보다 분명히 쌉니다. 다만 「장내 최저」는 아닙니다. 국제 Qwen3.8-Max와 Luna가 오프피크 DeepSeek보다 쌉니다. 「중국산 = 최저가」는 더 이상 안전한 가정이 아닙니다.

소재고가 미검증으로 표시한 점:

  • 1100%는 정확하지만 전체가 아닙니다. 피크 캐시 히트 입력만입니다. 출력은 350%입니다.
  • 진오 M890 / 반고 AL128은 중국 경제 매체 전술이며 알리바바 공식 기술 문서나 제3자 벤치는 없습니다.
  • GLM-5.3이 Cursor 심각 취약점을 발견했다는 말은 VentureBeat와 지푸 쪽입니다. 기술 세부는 미공개입니다.
  • 중국 상무부 보복 수출 규제는 공식 확인이 없고 보도 추정입니다.

확인 6단계:

  1. DeepSeek 공식 요금을 엽니다. 캐시 히트 입력, 캐시 미스 입력, 출력을 오프피크와 피크로 나눕니다. 피크는 베이징 9–12시·14–18시, 발효는 8월 17일 0시입니다.
  2. 헤드라인 배율을 행 항목에 되돌립니다. 약 1100%는 V4-Pro 피크 캐시 히트 입력, 350%는 출력, 200%는 캐시 미스 입력입니다.
  3. Qwen3.8-Max License 원문을 읽습니다. 지역 제한 없음. 직전 12개월 5000만 달러 초과 MaaS / AI 업무 도우미는 별도 허가. 월간 1억 초과 또는 월수입 2000만 달러 초과는 모델명 명시.
  4. GLM 공식 벤치를 대조합니다. 기반 7430억 동일, 재사전학습 없음, Terminal-Bench 3.0 4.6%→28.3%. 제3자 재측정 없고 Sol·Fable 5에 못 미칩니다.
  5. 자기 비교표를 만듭니다. DeepSeek 오프피크/피크, Qwen $2/$6, Luna $0.20/$1.20, Opus 5 약 $5/$25를 같은 기준에 둡니다.
  6. 부하를 시간대로 나눕니다. 오프피크+높은 히트면 약 1.8배에 가깝습니다. 피크+낮은 히트면 헤드라인에 가깝습니다. 가중치를 직접 올리면 라이선스와 노드를 먼저 견적합니다.

1차 정보(공개 후에도 링크를 다시 열어 본문을 확인하십시오):

https://api-docs.deepseek.com/quick_start/pricing

https://huggingface.co/Qwen

https://www.modelscope.cn/

https://z.ai/

https://ai.meta.com/blog/

05 DeepSeek 인상 FAQ: 청구, 라이선스, 노드 고르기

FAQ

  • 인상 후에는 무조건 더 비싸집니까. 시간대에 달립니다. 베이징 9–12시·14–18시를 피하고 캐시 히트가 높으면 350%·1100%보다 낮고, 중사용자 약 1.8배라는 시산이 있습니다. 피크 집중+낮은 히트면 헤드라인에 가깝습니다.
  • 개인 개발자는 Qwen3.8-Max를 무료 상용할 수 있습니까. 개인과 내부 사용은 거의 영향이 없습니다. 직전 12개월 5000만 달러 초과 MaaS / AI 업무 도우미는 별도 허가가 필요합니다. 월간 1억 초과 또는 월수입 2000만 달러 초과는 화면 명시가 필요합니다.
  • GLM-5.3과 5.2는 같은 모델입니까. 기반은 같은 7430억입니다. 재훈련은 없습니다. 상승은 후학습에서 강화학습 환경을 키운 결과입니다.
  • 미·EU 사용자 다운로드 금지는 사실입니까. 아닙니다. 공식문에 지역 조항이 없고 제한은 매출 규모입니다.
  • Meta Muse Glimmer로 Llama 시대가 돌아옵니까. 부분적입니다. Glimmer는 300억 증류 모델이고 플래그십 Muse Spark 1.2는 미공개입니다. 예고가 실행돼야 미국 플래그십 공개라고 할 수 있습니다.

지정학 층도 소재고는 조심스럽게 적습니다. Kimi K3 공개는 이미 미측 안보 심사 관심을 불렀습니다. 이 창에서 2.4조를 푸는 판단을 「규제가 조이기 전에 국제 존재감과 기술 대등 서사를 굳힌다」고 읽는 분석도 있습니다. 확정 사실이 아니라 타이밍을 읽을 때의 배경입니다.

공식 저가 API만 쫓으면 피크 시간대 요금에 맞습니다. 2.4조 MoE 가중치만 받아도 안정 노드가 없으면 재현 가능한 운영이 아닙니다. 공유 GPU 클라우드는 격리, 라이선스 표시, 7×24 로그를 섞기 쉽습니다. Cursor, 로컬 공개 가중치, iOS CI/CD를 완전한 macOS에서 돌리고 노드를 상시 온라인으로 두려는 팀에는 CALMVPS 베어메탈 Mac Mini 임대가 더 나은 해인 경우가 많습니다. 전용 Apple Silicon, 월 단위 신축, 약 120초 인도. 기종과 가격은 CALMVPS 요금 페이지를 보십시오.

출처: DeepSeek 공식 인상 공고(월스트리트견문, IT之家, AIGC, V2EX 교차 확인). 알리바바 Qwen 공식 모델 저장소(Hugging Face / ModelScope)와 SCMP 라이선스 보도. 지푸(Z.ai)GLM-5.3 공식 기술 페이지, VentureBeat, StableLearn. Meta AI Research 공식 블로그와 VentureBeat의 Muse Glimmer 보도. 제일재경, 소후재경 등 중국 쪽 공개 밀도 종합 보도. 가격, 라이선스, 벤치는 공개 시점 정리입니다. 재게시 전 공식문을 다시 확인하십시오. 칩, 취약점, 수출 규제 이야기는 본문에서 미검증으로 표시했습니다.