2026 중국 AI
INGASANGSEUNG_
GAEWON_
BYEONJIN.

DeepSeek 인상, 알리바바 Qwen3.8-Max 가중치 공개, GLM-5.3 후훈련 도약

8월 12일부터 17일까지 닷새. 중국 3대 랩이 서로 모순처럼 보이는 수를 동시에 던졌다. DeepSeek는 일부 구간 API를 최대 1100% 이상 올렸고, 같은 주 알리바바는 한 번도 풀어본 적 없는 Qwen-Max급 2.4조 파라미터 가중치를 공개했으며, 지푸는 GLM-5.2와 같은 기반 모델로 코딩 벤치를 약 6배 끌어올렸다. 통증: 헤드라인 퍼센트는 실제 청구서와 다르고, 「중국 모델=최저가」 공식은 깨졌다. 결론: 세 회사는 이제 가격이 아니라 가격 결정권을 두고 싸운다. 구조: 타임라인 → 요금·스펙·벤치 → 세 가지 논리 → 횡비교 → 미검증 주장 → 5단계 점검 → FAQ.

1. 이번 주 실제로 바뀐 세 가지 제약

  1. 1100%는 청구서 전체가 아니라 한 줄이다. 피크 시간 캐시 히트 입력—원래 공짜에 가장 가깝던 구간—에만 해당한다. 실제 청구를 지배하는 출력은 350%, 캐시 미스 입력은 200%다. 「11배」「1100%+」「350%」는 모두 맞지만 과금 축이 다르다. 절대 금액이 가장 작은 줄이 헤드라인을 먹었다.
  2. 공식 API가 자동으로 가장 싸지 않다. 피크 시간 DeepSeek 공식 리스트는 GMI Cloud, Novita 등 일부 재판매가보다 높아졌다. 한가 시간 V4-Pro는 여전히 Claude Opus 5보다 싸지만, 알리바바 국제 Qwen3.8-Max($2/$6)와 OpenAI GPT-5.6 Luna($0.20/$1.20)는 적어도 한 축에서 DeepSeek 한가 요금을 밑돈다.
  3. 오픈웨이트 ≠ Apache 2.0. 알리바바는 커스텀 Qwen3.8-Max License를 붙였다. 12개월 매출 5000만 달러를 넘는 Model-as-a-Service 또는 AI 업무 비서 사업은 별도 상업 라이선스를 협상해야 한다. 미국·EU·영국·한국 다운로드 금지설은 거짓이다. 공개 본문에 지역 조항은 없다.

2. 타임라인: 무슨 일이, 언제

날짜사건
2026-07-16문샷 Moonshot, Kimi K3(2.8조 파라미터) 오픈웨이트. 미측 안보 주시를 이미 받음
2026-08-02~03알리바바, Qwen3.8-Max 예고 후 클라우드 API 오픈
2026-08-10Meta, Muse Glimmer(300억, Apache 2.0) 공개. 플래그십 Muse Spark 1.2 가중치 「곧 공개」 예고
2026-08-12알리바바, Qwen3.8-2.4T-A95B 가중치를 Hugging Face/ModelScope에 공개. 같은 날 xAI Grok 4.6
2026-08-13DeepSeek-V4-Pro 정식 출시, 8월 17일 인상 공지. 구글은 인하한 Gemini 3.7 Flash
2026-08-14지푸, GLM-5.3 출시. GLM-5.2의 7430억 파라미터 기반 모델을 그대로 사용
2026-08-17 00:00 베이징DeepSeek 신규 요금 발효

렌즈를 더 당기면 그림이 선명해진다. 7월 30일 OpenAI는 최저 티어 GPT-5.6 Luna를 80% 내렸고, 8월 6–7일에는 Luna를 무료 사용자 기본 모델로 올리고 텍스트 대화를 무제한으로 열었다. 중국 랩이 인상과 플래그십 가중치 공개를 더하는 바로 그 주, 미국 랩은 소비층에서 무료와 인하를 더했다. 우연이 아니라 같은 가격 전쟁의 양면이다.

3. 숫자: 무엇이 실제로 바뀌었나

DeepSeek 인상 명세 (8월 17일 00:00 베이징 발효; 피크는 09–12시, 14–18시)

과금 항목 (100만 토큰당)인상 전한가 (신규)피크 (신규)피크 인상폭
V4-Flash 캐시 히트 입력¥0.02¥0.05¥0.10약 400%
V4-Flash 캐시 미스 입력¥1.0¥1.5¥3.0200%
V4-Flash 출력¥2.0¥4.5¥9.0350%
V4-Pro 캐시 히트 입력¥0.025¥0.15¥0.30약 1100%
V4-Pro 캐시 미스 입력¥3.0¥4.5¥9.0200%
V4-Pro 출력¥6.0¥13.5¥27.0350%

헤드라인 1100%는 피크 캐시 히트 입력 한 줄이다. 최고 약 12배(1100%+)이지만 절대 금액은 여전히 작다. 제3자 비용 모델링은 현실적인 헤비 워크로드(월 약 8400만 토큰, 대부분 한가, 캐시 히트 절반)의 청구 증가를 약 1.8배로 본다. 체감은 있지만 11배 헤드라인과는 거리가 멀다. 헤비 유저에게 더 아픈 줄은 출력 350%와 캐시 미스 입력이다.

Qwen3.8-2.4T-A95B (Qwen3.8-Max 오픈웨이트) 핵심 스펙

항목수치
파라미터총 2.4조, 토큰당 활성 950억 (MoE, 전문가 512, 라우팅 10 + 공유 1)
컨텍스트오픈 체크포인트 네이티브 262,144 토큰(26.2만), 약 101만까지 확장. 클라우드 Max 기본 100만 토큰
출시 리듬8월 2일 예고 → 8월 3일 API → 8월 12일 가중치 공개
API 요금 (국제)입력 $2/M, 출력 $6/M
라이선스Apache 2.0 아님. 커스텀 Qwen3.8-Max License
의미알리바바 역사상 첫 Max급(플래그십) 가중치 공개. Qwen3.5/3.6/3.7 Max는 API 전용

GLM-5.3 vs GLM-5.2: 같은 기반 모델, 후훈련만

벤치마크GLM-5.2GLM-5.3변화
Terminal-Bench 3.04.6%28.3%+23.7
DeepSWE v1.146.2%66.9%+20.7
Agents' Last Exam (CLI)23.8%28.5%+4.7
CyberGym77.2%84.5%+7.3
AutomationBench26.2%48.2%+22.0

위 수치는 지푸 공식 자체 측정이다. 독립 제3자 재측정은 아직 없다. Terminal-Bench 3.0에서 GLM-5.3은 여전히 GPT-5.6 Sol(34.6%), Claude Fable 5(33.7%)에 뒤진다. 프론티어 정상 탈환이 아니라 오픈웨이트 1군 진입이다. 일부 보도가 말하는 「같은 기반 모델 약 50% 도약」은 벤치마다 폭이 다른 묶음 표현으로 읽어야 한다.

4. 세 가지 수, 세 가지 논리

DeepSeek: 바닥 단가에서 시간대 요금으로 — 전략 선회가 아니라 용량 고백

가장 쉬운 오독은 「중국 최저가 모델이 마진에 굴복했다」이다. 요금표 구조를 보면 반대에 가깝다. 회사는 처음으로 컴퓨트 제약을 가격에 노출했다. 예전 단일 저가는 GPU가 수요를 따라가는 동안 고객 획득 도구였다. 호출이 지수로 늘고 용량이 못 따라가자, 무언가는 명시되어야 했다. 공지의 「더 유연한 워크로드 스케줄링을 장려한다」는 기업어다. 번역하면 「피크 컴퓨트가 부족하니 네가 시간을 옮겨라」다.

해외 보도가 거의 놓친 디테일: 피크 시간 DeepSeek 공식 API는 일부 제3자 재판매(GMI Cloud, Novita 등, 현재 V4-Pro 호가가 공식 피크보다 낮음)보다 비싸다. 「공식 경로가 항상 가장 싸다」는 DeepSeek 평판의 핵심 가정이 처음으로 깨졌다.

알리바바: 가중치는 생태계를 사고, 커스텀 라이선스는 매출 천장을 지킨다

Qwen3.8-Max 공개는 단순한 자선이 아니다. 알리바바는 동시에 두 일을 했다. 2.4조 파라미터 체크포인트를 무료 다운로드로 풀었고, 작은 Qwen에 쓰던 Apache 2.0이 아닌 커스텀 라이선스를 붙였다. 12개월 매출 5000만 달러를 넘는 Model-as-a-Service 또는 AI 업무 비서 사업은 별도 상업 라이선스를 협상해야 하고, 월간 활성 1억 또는 월 매출 2000만 달러를 넘는 제품은 모델명을 화면에 뚜렷이 표시해야 한다.

논리: 가중치를 풀어 개발자 마인드셰어를 산다. 특히 「중국산 모델」이 기업 구매에서 아직 주저를 부르는 해외에서. 동시에 그 위에 경쟁 추론 사업을 세울 수 있는 소수 대고객에 대한 가격 레버리지는 남긴다. Meta Muse Glimmer의 무제한 Apache 2.0과는 차원이 다른 베팅이다. 「오픈웨이트」라는 같은 단어가 두 릴리스에서 같은 뜻이 아니다.

죽일 루머 하나: 알리바바 라이선스가 미국·EU·영국·한국 다운로드를 금지한다는 주장. 거짓이다. 공개 LICENSE 본문에 지역·영토 조항은 없다. 릴리스가 이 속도로 돌면, 공지 스레드가 아니라 LICENSE 파일을 읽는 데 몇 초면 충분하다.

GLM-5.3: 새 기반 모델 없음, 더 큰 후훈련 베팅 — 그게 본편이다

가장 흥미로운 사실은 점수가 아니라 방법이다. GLM-5.2와 같은 7430억 파라미터 기반 모델, 재사전학습 없음, Terminal-Bench 3.0에서 4.6% → 28.3%(약 6배)는 후훈련 강화 학습 환경을 키운 결과다. 사전학습 스케일링 법칙의 한계효용이 둔화하는 국면에서, 후훈련 RL 스케일은 새 파운데이션을 다시 깎는 것보다 비용 바닥이 훨씬 낮은 독립 레버가 됐다. 중위 랩의 진입 장벽이 실제로 내려갔다는 뜻이다. 「인테리어만으로 1군에 붙는다」는 이야기가 숫자로 나온 주이다.

5. 횡비교: DeepSeek는 여전히 가장 싼 프론티어급인가

모델입력 (100만 토큰)출력 (100만 토큰)오픈웨이트
DeepSeek V4-Pro (피크)¥9.0 (약 $1.26)¥27.0 (약 $3.78)아니오
DeepSeek V4-Pro (한가)¥4.5 (약 $0.63)¥13.5 (약 $1.89)아니오
Qwen3.8-Max (국제 API)$2.00$6.00예 (커스텀 라이선스)
OpenAI GPT-5.6 Luna$0.20$1.20아니오
Claude Opus 5 (알리바바 배수 관계로 추정)약 $5.00약 $25.00아니오

위안-달러 환산은 약 ¥7.15/$1, 참고용이다. 실제는 공식 공지가 우선한다. 짧은 답: 아니다. 인상 후에도 V4-Pro 한가 요금은 Claude Opus 5보다 분명히 낮지만, 전장 최저가는 아니다. 국제 Qwen3.8-Max와 Luna가 DeepSeek 한가 요금을 밑돈다. 「중국 모델=최저가」는 2025년과 2026년 초까지는 대체로 맞았다. 지금은 안전한 가정이 아니다. 가격 경쟁은 계층 단계로 들어갔다.

인용 숫자: V4-Pro 피크 캐시 히트 입력 ¥0.025 → ¥0.30(약 1100%); 출력 ¥6.0 → ¥27.0(350%); Qwen3.8-Max 국제 $2/$6; GLM-5.3 Terminal-Bench 3.0 4.6% → 28.3%, 같은 7430억 기반 모델, 재사전학습 없음.

6. 논쟁과 미검증 디테일

  • 1100% 헤드라인은 기술적으로 맞지만 맥락 없이 오도한다. 피크 캐시 히트 입력에만 해당한다. 실제 청구를 지배하는 출력은 350%다. 매체마다 다른 줄을 전체인 것처럼 인용했다.
  • Qwen3.8-Max가 알리바바 자체 전오(Zhenwu) M890 칩과 「반고 AL128」 슈퍼노드에서 돈다는 주장은 여러 중국 경제지에 등장하지만, 알리바바 자체 기술 문서나 제3자 벤치로 독립 확인되지 않았다. 벤더 인접, 미검증으로 표시한다.
  • GLM-5.3이 Cursor의 「심각한 취약점」을 발견했다는 이야기는 VentureBeat와 지푸 측 공개에서 나온다. 구체 기술 세부는 미공개다. 벤더 일방 공개이지 독립 감사 결과가 아니다.
  • 중국 상무부가 AI/반도체 보복 수출 통제를 준비 중이라는 보도는 미확인 매체 추측이다. 공식 발표가 아니다. 배경 참고로만 둔다.

7. 5단계 점검: 스택을 다시 가격 매기는 법

  1. 과금 줄을 쪼개라. 청구서 전체에 1100%를 곱하지 마라. 캐시 히트 입력, 캐시 미스 입력, 출력은 세 개의 델타다. 피크는 베이징 09–12시, 14–18시다.
  2. 배치를 한가 시간으로 옮겨라. 공식 공지가 유연한 스케줄링을 요구한다. 독립 모델링상 헤비·대부분 한가·캐시 히트 절반 워크로드는 약 1.8배이지 11배가 아니다.
  3. 공지 스레드가 아니라 Qwen LICENSE를 읽어라. 개인 프로젝트와 사내 사용은 사실상 무관하다. 함정은 12개월 매출 5000만 달러를 넘는 Model-as-a-Service 또는 AI 업무 비서 사업이다. 월활 1억 또는 월 매출 2000만 달러면 모델명 표기가 필요하다. 지역 금지는 없다.
  4. GLM-5.3 점수는 벤더 자체 보고로 취급하라. 4.6% → 28.3% Terminal-Bench 점프는 후훈련만이다. 공개된 독립 재측정은 없다. 여전히 GPT-5.6 Sol(34.6%), Claude Fable 5(33.7%)에 뒤진다.
  5. 「가장 싼 중국 모델」 대신 계층 라우팅. 한가 DeepSeek V4-Pro는 여전히 Claude Opus 5를 밑돈다. 국제 Qwen3.8-Max와 GPT-5.6 Luna는 적어도 한 축에서 DeepSeek 한가를 밑돈다. 피크에서는 GMI Cloud, Novita를 공식 리스트와 대조하라.
# DeepSeek V4-Pro (CNY / 1M tokens, Beijing time) # peak: 09:00-12:00, 14:00-18:00 v4_pro_cache_hit = {"old": 0.025, "offpeak": 0.15, "peak": 0.30} # ~1100% v4_pro_cache_miss = {"old": 3.0, "offpeak": 4.5, "peak": 9.0} # 200% v4_pro_output = {"old": 6.0, "offpeak": 13.5, "peak": 27.0} # 350% # Qwen3.8-Max intl API: $2 in / $6 out # GPT-5.6 Luna: $0.20 in / $1.20 out fx_cny_per_usd = 7.15 # approx; official notice wins

8. 왜 중요한가: 동시에 돌아가는 두 개의 가격 전쟁

지난 한 달, 중국 헤드 랩의 출시 밀도는 국내 경제지가 「一周三更」(주 3회 업데이트)이라 부르기 시작했다. DeepSeek, 알리바바, 지푸에 더해 문샷 Kimi K3(7월 16일 오픈웨이트, 2.8조 파라미터), MiniMax H3가 연달아 나왔다. 중국 보도의 프레임은 대체로 「중국 오픈웨이트가 글로벌 AI 산업의 재가격을 강요한다」이다. 같은 사건을 영어권 테크 언론이 개별 제품 뉴스로 쪼개 읽는 것과 온도가 다르다.

미국 랩은 소비층에서 반대 플레이를 돌린다. OpenAI는 7월 30일 최저 티어를 80% 내린 뒤, 일주일 만인 8월 6–7일 그 모델을 무료·무제한으로 열었다. 구글은 8월 13일, 3주 전 전작의 절반 가격으로 코딩 특화 모델을 냈다. 중국은 플래그십 가중치를 풀고 컴퓨트 병목 상단에 계층 인상을 얹는다. 미국은 소비 끝에서 무료와 저가로 달린다. 둘 다 진짜 전략이다. 퍼널의 다른 층을 최적화할 뿐이다.

지정학 층도 조심스럽게 이름을 붙여야 한다. 7월 Kimi K3 오픈웨이트는 이미 미측 안보 심사를 불렀다. 알리바바가 이 창에 2.4조 플래그십을 푼 것을, 일부 분석은 규제 조임 전에 국제 마인드셰어와 「기술 대등」 서사를 선점한 수로 읽는다. 확인된 사실이 아니라 정보에 기반한 해석이다. 다만 영어권 테크 언론만 읽으면 잘 안 보이는 맥락이다. 그쪽은 이 릴리스들을 국가 패턴이 아니라 고립된 제품 뉴스로 다뤘다.

Meta 쪽은 Llama 시대 오픈소스 자세의 「부분 회귀」에 그친다. Muse Glimmer는 300억 증류 소형이지 진짜 플래그십이 아니다. 마크 저커버그는 더 큰 폐쇄형 Muse Spark 1.2 가중치를 「곧」 열겠다고 했다. 그 한 수가 실제로 떨어지면 미국 플래그십급이 처음으로 열리는 사건이 된다. 집필 시점에는 아직 없다. 선언된 의도이지 확정 사실이 아니다.

운영자의 실무 응답은 진영 선택이 아니다. 장부를 쪼개는 것이다. 피크 vs 한가, 캐시 히트 vs 미스, 라이선스 임계, 벤더 자체 보고 vs 제3자 재측정. 클라우드 API는 여전히 버스트와 플래그십 A/B에 맞다. 공식 피크가 최저 호스트가 아니고 오픈 체크포인트가 조 단위 MoE로 점프하면, 노트북 통합 메모리와 24/7 에이전트 스택이 먼저 무너진다. 더 깨끗한 통제 경로는 긴 컨텍스트와 상시 에이전트를 단일 공식 피크 SKU에 남기지 않고, 계량되는 원격 Mac 노드에 주차하는 것이다.

9. FAQ

인상 후 DeepSeek는 GPT-5.6이나 Claude보다 여전히 싼가?
한가 요금은 여전히 Claude Opus 5보다 싸다. 다만 전장 최저가는 아니다. OpenAI GPT-5.6 Luna($0.20/$1.20 per million tokens)와 알리바바 국제 Qwen3.8-Max($2/$6)가 적어도 한 축에서 새 한가 요금을 밑돈다. 프론티어급으로는 여전히 상대적 저가이지, 절대 최저가는 아니다. 호출이 한가(베이징 09–12, 14–18 밖)에 몰리고 캐시 히트가 높으면 체감은 헤드라인 350%·1100%보다 낮고, 분석 측 헤비 유저 실청구는 약 1.8배다. 피크 + 낮은 캐시 히트면 헤드라인에 근접한다.

알리바바 Qwen3.8-Max 오픈웨이트를 상업 제품에 무료로 쓸 수 있나?
대부분 가능하다. 개인 프로젝트와 사내 사용은 사실상 무관하다. 함정은 연속 12개월 매출 5000만 달러를 넘는 Model-as-a-Service 또는 AI 업무 비서 사업이다. 그 층은 알리바바와 별도 상업 라이선스가 필요하다. 월활 1억 또는 월 매출 2000만 달러면 모델명 표기가 추가된다.

Qwen3.8-Max는 미국·EU·영국 사용자에게 금지인가?
아니다. 온라인에 돌았지만 거짓이다. 공개 라이선스에 지역 제한은 없다. 제한은 매출 기준이지, 당신이나 사용자의 위치가 아니다. 한국 금지설도 같은 루머다.

GLM-5.3과 GLM-5.2는 실제로 무엇이 다른가?
기반 모델 수준에서는 아무것도 없다. 둘 다 7430억 파라미터 파운데이션이다. 성능 이득(Terminal-Bench 3.0에서 약 6배)은 전부 후훈련 강화 학습 스케일업에서 나온다. 더 큰 기반 모델을 다시 깎지 않았다.

Meta는 작은 Muse Glimmer가 아니라 플래그십도 열 것인가?
아직 아니다. Muse Glimmer는 300억 증류 모델이다. 저커버그는 Muse Spark 1.2 가중치를 「곧」이라고 했다. 집필 시점에는 그 릴리스가 없다. 선언된 의도로 취급하라.

10. 출처

  • DeepSeek 공식 인상 공지. 월가견문(华尔街见闻), IT之家, AIGC.cn, V2EX 커뮤니티 교차 확인
  • 알리바바 공식 Qwen 저장소(Hugging Face / ModelScope)와 사우스차이나모닝포스트(SCMP) 라이선스 조항 보도
  • 지푸(Z.ai) GLM-5.3 공식 기술 페이지, VentureBeat·StableLearn 보도
  • Meta AI Research 공식 블로그와 VentureBeat의 Muse Glimmer 보도
  • 중국 경제지(제일재경/第一财经, 소후재경)의 오픈웨이트 출시 리듬·프레임 종합

가격, 라이선스, 벤치 수치는 게재 시점 공개 정보다. 재발행 전 최신 공식 요금과 라이선스를 다시 확인하라. 위에서 미검증으로 표시한 항목(국산 칩 주장, Cursor 취약점 보고, 수출 통제 소문)은 독립 확인되지 않았다.

11. 마무리: 피크 요금이 오른 뒤에도, 통제 스택은 어디에든 착지해야 한다

호스티드 API는 여전히 돌아간다. 제약이 이제 명시됐을 뿐이다. 피크 리스트가 최저가를 보장하지 않고, 커스텀 라이선스가 대형 상업 사용자를 회수하며, 2.4조 MoE 체크포인트는 노트북 일이 아니다. Windows·Linux GPU 박스는 처리량 추론에는 괜찮지만 Cursor 툴체인, 상시 OpenClaw, MLX 양자화 점검, 그래픽 인접 워크플로에서는 대개 더 나쁘다. DeepSeek 한가 라우팅, Qwen 오픈웨이트 시험, GLM-5.3 코딩 벤치를 한 세트의 재현 환경에 두려면, 긴 컨텍스트와 에이전트 상주를 MACGPU 원격 Mac에 주차하라. SSH로 들어가고, 노드를 계량하고, 노트북은 편집용으로 남기고, 모든 토큰을 단일 공식 피크 SKU에 밀어 넣지 마라. API 한도가 먼저 보이고, 그다음 맥이 필요해지며, 그 맥을 원격으로 빌리는 경로가 가장 짧다.