2.4조 파라미터가 공개된다… Qwen의 파격이 오픈AI를 위협하는 이유

알리바바가 Qwen3.8-Max(2.4T)의 오픈 가중치를 8월 12일 공개한다. Max급 모델의 첫 오픈, 오픈 가중치 진영의 새 기준.

H
Huuush발행 2026.08.07 · 5분 read에디터: Jay Kim

3줄 요약

  • 알리바바가 총 2.4조 파라미터 규모의 Qwen3.8-Max를 오픈 가중치로 공개하며, 'Max급' 모델의 오픈 가중치 공개는 이번이 처음이다.
  • 공개는 2026년 8월 12일 오전 10시(UTC+8)에 예정됐고 로컬 배포용 27B 밀집 모델도 함께 나오며, 2.4T 본체는 데이터센터급 환경이라야 운영할 수 있다.
  • API 가격은 입력 $2·출력 $6로 저렴하고 멀티모달·문서 작업이 강점이지만 코딩 벤치마크는 상대적으로 약하며, 라이선스는 아직 확정 전이다.

알리바바의 Qwen3.8-Max가 오픈 가중치로 공개된다. 총 파라미터 2.4T(2조 4천억) 규모로, 'Max급' 모델이 오픈 가중치로 나온 것은 이번이 처음이다. 공개 시각은 2026년 8월 12일 오전 10시(UTC+8, 한국 시간 오전 11시)로 예고됐다.

Qwen3.8-Max 모델 아키텍처 다이어그램
Qwen3.8-Max — 2.4T 파라미터, MoE 구조로 토큰당 활성 파라미터 약 950억 (출처: X 포스트)

2.4조 파라미터를 푼다, 먼저 봐야 할 스펙

  • 총 파라미터: 2.4T (희소 MoE — 토큰당 활성 파라미터 약 95B)
  • 컨텍스트: 최대 100만 토큰
  • 멀티모달: 텍스트·이미지·영상 입력 지원
  • 공개처: Hugging Face·ModelScope, 8/12 오전 10시(UTC+8)
  • 함께 공개: 로컬 배포용 Qwen3.8-27B(27B 밀집)

API에 갇혀 있던 Max급, 이제 직접 내려받는다

지금까지 Qwen의 Max급 모델은 API로만 제공됐다. 오픈 가중치로 나온 것은 상위 성능 모델을 직접 내려받아 운영할 수 있다는 뜻이다. 다만 2.4T는 멀티노드 데이터센터급 아티팩트라 대부분은 로컬에서 못 돌리고, 로컬 운영은 27B가 맡는다.

입력 $2·출력 $6, 싼 만큼 무엇이 다른가

  • API 가격: 입력 $2 / 출력 $6 (100만 토큰 기준) — GPT-5.6 Sol 대비 약 60~80% 저렴
  • 강점: 멀티모달·문서 작업 (PaperBench 93.0 vs Claude Fable 5의 88.8)
  • 약점: 코딩 벤치마크 SWE-bench Pro 67.7 (Fable 5는 80.0)
  • 자율 코딩: 16일간 무인 코딩 265 커밋·127 PR·151 이슈 기록

가격 싸움에서 실무 생산성으로, 오픈 진영의 다음 수

Qwen·Kimi 등 오픈 가중치 진영이 '가격·성능' 논쟁을 '실무 생산성' 영역으로 확장하고 있다. 이번 Max 오픈은 그 흐름에서 가장 큰 단일 사건이다. 라이선스(Apache 2.0 여부)는 아직 확정 전이지만, 기존 Qwen 오픈 릴리스는 Apache 2.0이었다.

2.4T 공개 뒤에 남은 질문, 누가 실제로 돌릴 수 있나

오픈 가중치 진영이 'API 전용 상위 모델'의 벽을 처음 넘었다는 점에서 이번 공개는 상징적이다. 다만 2.4T의 실질 활용은 데이터센터 운영자에게 한정된다. 8월 12일 공개 후 라이선스·실측 성능을 확인하는 것이 관건이다.

관련: Alibaba Cloud · Quartz · TechRepublic

자주 묻는 질문

이 글에서 다룬 벤더