본문으로 건너뛰기
뉴스 목록

알리바바, 2.4조 파라미터 Qwen3.8-Max 공개 — 중국 최대 AI 모델

한 줄 요약: 알리바바가 총 2.4조 파라미터(실활성 950억)의 MoE 모델 Qwen3.8-Max를 공개해, Arena.AI 텍스트 리더보드에서 중국 1위·비전 부문 글로벌 2위에 올랐다.

핵심

  • 규모: 2.4조 파라미터 MoE(혼합 전문가) 구조, 추론 시 950억 파라미터만 활성화 — Qwen 시리즈 역대 최대.
  • 멀티모달: 텍스트·이미지·영상 입력을 모두 지원하며, 텍스트 응답에 최적화됐다.
  • 벤치마크: Arena.AI 크라우드소싱 평가에서 중국 모델 텍스트 1위, 비전 태스크 글로벌 2위(Claude Fable 5 변형 모델 다음). 상위 Anthropic 모델에는 아직 뒤처진다.
  • 배포·오픈소스: Alibaba Cloud Model Studio API와 QwenWork(기업 에이전트 플랫폼)에서 즉시 이용 가능. 가중치는 다음 주 오픈소스 공개 예정.

왜 중요한가

중국 AI 랩들이 점점 미국 최고 모델에 근접하고 있다는 신호다. 2.4조 파라미터 MoE 오픈소스 모델이 공개되면, 저비용 추론을 원하는 개발자·기업에게 또 하나의 강력한 대안이 생긴다. 알리바바가 올해 초 일부 플래그십 모델을 독점화했다가 다시 오픈소스 전략으로 복귀했다는 점도 주목할 만하다.

더 보기

이 이야기의 흐름

  1. 알리바바, '역대 최강' AI 모델 공개
  2. 알리바바, 새 AI로 미국 우위에 재도전
  3. Anthropic, Alibaba가 Claude 불법 증류 감행했다고 미 상원서 주장 — 가짜 계정 2만 5천 개·2,880만 건 교환
  4. Anthropic, 알리바바가 2만5천 가짜 계정으로 클로드 AI 역대 최대 '증류 공격' 감행했다고 미 상원에 고발
LLM
— Large Language Model의 약자로, '거대 언어 모델'이라고 해요. ChatGPT, Claude 같은 AI가 바로 LLM이에요. 엄청나게 많은 텍스트를 학습해서 사람처럼 글을 쓰고 대화할 수 있어요.
파라미터
— AI 모델이 학습으로 갖게 되는 '지식의 매듭' 같은 거예요. 보통 수십억~수조 개로, 많을수록 더 똑똑해지는 경향이 있지만 비용과 속도도 함께 늘어나요. 그래서 요즘은 크기보다 효율을 중시해요.

뉴스레터 구독

무료 뉴스레터

매주 핵심 AI 소식, 한 번에 받기

쏟아지는 AI·LLM 뉴스 중 꼭 알아야 할 것만 골라 메일로 보내드려요. 뉴스레터 발송이 시작되면 구독자분들께 가장 먼저 보내드립니다.