알리바바 Qwen3.8-Flash-Next 공개 — Qwen4 아키텍처 선행 체험판, 토큰당 6B만 활성화
알리바바가 8월 26일 오픈 가중치 멀티모달 모델 Qwen3.8-Flash-Next를 공개했다. 총 1,250억 파라미터 중 토큰당 60억만 활성화하는 MoE 구조로, 차세대 Qwen4 아키텍처를 미리 선보이는 개발자용 선행 공개다.
- Alibaba
- Qwen
- LLM
- 오픈소스
- MoE
- 모델출시
6건의 기사
알리바바가 8월 26일 오픈 가중치 멀티모달 모델 Qwen3.8-Flash-Next를 공개했다. 총 1,250억 파라미터 중 토큰당 60억만 활성화하는 MoE 구조로, 차세대 Qwen4 아키텍처를 미리 선보이는 개발자용 선행 공개다.
LG AI리서치가 7월 31일 K-EXAONE 2.0을 Hugging Face에 Apache 2.0 라이선스로 공개했다. 총 7,500억(750B) 파라미터, 활성 370억(37B) 파라미터의 혼합 전문가(MoE) 모델로, 한국어 포함 10개 언어와 262K 토큰 컨텍스트를 지원하는 현재 국내 최대 규모 AI 파운데이션 모델이다.
Mira Murati가 이끄는 Thinking Machines Lab이 창업 9개월 만에 첫 오픈웨이트 AI 모델 Inkling을 발표했다. MoE 구조의 975B 파라미터 멀티모달 모델로, 완제품보다 기업 맞춤화의 출발점으로 포지셔닝된다.
NVIDIA가 5,500억 파라미터 MoE 하이브리드 모델 '네모트론 3 울트라'를 오픈웨이트로 공개했다. Artificial Analysis 지능 지수 미국 오픈소스 1위(48점)를 기록했으며, 허깅페이스·NVIDIA NIM에서 상업 이용 가능한 OpenMDW-1.1 라이선스로 배포된다.
DeepSeek이 4월 24일 V4 Pro를 프리뷰 공개했다. 총 1.6조 파라미터(활성 490억)의 MoE 아키텍처, 100만 토큰 컨텍스트, MIT 라이선스로 SWE-bench Verified 80.6%를 달성하며 출력 토큰당 $0.87에 제공한다.
알리바바가 오픈소스 코딩 특화 MoE 모델 Qwen3-Coder-Next를 공개했다. 총 800억 파라미터 중 추론 시 30억만 활성화하는 초희소 구조로, 동급 밀집 모델 대비 처리량이 최대 10배 높다.