알리바바가 Qwen 3.8-Flash-Next를 발표하고 Qwen 4 아키텍처를 미리 볼 예정입니다
알리바바 Qwen 팀은 수요일에 Qwen 3.8-Flash-Next를 발표할 예정입니다. 이는 혼합 전문가(MoE) 모델로, 총 매개변수는 1250억에 달하지만 각 토큰은 60억 매개변수만 활성화됩니다. 팀은 이를 차세대 Qwen 4 아키텍처의 미리보기 버전으로定位하고 있으며, 최종 플래그십 모델이 아닙니다.
이 모델은 다중 모달로 설명되며, 곧 출시될 Qwen 4 아키텍처를 기반으로 구축되었습니다. 팀은 이 초기 버전을 조기에 출시한 이유는 개발자들이 후속 완전한 Qwen 시리즈를 준비할 수 있도록 하기 위함이라고 밝혔습니다. 모델 가중치는 Hugging Face와 ModelScope 플랫폼에 호스팅될 예정입니다.
현재까지 Qwen은 이 모델의 벤치마크 성적을 발표하지 않았으며, 자사 Qwen 3 시리즈나 해외 경쟁 제품과의 비교 데이터도 공개하지 않았습니다. 1250억과 60억 매개변수의 구체적인 숫자는 공식적으로 확인되지 않았습니다. 오픈 가중치 모델로서, 개발자는 무료로 다운로드하고 미세 조정하며 실행할 수 있으며, 데이터를 폐쇄 API로 전송할 필요가 없어 모델 호스팅 비용을 줄이는 데 도움이 됩니다.






