알리바바(Alibaba)가 큐원4(Qwen4) 정식판에 앞서 차세대 아키텍처를 적용한 큐원3.8-플래시-넥스트(Qwen3.8-Flash-Next)를 한국시간 8월 27일 0시에 공개한다.
블록비트는 모델스코프(ModelScope)에 큐원3.8-플래시-넥스트 예고 페이지가 올라왔다고 전했다. 공개 시점은 중국시간 8월 26일 오후 11시로 제시됐으며, 한국시간으로는 8월 27일 0시다.
이번 모델은 큐원4를 구동할 차세대 아키텍처 기반의 다중모달 혼합전문가(MoE) 모델로 소개됐다. 큐원4 정식판 출시는 아니며, 후속 큐원4 모델군에 앞서 개발자와 커뮤니티가 새 구조를 먼저 확인하는 기술 미리보기 성격이다.
다중모달은 텍스트뿐 아니라 이미지 등 여러 형태의 입력을 함께 처리하는 모델 구조를 뜻한다. 혼합전문가 모델은 모든 매개변수를 매번 쓰지 않고 작업에 필요한 일부만 활성화하는 방식으로, 대형 모델의 처리 비용과 응답 속도를 조정하는 설계로 활용된다.
알리바바가 먼저 내세운 것은 제품명보다 구조다. 정식 큐원4가 나오기 전 새 아키텍처를 공개해 후속 모델군에 대한 개발 환경과 검증 흐름을 앞당기려는 움직임으로 풀이된다.
블록비트는 알리바바가 앞서 큐원3-넥스트(Qwen3-Next)에서 게이티드 델타넷(Gated DeltaNet)과 일반 어텐션을 결합한 하이브리드 구조를 도입했고, 이후 큐원3.5 계열이 이 설계를 이어갔다고 전했다. 이번 발표도 새 구조를 먼저 공개한 뒤 후속 제품군으로 확장하는 흐름에 놓여 있다.
알리바바의 모델 공개 속도도 관심을 끈다. 블록비트는 알리바바가 이달 초 2.4T 매개변수 규모의 큐원3.8-맥스(Qwen3.8-Max)를 공개한 뒤 한 달이 지나기 전에 다음 세대 아키텍처 공개를 예고했다고 전했다.
[본지는 앞서 알리바바가 큐원3.8 계열 모델을 오픈소스로 공개했다](https://www.tokenpost.kr/news/cryptocurrency/391304)고 전했다. 당시 보도에서는 큐원3.8-27B가 270억 매개변수 규모의 네이티브 멀티모달 덴스 모델로 소개됐다.
덴스 모델은 모든 매개변수를 일관되게 사용하는 구조인 반면, 혼합전문가 모델은 일부 전문가 네트워크를 선택적으로 활성화한다. 배포 환경의 단순성은 덴스 모델이, 대규모 모델 운용 효율은 혼합전문가 구조가 각각 비교되는 지점이다.
오픈 모델 생태계에서 개발자는 성능 지표뿐 아니라 라이선스, 가중치 공개 방식, 추론 비용, 장문 맥락 처리, 다중모달 지원 여부를 함께 본다. 큐원3.8-플래시-넥스트가 실제로 어떤 라이선스와 가중치, 벤치마크를 제시할지는 27일 공개 이후 확인된다.

