Alibaba Cloud가 Qwen3.8-Flash-Next 모델을 공개했어요. 기존 Qwen3.8 모델보다 추론 속도가 2배 빨라졌고, 메모리 사용량도 줄였어요. FlashAttention-2를 활용하여 성능을 최적화했어요. Qwen3.8-Flash-Next는 7B와 13B 두 가지 버전으로 제공되며, Apache License 2.0으로 공개돼 누구나 사용할 수 있어요. 개발자들은 Hugging Face에서 모델을 다운로드할 수 있어요.