Pulse · AI 뉴스

Qwen3.8-Flash-Next 공개: 빠른 추론 속도와 효율성

Qwen · 2026-08-27

Alibaba Cloud가 Qwen3.8-Flash-Next 모델을 공개했어요. 기존 Qwen3.8 모델보다 추론 속도가 2배 빨라졌고, 메모리 사용량도 줄였어요. FlashAttention-2를 활용하여 성능을 최적화했어요.

Qwen3.8-Flash-Next는 7B와 13B 두 가지 버전으로 제공되며, Apache License 2.0으로 공개돼 누구나 사용할 수 있어요. 개발자들은 Hugging Face에서 모델을 다운로드할 수 있어요.

##Qwen##FlashAttention##AlibabaCloud##모델출시##오픈소스
매일 핵심 AI 소식을 한국어로, 빠르게
App Store 에서 Pulse 받기 앱에서 열기