WonderRico가 Qwen3.8-Flash-Next-NVFP4 모델이 로컬 LLM 벤치마크에서 뛰어난 성능을 보인다고 밝혔어요. 중간 추론 작업에서 요청당 점수와 생성 토큰당 점수 모두 가장 효율적이었어요. 언더트레인된 모델임에도 불구하고 높은 성능을 기록하며 놀라움을 자아냈어요.
Qwen3.8-Flash-Next-NVFP4는 다른 모델 대비 요청당 점수와 토큰당 점수에서 우수한 효율성을 보였으며, 128K 컨텍스트를 지원해요. Reddit 커뮤니티에서 공개된 블랙웰 성능 테스트 결과에서도 높은 점수를 기록했어요.
WonderRico는 Qwen3.8-Flash-Next-NVFP4 모델의 성능을 테스트한 결과, 기존 모델 대비 높은 효율성을 확인했으며, 관련 벤치마크 상세 정보는 GitHub 페이지에서 확인할 수 있다고 전했어요.