AtomicChat 팀이 Qwen 3.8 27B MLX Vision Quant를 제작하고 커뮤니티에서 배포하는 다른 모델과 성능을 비교했어요. 저비트 파일은 BF16 모델을 가르침으로써 증류 방식으로 학습되었으며, 11.8GB 모델은 70.32%의 Top-1 정확도를 기록했어요. 결과는 Hugging Face 컬렉션에서 확인할 수 있으며, AtomicChat 앱에서 직접 실행해볼 수 있어요.
H200 NVL 환경에서 4096 컨텍스트로 테스트한 결과, 11.8GB 모델은 다른 12GB 모델보다 훨씬 높은 성능을 보여줬어요. 16GB MacBook에서도 실행 가능하며, wired limit 설정을 통해 13-14GB 메모리 활용이 가능해요.
AtomicChat 앱을 통해 다양한 MLX 빌드를 실행하고 피드백을 공유할 수 있으며