사용자가 Ninfer를 활용해 RTX 5090에서 Qwen3.8 27B 모델을 실행하며 놀라운 성능을 경험했어요. 기존 llama.cpp 대비 처리 속도가 두 배 이상 향상돼 큰 만족감을 표했습니다. 24000 토큰 컨텍스트를 지원하며, 초당 220 토큰까지 처리 가능합니다.