사용자가 WinterMix 방법 개선을 통해 Qwen3.5-122B-A10B 모델의 3비트 양자화 모델을 출시했습니다. 이 모델은 59GB 용량을 가지며, 긴 컨텍스트 환경에서 기존 모델보다 뛰어난 성능을 보입니다.
WinterMix38 모델은 16K 컨텍스트에서 기존 MLX 빌드 및 원본 GGUF 모델을 능가하며, 특히 긴 세션 작업에서 강점을 보입니다. 이 모델은 Apple Silicon 장치에서 더 빠른 성능을 제공합니다.
새로운 어닐링 프로세스를 통해 추론 체인을 개선하여 3비트 양자화 모델의 성능을 향상시켰으며, Apache 2.0 라이선스로 배포되었습니다.