DeepGrove가 Maple Preview라는 20B A1B MoE 모델을 공개했어요. 이 모델은 Mac에서 효율적인 로컬 추론을 위해 설계됐으며, 5.31GB의 작은 크기를 자랑합니다.
Tau-2 벤치마크 테스트 결과, Maple Preview는 Sonnet이나 Qwen만큼의 성능은 아니지만, 웹 검색과 연동하면 간단한 질문에 대한 답변이 가능합니다.
Codex와 Mference를 활용해 Maple Preview를 통합한 결과, Air M4에서 40tps의 생성 성능을 달성했으며, 500MB의 RAM만 사용합니다. 이는 기존 방식보다 훨씬 효율적인 결과입니다.