LiquidAI가 LFM2.5 모델 패밀리의 DSpark draft 모델 체크포인트를 공개했어요. LFM2.5-1.2B-Instruct, LFM2.5-2.6B, LFM2.5-8B-A1B 모델이 포함됐어요.
DSpark는 메모리 사용량은 늘리지 않고 추론 속도를 향상시키는 기술로, GPU에서는 최대 3.18배, 온디바이스에서는 최대 2.87배의 속도 향상을 제공해요.
특히 LFM2.5-2.6B 모델은 MacBook에서 기존 클라우드 모델보다 빠른 속도(~140 tok/s)를 보여주며, 함수 호출 지연 시간을 평균 57% 단축했어요.