Ling Tiny가 Gemma4-12B를 대체하여 hindsight 작업에 활용돼요. 4060Ti GPU에서 실행하는데 속도가 매우 빠르다고 해요. MTP를 비활성화하고 BailingMoE3를 위한 vLLM 포크를 설정하는 것을 추천해요. Reddit 사용자가 4060Ti GPU에서 Ling Tiny를 실행한 경험을 공유하며, 속도가 매우 빠르다고 언급했어요. vLLM 포크를 활용하면 더 좋은 성능을 얻을 수 있다고 덧붙였어요.