Pulse · AI 뉴스

M2 울트라에서 DeepSeek V4 Flash 최적화: 더 작고 빠른 성능

DeepSeek · 2026-08-23

Agusx1211 사용자가 M2 울트라 칩에서 DeepSeek V4 Flash 모델을 최적화한 결과, 기존 GGUF 파일보다 작은 141GB 용량으로 더 빠른 속도를 달성했어요.

SSD 캐시와 동적 레인을 활용하여 100만 토큰 컨텍스트를 지원하며, M3 울트라보다도 빠른 25.8t/s의 속도를 보여줘요.

GitHub 저장소를 통해 관련 코드를 공개했으며, 추가적인 최적화를 통해 성능을 더욱 향상시킬 수 있을 것으로 기대돼요.

##DeepSeek##llama.cpp##최적화##M2울트라##모델
매일 핵심 AI 소식을 한국어로, 빠르게
App Store 에서 Pulse 받기 앱에서 열기