llama.cpp 프로젝트에서 TENSOR_READ_LAZY 기능을 추가하여 모델 로더를 개선했어요. 이 기능은 Qwen 3.8 Next Flash (Qwen 4) engrams를 VRAM/RAM에 로드할 필요성을 줄여줘요.