Mistral 7B 모델을 파인튜닝하여 기존 모델보다 성능을 높이고 30만 달러를 절감했어요. 파인튜닝이 무용지물이라고 생각했지만, LoRA/QLoRA 어댑터가 RAG보다 훨씬 효과적이었어요. 개인용 GPU로도 QLoRA를 활용하여 LLM을 파인튜닝할 수 있으며, 수학적 원리도 자세히 설명해요.