20260903- SFT vs DPO 자가진화 루프의 핵심 차이점DPO, 다층 RAG, LoRA SFT의 삼각 공조 체계는 AI 환각을 차단하고 소형 실동 모델의 성능 한계를 극복하는 가장 진보된 자가개선 설계입니다.1. LLM 진화 모델의 핵심 기술다층 RAG 컨텍스트 주입(Short-Term Loop)LoRA SFT(Supervised Fine-Tuning) 지도 학습(Long-Term Loop)DPO(Direct Preference Optimization, 직접 선호도 최적화) 기술DPO, 다층 RAG, LoRA SFT의 삼각 공조 체계는 AI 환각을 차단하고 소형 실동 모델의 성능 한계를 극복하는 가장 진보된 자가개선 설계입니다.다층 RAG 컨텍스트 주입 (Short-Term Loop - 단기 루..