LLM 파인튜닝 고급 ① — RLHF/헌법AI 큰 그림 | DAKER 학습

고급 · 약 130분

보상모델·RLHF·헌법 AI의 큰 그림을 그리고, 언제 어떤 정렬 파이프라인이 필요한지 고른다.

커리큘럼