LLM 파인튜닝 고급 ① — RLHF/헌법AI 큰 그림 | DAKER 학습
고급 · 약 130분
보상모델·RLHF·헌법 AI의 큰 그림을 그리고, 언제 어떤 정렬 파이프라인이 필요한지 고른다.
커리큘럼
- RLHF 큰 그림
- 보상모델
- 헌법 AI 감각
- 미니 랩: 파이프라인 선택
- 퀴즈 — LLM 파인튜닝 고급 ①
- 플래시카드
- 실습 프롬프트
고급 · 약 130분
보상모델·RLHF·헌법 AI의 큰 그림을 그리고, 언제 어떤 정렬 파이프라인이 필요한지 고른다.