references
참고 출처 — 03 학습·정렬·RLHF
섹션 제목: “참고 출처 — 03 학습·정렬·RLHF”| # | 파일 | 인용 위치 | verbatim |
|---|---|---|---|
| S1 | sources/05-ai-fundamentals/llm-basics/illustrating-rlhf-huggingface.md | 01·02 — 3단계, KL 페널티, reward hacking | false |
| S2 | sources/05-ai-fundamentals/llm-basics/rlhf-chip-huyen.md | 01·02·03 — untamed completion, behavior cloning, paradox | false |
| S3 | sources/05-ai-fundamentals/llm-basics/finetuning-large-language-models-raschka.md | 02 — 미세조정 일반론 | false |
| S4 | sources/16-youtube-transcripts/karpathy/karpathy-deep-dive-into-llms.md | 01 — 학습 스택 개관 | false |
| S5 | sources/01-anthropic-official/prompting/building-effective-agents.md | 03·예시01 — 단순 패턴 권고 | false |
verbatim:false 주의
섹션 제목: “verbatim:false 주의”모든 1차 출처가 요약본이다. 직접 인용은 본문에 명시한 한국어 의역을 신뢰의 1차 단위로 삼고, 정확한 영문은 원문 URL에서 다시 확인할 것. Constitutional AI에 대한 1차 자료(01-anthropic-official/prompting/)는 본 패스 시점에 별도 파일로 분리되어 있지 않다 — refresh-sources 후속 패스에서 보강 대상.