Introduction to LLM

This page provides an easy-to-understand guide on LLMs (Large Language Models) from basics to applications for AI enthusiasts.


Total of 3 articles available. | Currently on page 1 of 1.

제16장 — 안전한 파인튜닝과 적응

파인튜닝된 모델을 물려받는 것이 아니라 획득해야 할 아티팩트로 다루기. 정렬 침식, 소규모 데이터 오염, CI 평가 게이트, 그리고 롤백 규율.

2026-05-25

제10장 — 사후 학습과 정렬의 수학

LLM Primer II 시리즈 제10장입니다. 똑똑하지만 길들지 않은 다음 토큰 예측기를, 쓸 만한 어시스턴트로 길들이는 자리 — 지도 파인튜닝, 보상 모델, KL 페널티 위의 RLHF, 그리고 강화학습 파이프라인 전체가 하나의 지도학습 손실로 접히는 DPO의 우아한 유도까지 함께 풀어 봅니다.

2026-03-12

제6장 — 안전, 정렬, 그리고 모델이 "도움이 된다"는 것의 의미

LLM Primer I 시리즈 제6장입니다. "유창함"과 "도움이 됨"이 어떻게 다른지를 짚고, 정렬(alignment)이 정확히 무엇을 다듬는 일인지를 풀어 봅니다. 그리고 2026 에디션에서 새로 더한 §6.6 — 헌법형 AI, 디버틀 모델, 새로운 정렬 연구의 가닥 — 의 맛보기까지 함께.

2026-02-23