Introduction to LLM
This page provides an easy-to-understand guide on LLMs (Large Language Models) from basics to applications for AI enthusiasts.
제11장 — 관측 가능성, 로깅, 사건 대응
확률적 시스템에서 로깅해야 할 것, 시그니처·통계·행동 신호를 조합한 탐지, 그리고 재현 가능성을 확보하는 NIST 800-61 형태의 사건 대응.
2026-05-20제9장 — 모델 무결성과 공급망 위험
모델을 서드파티가 배포한 바이너리로 다루기. BadNets에서 Sleeper Agents까지, 피클 대 safetensors, 그리고 SLSA·Sigstore·드리프트 모니터링.
2026-05-18제8장 — 모델에 대한 적대적 공격
FGSM에서 TextFooler·보편적 접미사까지의 계보, API 예산이 시사하는 것보다 저렴한 블랙박스 공격, 그리고 블랙박스를 사실상 화이트박스로 바꾸는 모델 탈취.
2026-05-17제7장 — 환각과 신뢰성
환각의 두 메커니즘 — 사실성과 충실성 실패, 신경망의 구조적 과신, 그리고 캘리브레이션·RAG 접지·human-in-the-loop로 이루어지는 신뢰성 엔지니어링.
2026-05-16제5장 — 입력 검증과 출력 필터링
단계적 위생 처리, 방어로서의 구조화된 출력, Llama Guard와 NeMo Guardrails, 그리고 Garak·PyRIT로 안전을 측정하는 방법.
2026-05-14LLM Primer VII — 시리즈 소개 및 목차
LLM Primer VII: AI 보안의 챕터별 워크스루 소개. 위협 모델부터 규제 경계까지, 시리즈의 마지막 권에서 엔지니어링 아크가 적대자와 만나는 지점을 다룹니다.
2026-05-09제6장 — 프루닝과 지식 증류
가중치 개수를 직접 공격하는 장 — 먼저 중요하지 않은 가중치를 영으로 만들고, 그다음에는 큰 모델의 행동을 더 작은 모델로 옮깁니다.
2026-04-28제1장 — 토큰 생성의 기제
LLM 서빙의 거의 모든 어려운 질문은 한 사실에서 내려옵니다 — 각 토큰을 만드는 루프는 메모리 대역폭에 묶여 있고, 비싼 연산 유닛은 99.7퍼센트의 시간을 놀립니다.
2026-04-23제2장 — 파운데이션 모델과 프롬프트 엔지니어링
프롬프트 엔지니어링을 예술이 아니라 엔지니어링으로 다루는 장. 모델 선택, 샘플링 파라미터, 방어적 프롬프트 해부학, 그리고 스키마를 강제하는 구조화 출력 — 네 개의 제어 표면.
2026-04-15제1장 — AI 엔지니어링이라는 학문
데모는 잘 돌아가는데 프로덕션 시스템이 무너지는 이유는 모델 문제가 아니라 엔지니어링 문제입니다. 제1장은 확률적 코어 주위를 감싸는 결정적 래퍼를 세우고, 신뢰성·품질·성능·비용·진화라는 다섯 기둥으로 그 학문을 그립니다.
2026-04-14제11장 — 모델을 더 작게, 더 영리하게
LLM Primer I 시리즈 제11장입니다. 큰 모델을 어떻게 작고 빠르게 만들어 운영의 결에 맞추는가 — 디스틸레이션, 양자화, MoE — 그리고 2026 에디션의 새 절 §11.6 "추론 모델"의 큰 그림을 함께 풀어 봅니다.
2026-02-28제7장 — 모델을 더 영리하게 쓰는 방식: 프롬프트 엔지니어링
LLM Primer I 시리즈 제7장입니다. 같은 모델을 두 배쯤 영리하게 만들어주는 프롬프트의 갈래들 — 시스템 프롬프트, 퓨샷 예시, 사고의 사슬, 역할 설정 — 그리고 그 갈래들이 왜 통하는지를, 다음 토큰 예측의 메커니즘과 이어 풀어 봅니다.
2026-02-24제5장 — 그래도 작은 결함이 남아 있다
LLM Primer I 시리즈 제5장입니다. 잘 학습된 LLM도 여전히 갖고 있는 결함 — 환각, 시간 감각의 결손, 계산의 약점, 출력의 일관성 흔들림 — 의 정체를 들여다보고, 그것이 왜 "버그"가 아니라 같은 메커니즘에서 함께 나오는 "특성"인지를 풀어 봅니다.
2026-02-22제2장 — 확률, 토큰, 그리고 텍스트
LLM Primer I 시리즈 제2장입니다. 토큰이 단어와 어떻게 다른지, 모델이 매번 만들어내는 "다음 토큰 후보들의 확률 분포"가 정확히 무엇인지, 그리고 같은 모델이 따분한 글과 창의적인 글을 같이 쓸 수 있게 해주는 샘플링 노브 — temperature와 top-p — 의 정체를 풀어냅니다.
2026-02-19제1장 — 대규모 언어 모델이란 무엇인가 (헤드라인 너머)
LLM Primer I 시리즈 제1장입니다. "대규모", "언어", "모델"이 정말로 가리키는 것이 무엇인지 풀어내고, 룰 기반 시스템에서 뉴럴 네트워크로 옮겨온 과정을 짚고, 현대 LLM의 작동에 대한 세 가지 큰 오해를 다룹니다. 앞으로 이어질 모든 내용의 토대가 될, 명료하고 읽기 쉬운 입구입니다.
2026-02-18LLM Primer I 챕터별 워크스루 — 시리즈 서문과 인덱스
『LLM Primer I: 생성 AI는 어떻게 작동하는가』를 챕터별로 소개하는 12회 시리즈의 서문과 인덱스입니다. 2026년 2월 18일부터 3월 1일까지 매일 한 편씩. 차례로 따라 읽어도, 관심 가는 챕터만 골라 읽어도 됩니다. 열두 편의 글을 여기서 한꺼번에 찾을 수 있습니다.
2026-02-17LLM 입문서 시리즈 — 생성형 AI를 한 권씩 풀어내는 일곱 권의 안내서
LLM Primer 시리즈 — Sho Shimoda의 생성형 AI 필드 가이드, 이제 완결. 기초부터 보안까지 7권 전권. 자매 볼륨 Physical AI도 포함. 7권 모두 Amazon에서 판매 중.
2026-02-15