Introduction to LLM

This page provides an easy-to-understand guide on LLMs (Large Language Models) from basics to applications for AI enthusiasts.


Total of 30 articles available. | Currently on page 1 of 1.

제13장 — 규제 지형

EU AI 법의 단계적 적용, AI 시스템에도 여전히 구속력을 갖는 GDPR·CCPA·PIPL, 그리고 감사 가능성·모델 카드·위험 분류가 만드는 운영 형태.

2026-05-22

제12장 — 접근 제어와 신원

OAuth·mTLS·RBAC·ABAC의 LLM 이식, 멀티테넌트 격리의 세 접근, 그리고 SAML·SCIM·감사 로그가 만드는 엔터프라이즈 거버넌스 오버레이.

2026-05-21

제9장 — 모델 무결성과 공급망 위험

모델을 서드파티가 배포한 바이너리로 다루기. BadNets에서 Sleeper Agents까지, 피클 대 safetensors, 그리고 SLSA·Sigstore·드리프트 모니터링.

2026-05-18

제6장 — 검색 증강 생성의 위험

RAG 파이프라인의 다섯 신뢰 경계, 인덱스를 통한 인젝션 공격, PoisonedRAG와 BadRAG, 그리고 아키텍처적으로 안전한 검색 패턴.

2026-05-15

제5장 — 입력 검증과 출력 필터링

단계적 위생 처리, 방어로서의 구조화된 출력, Llama Guard와 NeMo Guardrails, 그리고 Garak·PyRIT로 안전을 측정하는 방법.

2026-05-14

제3장 — 데이터 보안과 프라이버시

LLM 시스템에서 데이터를 수명주기 자산으로 다루기. 학습 코퍼스의 저작권과 PII, 암기와 추출 공격, 그리고 Samsung과 Garante 사건이 규정한 사용자 입력 처리 규율.

2026-05-12

제1장 — 왜 AI 보안은 다른가

LLM 보안이 코드 보안이 아닌 이유. 확률적 시스템의 행동 포락선이 공격 표면이 되며, 프롬프트·검색·도구·학습·모델·출력의 여섯 표면이 새로운 신뢰 경계를 규정합니다.

2026-05-10

제16장 — 프로덕션의 비용 절감 전략

지난달 청구서의 3분의 1이나 절반으로 복리로 쌓이는 서로 독립적인 수의 카탈로그.

2026-05-08

제10장 — LLM 엔진 계층

엔진과 플랫폼 사이의 경계에 이름을 붙이고, 2026년 그 계층을 지배하는 다섯 엔진을 걷는 장.

2026-05-02

제9장 — 투기적 디코딩

자기회귀의 순차 병목에 수학적 허점이 있다는 것, 그리고 언제 그 허점이 이득이 되는지의 산수를 보여 주는 장.

2026-05-01

제4장 — 특화 AI 실리콘과 ASIC

GPU와 ASIC의 선택은 워크로드 모양의 문제입니다 — 이 장은 그 모양을 줍니다.

2026-04-26

제2장 — KV 캐시라는 과제

KV 캐시는 산술을 메모리와 맞바꿉니다 — 그리고 그 메모리는 배치, 시퀀스 길이, 레이어 수, 헤드 수, 헤드 차원에 동시에 비례합니다. 그래서 서빙 클러스터는 다른 어떤 자원보다 VRAM이 먼저 떨어집니다.

2026-04-24

제6장 — AI 관측성과 트레이싱

사용자 질의를 요청 로그가 아니라 인과 트리로 다루고, 그 트리가 읽히기 위해 무엇이 트레이스되어야 하는지 보이는 장.

2026-04-19

제5장 — LLM 애플리케이션 평가하기

LLM 출력에는 assertEqual이 죽었음을 인정하고, 앵커된 판정자, RAG 트라이어드, 궤적 테스트를 중심으로 테스트 규율을 다시 세우는 장.

2026-04-18

제13장 — 프레임워크와 클라우드 통합

LLM Primer IV 워크스루의 열세 번째 글입니다. Bedrock과 함께한 Strands, AWS 상태 층 패턴, Microsoft Agent Framework, LangChain, Semantic Kernel — 그리고 팀이 독립적으로 거듭 도착하는 세 가지 프로덕션 통합 모양을 살핍니다.

2026-04-11

제12장 — 프로토콜 하드닝과 방어

LLM Primer IV 워크스루의 열두 번째 글입니다. 네 가지 방어 군집 — 암호화 증명, 유계 세션을 가진 OAuth 범위 규율, 런타임 샌드박싱, 사람-개입 게이트 — 이 적대적 조건에서 모델이 올바르게 행동하는 것에 의존하지 않는 자세로 조합되는 모습을 살핍니다.

2026-04-10

제10장 — 장기 호라이즌 작업 메모리

LLM Primer IV 워크스루의 열 번째 글입니다. 윈도와 ReAct 스크래치패드를 통한 단기 메모리, 일화적 벡터와 의미적 저장소를 통한 장기 메모리, 그리고 에이전트가 시간과 일을 가로질러 생산적으로 유지되게 하는 압축 기법을 살핍니다.

2026-04-08

제8장 — 아키텍처 배포 레이아웃

LLM Primer IV 워크스루의 여덟 번째 글입니다. MCP 생태계에서 떠오른 세 가지 배포 레이아웃 — 재사용 가능한 에이전트, 엄격한 순수성, 하이브리드 — 과 어느 것이 어느 프로젝트에 맞는지 결정하는 네 가지 묶이는 제약을 살핍니다.

2026-04-06

제6장 — 기초 오케스트레이션 전략

LLM Primer IV 워크스루의 여섯 번째 글입니다. 두 기초 오케스트레이션 모양 — 순차 파이프라인과 동시 산-수집 — 과 모든 팀이 먼저 물어야 할 선행 질문을 살핍니다. 다중 에이전트 시스템이 정말 알맞은 답인가?

2026-04-04

제2장 — Model Context Protocol(MCP)의 베일 벗기

LLM Primer IV 워크스루의 두 번째 글입니다. MCP가 실제로 무엇을 표준화하는지, Host·Client·Server의 세 역할 분할, 중요한 경우에 동적 발견과 양방향 메시징이 REST와 어떻게 다른지, 그리고 능력 협상으로 열리는 세션 라이프사이클을 봅니다.

2026-03-31

제1장 — AI 통합 위기와 에이전트형 아키텍처의 부상

LLM Primer IV 워크스루의 첫 번째 글입니다. 시스템 프롬프트가 자라며 모놀리식 에이전트가 닳아 가는 과정, 그 밑에 숨은 N 곱하기 M 통합 문제, 그리고 MCP가 가능하게 하기 위해 만들어진 프롬프트 엔지니어링에서 컨텍스트 엔지니어링으로의 이행을 살핍니다.

2026-03-30

LLM Primer IV — 시리즈 소개 및 인덱스

LLM Primer 시리즈 제4권의 챕터별 워크스루를 여는 글입니다. 에이전트가 데모를 넘어 확장되려면 왜 프로토콜 층이 필요한지, 누구를 위해 이 책을 썼는지, 그리고 3월 30일부터 4월 12일까지 이어질 열네 편의 포스트 일정을 정리합니다.

2026-03-29

제7장 — 접근 제어 구현

LLM Primer III 워크스루의 일곱 번째 글입니다. 문서 수준 ACL을 토대로, Microsoft Purview 민감도 레이블과 함께 가는 RBAC, Zanzibar와 SpiceDB로 가는 ReBAC, 그리고 그 모두 아래에서 도는 사전 필터와 사후 필터의 규율을 함께 살펴봅니다.

2026-03-24

제4장 — 올바른 벡터 데이터베이스 선택

LLM Primer III 워크스루의 네 번째 글입니다. 목적별 벡터 데이터베이스와 Postgres 류 확장의 아키텍처적 분기, 매니지드의 선두 주자(Pinecone, Vertex), 오픈소스의 진영(Qdrant, Milvus, Weaviate), 임베디드 옵션, 그리고 실제 선택을 가르는 세 운영 축 — 데이터 거주성, 운영, 비용 — 을 함께 살펴봅니다.

2026-03-21

제11장 — 평가, 보정, 추론

LLM Primer II 시리즈 제11장입니다. 무엇이든 말할 수 있는 기계를 도대체 어떻게 잰단 말인가 — 그리고 "확신에 찬 모델은 거의 늘 보정이 나쁜 모델이라는 사실"을 마주하게 되는 자리. 퍼플렉시티, 보정, 벤치마크의 오차 막대, 환각의 수학을 함께 풀어 봅니다.

2026-03-13

제10장 — 사후 학습과 정렬의 수학

LLM Primer II 시리즈 제10장입니다. 똑똑하지만 길들지 않은 다음 토큰 예측기를, 쓸 만한 어시스턴트로 길들이는 자리 — 지도 파인튜닝, 보상 모델, KL 페널티 위의 RLHF, 그리고 강화학습 파이프라인 전체가 하나의 지도학습 손실로 접히는 DPO의 우아한 유도까지 함께 풀어 봅니다.

2026-03-12

제10장 — 멀티모달: 텍스트를 넘어선 입력

LLM Primer I 시리즈 제10장입니다. 같은 트랜스포머가 어떻게 이미지와 오디오까지 받아들이게 되었는지 — 비전 트랜스포머와 오디오 토큰화의 메커니즘을 풀어내고, "한 모델이 모든 입력을 다 본다"는 그림의 한계와 강점을 정직하게 짚어 봅니다.

2026-02-27

LLM Primer I 챕터별 워크스루 — 시리즈 서문과 인덱스

『LLM Primer I: 생성 AI는 어떻게 작동하는가』를 챕터별로 소개하는 12회 시리즈의 서문과 인덱스입니다. 2026년 2월 18일부터 3월 1일까지 매일 한 편씩. 차례로 따라 읽어도, 관심 가는 챕터만 골라 읽어도 됩니다. 열두 편의 글을 여기서 한꺼번에 찾을 수 있습니다.

2026-02-17

LLM 입문서 시리즈 — 생성형 AI를 한 권씩 풀어내는 일곱 권의 안내서

LLM Primer 시리즈 — Sho Shimoda의 생성형 AI 필드 가이드, 이제 완결. 기초부터 보안까지 7권 전권. 자매 볼륨 Physical AI도 포함. 7권 모두 Amazon에서 판매 중.

2026-02-15

LLM 가이드 (대규모 언어 모델): 생성형 AI의 기초 이해

이 가이드는 GPT, BERT, T5와 같은 대규모 언어 모델(LLM)의 개념과 원리를 쉽게 이해할 수 있도록 정리했습니다. 생성형 AI를支える 핵심 기술인 트랜스포머 구조, 어텐션 메커니즘, 학습 과정, 그리고 실제 응용 사례까지 폭넓게 다룹니다. 머신러닝과 자연어 처리에 관심 있는 독자라면, 이 글을 통해 LLM의 기반을 체계적으로 이해할 수 있습니다.

2024-09-01