Introduction to LLM

This page provides an easy-to-understand guide on LLMs (Large Language Models) from basics to applications for AI enthusiasts.


Total of 36 articles available. | Currently on page 1 of 1.

제12장 — 접근 제어와 신원

OAuth·mTLS·RBAC·ABAC의 LLM 이식, 멀티테넌트 격리의 세 접근, 그리고 SAML·SCIM·감사 로그가 만드는 엔터프라이즈 거버넌스 오버레이.

2026-05-21

제11장 — 관측 가능성, 로깅, 사건 대응

확률적 시스템에서 로깅해야 할 것, 시그니처·통계·행동 신호를 조합한 탐지, 그리고 재현 가능성을 확보하는 NIST 800-61 형태의 사건 대응.

2026-05-20

제10장 — 안전한 LLM 아키텍처 설계

격리가 폭발 반경을 제한하는 방식, 계층화된 검증과 선언적 정책, 그리고 모델 호출에 적용된 제로 트러스트로 침해된 프롬프트가 시스템 침해로 상승하지 못하게 하는 아키텍처.

2026-05-19

제7장 — 환각과 신뢰성

환각의 두 메커니즘 — 사실성과 충실성 실패, 신경망의 구조적 과신, 그리고 캘리브레이션·RAG 접지·human-in-the-loop로 이루어지는 신뢰성 엔지니어링.

2026-05-16

제2장 — LLM 시스템의 위협 모델링

Shostack의 네 질문, STRIDE와 PASTA, MITRE ATLAS를 LLM 시스템에 적용. 자산 목록·적대자 카탈로그·위협 등록부를 채우는 작업 템플릿을 걷습니다.

2026-05-11

제15장 — 서버리스 API 대 전용 인프라

손익분기 산수를 테이블에 올리고, 대부분의 팀에게 답을 뒤집는 플랫폼 엔지니어링 라인 아이템에 이름을 붙이는 장.

2026-05-07

제14장 — 토큰 경제학과 API 가격

제1장의 물리를 청구서의 라인 아이템에 연결하고, 첫 달의 청구서가 왜 팀이 모델링한 것과 닮지 않는 경우가 많은지 설명하는 장.

2026-05-06

제12장 — 분리 서빙과 쿠버네티스

프리필과 디코드를 별도 GPU 풀로 나누고, 파드가 인터커넥트의 올바른 쪽에 안착하도록 하는 쿠버네티스 프리미티브를 걷는 장.

2026-05-04

제11장 — 플랫폼과 오케스트레이션 계층

플랫폼 선택은 기능이 아니라 어느 운영 모델이 팀의 기존 운영 문화에 맞는가의 문제라고 주장하는 장.

2026-05-03

제10장 — LLM 엔진 계층

엔진과 플랫폼 사이의 경계에 이름을 붙이고, 2026년 그 계층을 지배하는 다섯 엔진을 걷는 장.

2026-05-02

LLM Primer VI — 시리즈 서문 및 목차

LLM Primer VI — AI 시스템 확장하기의 16개 챕터를 하루 한 편씩 걷는 워크스루의 서문입니다. 메모리 대역폭, 스케줄링, 그리고 청구서가 만나는 지점에서 LLM 추론을 엔지니어링 학문으로 다룹니다.

2026-04-22

제8장 — 성능, 서빙, 비용 최적화

프로덕션 LLM 경제학을 층진 규율로 다루는 장. 가장 저렴한 호출은 결코 이루어지지 않는 호출이고, 아래 각 층은 다음 호출을 저렴하게 만들어 주는 층입니다.

2026-04-21

제7장 — LLM 보안과 가드레일

LLM 애플리케이션이 새로 들여오는 보안 축을 명명하고, 그 위에 네 층의 완화 매트릭스를 세우는 장. 원리는 하나 — 권한은 신뢰 출처와 일치해야 합니다.

2026-04-20

제6장 — AI 관측성과 트레이싱

사용자 질의를 요청 로그가 아니라 인과 트리로 다루고, 그 트리가 읽히기 위해 무엇이 트레이스되어야 하는지 보이는 장.

2026-04-19

제5장 — LLM 애플리케이션 평가하기

LLM 출력에는 assertEqual이 죽었음을 인정하고, 앵커된 판정자, RAG 트라이어드, 궤적 테스트를 중심으로 테스트 규율을 다시 세우는 장.

2026-04-18

제4장 — AI 에이전트와 도구 호출

언어 모델을 도구를 상대로 루프 도는 행위자로 바꾸는 엔지니어링을 다루는 장. 스키마, 메모리 층, 그리고 다중 에이전트 배선이 데모를 프로덕션 행위자로 만듭니다.

2026-04-17

제3장 — 검색 증강 생성

RAG 파이프라인을 끝에서 끝까지 걷고, 열 개의 즐겨찾기 문서에서만 잘 돌아가는 데모와 실제 코퍼스와 접촉하고도 살아남는 시스템 사이의 차이를 그리는 장.

2026-04-16

제1장 — AI 엔지니어링이라는 학문

데모는 잘 돌아가는데 프로덕션 시스템이 무너지는 이유는 모델 문제가 아니라 엔지니어링 문제입니다. 제1장은 확률적 코어 주위를 감싸는 결정적 래퍼를 세우고, 신뢰성·품질·성능·비용·진화라는 다섯 기둥으로 그 학문을 그립니다.

2026-04-14

LLM Primer V — 시리즈 소개 및 목차

LLM Primer V 워크스루 시리즈의 시작. AI 엔지니어링을 프롬프트 트릭이 아니라 하나의 학문 분야로 다루는 제5권을, 8개 장을 따라 하루에 한 편씩 살핍니다.

2026-04-13

제14장 — 벤치마킹, 테스트, 성능

LLM Primer IV 워크스루의 열다섯 번째이자 마지막 글입니다. 실제 서버 위의 MCP-Universe 벤치마크, 그것이 드러낸 두 가지 시스템적 실패 모드, 세션당 요청과 공유 세션 풀 사이의 10배 처리량 격차, 그리고 제5권으로의 다리를 살핍니다.

2026-04-12

제13장 — 프레임워크와 클라우드 통합

LLM Primer IV 워크스루의 열세 번째 글입니다. Bedrock과 함께한 Strands, AWS 상태 층 패턴, Microsoft Agent Framework, LangChain, Semantic Kernel — 그리고 팀이 독립적으로 거듭 도착하는 세 가지 프로덕션 통합 모양을 살핍니다.

2026-04-11

제12장 — 프로토콜 하드닝과 방어

LLM Primer IV 워크스루의 열두 번째 글입니다. 네 가지 방어 군집 — 암호화 증명, 유계 세션을 가진 OAuth 범위 규율, 런타임 샌드박싱, 사람-개입 게이트 — 이 적대적 조건에서 모델이 올바르게 행동하는 것에 의존하지 않는 자세로 조합되는 모습을 살핍니다.

2026-04-10

제10장 — 장기 호라이즌 작업 메모리

LLM Primer IV 워크스루의 열 번째 글입니다. 윈도와 ReAct 스크래치패드를 통한 단기 메모리, 일화적 벡터와 의미적 저장소를 통한 장기 메모리, 그리고 에이전트가 시간과 일을 가로질러 생산적으로 유지되게 하는 압축 기법을 살핍니다.

2026-04-08

제9장 — 주의력 예산 관리

LLM Primer IV 워크스루의 아홉 번째 글입니다. 컨텍스트 부패, 가운데에서 잃어버린 절벽, 도구 로드아웃 부패, 그리고 모델의 빠진 지식이 실제로 어디에 속하는지에 대한 세 가지 아키텍처적 답 — MCP, RAG, 파인튜닝 — 을 살핍니다.

2026-04-07

제8장 — 아키텍처 배포 레이아웃

LLM Primer IV 워크스루의 여덟 번째 글입니다. MCP 생태계에서 떠오른 세 가지 배포 레이아웃 — 재사용 가능한 에이전트, 엄격한 순수성, 하이브리드 — 과 어느 것이 어느 프로젝트에 맞는지 결정하는 네 가지 묶이는 제약을 살핍니다.

2026-04-06

제7장 — 고급 협업 및 동적 패턴

LLM Primer IV 워크스루의 일곱 번째 글입니다. 라운드테이블 합의, 핸드오프 라우팅, 마젠틱 오케스트레이션 — 토폴로지가 요청별로 만들어져야 할 때 떠오르는 패턴들과 더 단순한 패턴이 피하는 실패 모드(비종료, 잘못된 라우팅, 폭주 계획)를 살핍니다.

2026-04-05

제4장 — 클라이언트 프리미티브: 에이전트형 행동과 제어

LLM Primer IV 워크스루의 네 번째 글입니다. 샘플링, 루트, 일리시테이션은 MCP가 호스트-서버 벽에 뚫는 세 개의 작고 제어된 구멍입니다 — 각각 호스트가 서버에 빌려주는 능력이며, 각각 사용자를 대신해 받아들이는 위험입니다.

2026-04-02

제3장 — 서버 프리미티브: 컨텍스트와 능력의 노출

LLM Primer IV 워크스루의 세 번째 글입니다. MCP 서버가 내놓을 수 있는 세 개의 명사 — Resources(읽기 상태), Prompts(재사용 가능한 스캐폴드), Tools(쓰기 행동) — 와 그 스키마, 라이프사이클, 오류 모델, 그리고 알맞은 프리미티브를 고르는 규율을 살핍니다.

2026-04-01

제10장 — 주요 평가 프레임워크

LLM Primer III 워크스루의 열 번째 글입니다. 평가 트라이어드에 도구 모음이 붙은 자리 — 두 진영의 여덟 프레임워크 — 그리고 그중 누구도 아직 풀지 못한 부분에 대한 한 차례 정직한 인정.

2026-03-27

제3장 — 고급 청킹 프레임워크

LLM Primer III 워크스루의 세 번째 글입니다. 고정 크기에서 구조 인지까지 이어지는 청킹 스펙트럼, 오버랩 미신, 검색을 조용히 무너뜨리는 컨텍스트 클리프, 그리고 최전선의 셈을 다시 짠 컨텍스추얼 리트리벌과 레이트 청킹을 함께 살펴봅니다.

2026-03-20

제1장 — RAG 아키텍처의 진화

LLM Primer III 워크스루의 첫 번째 글입니다. RAG의 네 가지 아키텍처 자세 — 나이브, 어드밴스드, 모듈러, 에이전틱 — 를 한 결정씩 LLM에게 권한을 더 넘겨주는 이야기로 읽고, 검색보다 파인튜닝이 더 나은 도구가 되는 자리를 솔직하게 짚습니다.

2026-03-18

제8장 — 모델 한 대로는 부족할 때: 도구 사용과 에이전트

LLM Primer I 시리즈 제8장입니다. 모델을 모델 바깥의 결로 확장하는 자리 — 도구 사용, 함수 호출, 에이전트 — 그리고 2026 에디션의 새 절 §8.6 "에이전트 패턴"의 큰 가닥을 함께 풀어 봅니다.

2026-02-25

제7장 — 모델을 더 영리하게 쓰는 방식: 프롬프트 엔지니어링

LLM Primer I 시리즈 제7장입니다. 같은 모델을 두 배쯤 영리하게 만들어주는 프롬프트의 갈래들 — 시스템 프롬프트, 퓨샷 예시, 사고의 사슬, 역할 설정 — 그리고 그 갈래들이 왜 통하는지를, 다음 토큰 예측의 메커니즘과 이어 풀어 봅니다.

2026-02-24

제5장 — 그래도 작은 결함이 남아 있다

LLM Primer I 시리즈 제5장입니다. 잘 학습된 LLM도 여전히 갖고 있는 결함 — 환각, 시간 감각의 결손, 계산의 약점, 출력의 일관성 흔들림 — 의 정체를 들여다보고, 그것이 왜 "버그"가 아니라 같은 메커니즘에서 함께 나오는 "특성"인지를 풀어 봅니다.

2026-02-22

제1장 — 대규모 언어 모델이란 무엇인가 (헤드라인 너머)

LLM Primer I 시리즈 제1장입니다. "대규모", "언어", "모델"이 정말로 가리키는 것이 무엇인지 풀어내고, 룰 기반 시스템에서 뉴럴 네트워크로 옮겨온 과정을 짚고, 현대 LLM의 작동에 대한 세 가지 큰 오해를 다룹니다. 앞으로 이어질 모든 내용의 토대가 될, 명료하고 읽기 쉬운 입구입니다.

2026-02-18

LLM 입문서 시리즈 — 생성형 AI를 한 권씩 풀어내는 일곱 권의 안내서

LLM Primer 시리즈 — Sho Shimoda의 생성형 AI 필드 가이드, 이제 완결. 기초부터 보안까지 7권 전권. 자매 볼륨 Physical AI도 포함. 7권 모두 Amazon에서 판매 중.

2026-02-15