LLM介绍
本页面为AI爱好者提供从基础到应用的大型语言模型(LLM)指南。
第 17 章 — 未来威胁与新兴防御
LLM Primer VII 章节走读的第 17 篇,也是本卷和 LLM Primer 系列的收官之作。走看那些还在成形中的学科 —— 自主智能体、多模态攻击面、合成身份,以及 2026 年中期 AI 对 AI 的军备竞赛。
2026-05-26第 4 章 — Prompt Injection 与 Jailbreak
LLM Primer VII 章节走读第 4 篇。位于 LLM 安全实操问题正中央的这一章 —— 解释为什么 prompt injection 没有一个类似参数化查询那样的结构性修复,只有分层的、部分的防御。
2026-05-13LLM Primer VII — 系列引言与索引
《LLM Primer VII: AI Security》章节走读的系列引言与索引 —— LLM Primer 系列的收官之作,把七卷的工程弧线落到那门决定这一切能否在对手、监管者和概率系统日常故障模式面前存活下来的学科。
2026-05-09第 10 章 — LLM Engine 层
LLM Primer VI 章节走读第 10 篇。Engine 是把一个模型跑在一块或几块 GPU 上的单节点运行时。vLLM、TensorRT-LLM、SGLang、TGI、Ollama —— 五个 engine 在同一份工作上做的不同机制层面取舍。
2026-05-02第 9 章 — 投机解码
LLM Primer VI 章节走读第 9 篇。原来自回归的顺序瓶颈里藏着一个数学漏洞:先猜再验。EAGLE、Medusa、Lookahead、MTP —— 以及投机什么时候真的划算的那道算术。
2026-05-01第 5 章 — 拆解量化
LLM Primer VI 章节走读第 5 篇。为什么 70B 模型能扛得住 4-bit 量化,而 1B 模型不能。AWQ、GPTQ、SmoothQuant、GGUF 各自在做什么,以及那份能上生产的校准纪律。
2026-04-27第 3 章 — 面向生成式 AI 的数据中心 GPU
LLM Primer VI 章节走读第 3 篇。挑一块 serving GPU,该看的是 HBM 带宽和 VRAM 容量,而不是数据表正面那个 FLOP/s 数字。这一章走 H100、H200、B200、L40S、MI300X 这五款主流硅片。
2026-04-25LLM Primer VI — 系列导读与目录
《LLM Primer VI: Scaling AI Systems》章节走读的第一篇。这一卷把 LLM 推理当成一门工程学科:内存带宽、调度、每一美元的账单,在同一块芯片上撞在一起。十六章分成六个部分,一层层走过硬件、模型压缩、运行时、平台和经济学。
2026-04-22第 1 章 — AI 集成危机与智能体架构的兴起
LLM Primer IV 章节走读第 1 篇。单体智能体为什么会随着 system prompt 变长而散掉,藏在底下的那个 N 乘 M 集成问题是什么,以及从 prompt 工程转向上下文工程这一步 — MCP 就是为了让这一步走得通而存在的。
2026-03-30第 5 章 — 搭一条检索流水线
LLM Primer III 章节走读第五篇。一次向量搜索是大多数 demo 停下的地方,也是大多数生产故障开始的地方。本章一路走到生成器手里那一组候选,以及每一步存在的理由。
2026-03-22第 1 章 — RAG 架构的演进
LLM Primer III 章节走读第一篇。基础模型有两条结构性的限 — 知识封冻、来源不可指认 — 居然有同一个架构上的答案,而这个答案,三年里长出了四张脸。
2026-03-18第 10 章 — 多模态:走出文本
LLM Primer I 章节走读第十篇。同一个 Transformer 是怎么学会接收图像和音频的 — vision transformer 和音频 token 化 — 以及"一个模型什么都能看"这种说法老老实实的边界在哪。
2026-02-27第 9 章 — RAG:把新鲜信息缝进上下文
LLM Primer I 章节走读第九篇。RAG(检索增强生成)到底在做什么、它是怎么补上模型的时间缺失和事实弱点的,以及好 RAG 和坏 RAG 的分水岭从哪儿开始。
2026-02-26第 3 章 — 文本在模型里是怎么流动的
LLM Primer I 章节走读第三篇。token 进了模型之后到底经历了什么 — 嵌入、注意力、Transformer — 不被矩阵淹没,也不丢精度。
2026-02-20第 2 章 — 概率、token 和文本
LLM Primer I 章节走读第二篇。token 和单词的区别、模型每一步构造出的那整张"下一个 token 概率分布"到底是什么,以及 temperature 和 top-p 怎么改变同一个模型的输出性格。
2026-02-19LLM Primer I — 章节走读:序言与目录
LLM Primer I 章节走读的开篇。整本书是怎么搭起来的、每一章给出什么,以及 2 月 18 日到 3 月 1 日这十二篇连载的发布日程。
2026-02-17LLM Primer 系列 — 一卷一卷读懂生成式 AI 的实战指南
LLM Primer 系列 — 下田昌平(Sho Shimoda)撰写的七卷本生成式 AI 现场指南,现已完结。从基础到安全。含姊妹卷《Physical AI》。全 7 卷均在 Amazon 上架销售。
2026-02-151.0 什么是LLM?大规模语言模型的定义与应用
了解大规模语言模型(LLM)的基本定义、工作原理以及其在自然语言处理中的应用。本文介绍了LLM的功能、优势,以及它如何与传统机器学习模型不同。
2024-09-02
大规模语言模型(LLM)全面指南:原理、应用与训练方法
深入探索大规模语言模型(LLM)的世界。本指南涵盖LLM的定义、在自然语言处理(NLP)中的作用、训练方法以及文本生成、翻译、问答系统和代码生成等实际应用。适合希望利用LLM开发创新解决方案的工程师与开发者。
2024-09-01