LLM介绍

本页面为AI爱好者提供从基础到应用的大型语言模型(LLM)指南。


共有8篇文章。 | 当前在第1页,共1页。

第 16 章 — 安全的微调与适配

LLM Primer VII 章节走读第 16 篇。这一章把微调后的模型当作一份"必须去挣、不是继承来的"安全性质的 artefact —— 因为教域内术语的同一步梯度,也能侵蚀基础模型带来的对齐。

2026-05-25

第 13 章 — 自动扩缩与冷启动缓解

LLM Primer VI 章节走读第 13 篇。默认 HPA 在 LLM 流量上会造成故障 —— 按队列深度、TTFT、KV 占用扩缩,并用 CRIU 温存快照把冷启动压到 3–6 秒。

2026-05-05

LLM Primer VI — 系列导读与目录

《LLM Primer VI: Scaling AI Systems》章节走读的第一篇。这一卷把 LLM 推理当成一门工程学科:内存带宽、调度、每一美元的账单,在同一块芯片上撞在一起。十六章分成六个部分,一层层走过硬件、模型压缩、运行时、平台和经济学。

2026-04-22

第 7 章 — LLM 安全与护栏

LLM Primer V 章节走读第 7 篇。给 LLM 应用引入的那条新安全轴取一个名字 —— 控制哪些指令能到达模型、从哪里来、带着多少权限 —— 再围绕它搭起四层缓解矩阵。原则:权限必须匹配来源的信任度。

2026-04-20

第 11 章 — 持续更新与流水线优化

LLM Primer III 章节走读最末一篇。流水线没有「做完」这件事 — 文档在变、查询在漂、模型在换 — 负它的团队学着在三种时间尺度上同时思考。结尾接到第四本 — MCP。

2026-03-28

第 9 章 — RAG 评测三件套

LLM Primer III 章节走读第九篇。三种不同的故障塌成同一种症状 — 这个领域为此发明了一只三头的度量,终于告诉团队:那个症状对的是哪一种故障。

2026-03-26

第11章 — 评估、校准与推理

LLM Primer II 章节走读第十一篇。怎么去衡量一个什么都能说的机器 — 困惑度、校准、benchmark 上那条少有人写的误差线,以及"测量幻觉"那件事的数学。

2026-03-13

第 3 章 — 文本在模型里是怎么流动的

LLM Primer I 章节走读第三篇。token 进了模型之后到底经历了什么 — 嵌入、注意力、Transformer — 不被矩阵淹没,也不丢精度。

2026-02-20