LLM介绍
本页面为AI爱好者提供从基础到应用的大型语言模型(LLM)指南。
第 14 章 — 偏见、公平与责任 AI
LLM Primer VII 章节走读第 14 篇。这一章把责任 AI 当作一门在不确定性下做选择的学科来处理 —— 技术工具让权衡浮出水面,但并不替你解决它。
2026-05-23第 6 章 — 检索增强生成的风险
LLM Primer VII 章节走读第 6 篇。这一章把检索语料看作一条不受信任的输入通道 —— 因为在模型眼里,每一份被索引的文档都是一条和用户提问平起平坐的指令。
2026-05-15LLM Primer VII — 系列引言与索引
《LLM Primer VII: AI Security》章节走读的系列引言与索引 —— LLM Primer 系列的收官之作,把七卷的工程弧线落到那门决定这一切能否在对手、监管者和概率系统日常故障模式面前存活下来的学科。
2026-05-09第 7 章 — 进阶 Batching 策略
LLM Primer VI 章节走读第 7 篇。Batching 不是一项优化,是让带宽受限 decoding 变得经济可行的那个决定性动作。从静态 batching 到 continuous batching,再到 chunked prefill —— 以及后者留给 KV cache 的债务。
2026-04-29第 8 章 — 性能、部署与成本优化
LLM Primer V 章节走读第 8 篇。把生产 LLM 的经济学当分层学科来做:最便宜的调用是那次没发生的调用,再往下每一层都是让下一次调用变便宜的那一层。语义缓存、动态路由、推理服务器内部的 PagedAttention、连续批处理、推测解码。
2026-04-21第 7 章 — LLM 安全与护栏
LLM Primer V 章节走读第 7 篇。给 LLM 应用引入的那条新安全轴取一个名字 —— 控制哪些指令能到达模型、从哪里来、带着多少权限 —— 再围绕它搭起四层缓解矩阵。原则:权限必须匹配来源的信任度。
2026-04-20第 3 章 — 检索增强生成
LLM Primer V 章节走读第 3 篇。走完 RAG 五阶段管道 —— 加载、切分、embedding、检索、生成 —— 顺带把 demo 阶段的 RAG 和真正扛得住真实语料的生产 RAG 分开:混合检索加重排器、结构感知加语义组合的切分,以及按 query 派发的变换路由。
2026-04-16LLM Primer V — 系列导读与索引
LLM Primer V 章节走读的系列导读。这一卷把 AI 工程当作一门独立的工程学科来讲,而不是一套 prompt 技巧;八个章节按栈的方式排列 —— 基础模型、prompt、检索、智能体、评估、可观测性、安全、以及部署经济学 —— 一层一层填出包在概率核心外面的确定性外壳。
2026-04-13第 11 章 — 攻击面与协议漏洞
LLM Primer IV 章节走读第 11 篇。被改造到 MCP 上的几个经典攻击 — Confused Deputy、Token Passthrough、Session Hijacking — 围绕能力升级和未认证 sampling 的协议级缺陷,以及让上下文投毒变成结构性问题而不是卫生问题的隐式信任传播。
2026-04-09第 10 章 — 长时任务记忆
LLM Primer IV 章节走读第 10 篇。通过窗口和 ReAct scratchpad 的短期记忆,通过情景向量和语义存储的长期记忆,以及让 agent 跨小时跨天保持产出的压缩技巧。
2026-04-08第 3 章 — 服务器原语:暴露上下文与能力
LLM Primer IV 章节走读第 3 篇。MCP server 能给的三个名词 — Resources(读状态)、Prompts(可复用脚手架)、Tools(写操作) — 它们的 schema、生命周期、错误模型,以及挑对原语这件事的纪律。
2026-04-01第 7 章 — 落实访问控制
LLM Primer III 章节走读第七篇。为关系数据库和文件系统设计的权限模型,套到检索上不完全合身。访问单位不再是一行或一份文件,而是一个嵌入 — 哪怕原文档已被拦,这个嵌入还能通过相似搜索把它漏出来。
2026-03-24第 6 章 — RAG 的威胁模型
LLM Primer III 章节走读第六篇。纯 LLM 只有一条信任边界。一套 RAG 系统有很多 — 入库、解析、分块、嵌入、索引、检索、重排、生成、工具、输出 — 每一条都连着对手能塑形的输入。
2026-03-23第 5 章 — 搭一条检索流水线
LLM Primer III 章节走读第五篇。一次向量搜索是大多数 demo 停下的地方,也是大多数生产故障开始的地方。本章一路走到生成器手里那一组候选,以及每一步存在的理由。
2026-03-22第 2 章 — 智能文档解析
LLM Primer III 章节走读第二篇。检索系统会继承它输入的质量 — 而那个让 RAG 质量平庸的最常见原因,就悄悄住在输入层。PDF 不是文本文件、版面感知解析器把哪些信号放回来,以及让模型直接读页面图像的那一路多模态。
2026-03-19第 9 章 — RAG:把新鲜信息缝进上下文
LLM Primer I 章节走读第九篇。RAG(检索增强生成)到底在做什么、它是怎么补上模型的时间缺失和事实弱点的,以及好 RAG 和坏 RAG 的分水岭从哪儿开始。
2026-02-26第 4 章 — 模型是怎么学的
LLM Primer I 章节走读第四篇。为什么预训练决定能力上限,为什么微调塑造性格,以及 RLHF 是怎么把一个原始的"下一个 token 预测器"变成我们每天信任的那位助手。
2026-02-21
大规模语言模型(LLM)全面指南:原理、应用与训练方法
深入探索大规模语言模型(LLM)的世界。本指南涵盖LLM的定义、在自然语言处理(NLP)中的作用、训练方法以及文本生成、翻译、问答系统和代码生成等实际应用。适合希望利用LLM开发创新解决方案的工程师与开发者。
2024-09-01