LLM介绍

本页面为AI爱好者提供从基础到应用的大型语言模型(LLM)指南。


共有21篇文章。 | 当前在第1页,共1页。

第 17 章 — 未来威胁与新兴防御

LLM Primer VII 章节走读的第 17 篇,也是本卷和 LLM Primer 系列的收官之作。走看那些还在成形中的学科 —— 自主智能体、多模态攻击面、合成身份,以及 2026 年中期 AI 对 AI 的军备竞赛。

2026-05-26

第 13 章 — 监管全景

LLM Primer VII 章节走读第 13 篇。这一章把仍在整合中的、多元的监管全景,映射到前面几章开发出来的技术控制上。

2026-05-22

第 12 章 — 访问控制与身份

LLM Primer VII 章节走读第 12 篇。这一章回答那个组合性的问题 —— 谁被允许调用一个 LLM 集成应用的哪种能力,以及执法如何跨系统的各组件构建。

2026-05-21

第 6 章 — 检索增强生成的风险

LLM Primer VII 章节走读第 6 篇。这一章把检索语料看作一条不受信任的输入通道 —— 因为在模型眼里,每一份被索引的文档都是一条和用户提问平起平坐的指令。

2026-05-15

LLM Primer VII — 系列引言与索引

《LLM Primer VII: AI Security》章节走读的系列引言与索引 —— LLM Primer 系列的收官之作,把七卷的工程弧线落到那门决定这一切能否在对手、监管者和概率系统日常故障模式面前存活下来的学科。

2026-05-09

第 15 章 — Serverless API 对比自建基础设施

LLM Primer VI 章节走读第 15 篇。GPU 租金分项决定 token 那道算术;平台工程分项决定这单交易。混合姿态几乎总是对的答案,应用边界那个路由器是承重的那一块。

2026-05-07

第 14 章 — Token 经济学与 API 定价

LLM Primer VI 章节走读第 14 篇。为什么输出比输入贵 4–8 倍。输入输出混合决定优化杠杆的方向。上下文累积和看不见的 reasoning token 是账单上最贵的两个隐藏项。

2026-05-06

第 11 章 — 平台与编排层

LLM Primer VI 章节走读第 11 篇。平台的选择不是关于功能,而是关于哪一种运营模型贴合团队的 ops 文化。Ray Serve、KServe、BentoML、Triton —— 四种 CRD、Python actor、Bento、模型仓库,分别匹配不同的 ops grain。

2026-05-03

第 4 章 — AI 智能体与工具调用

LLM Primer V 章节走读第 4 篇。把智能体当作一个针对工具循环起来的语言模型来处理:工具 schema、错误合同、以及记忆的写入纪律,是整个系统里杠杆率最高的工程面。ReAct 循环、工具作为合同,以及智能体真正需要的三层记忆。

2026-04-17

第 3 章 — 检索增强生成

LLM Primer V 章节走读第 3 篇。走完 RAG 五阶段管道 —— 加载、切分、embedding、检索、生成 —— 顺带把 demo 阶段的 RAG 和真正扛得住真实语料的生产 RAG 分开:混合检索加重排器、结构感知加语义组合的切分,以及按 query 派发的变换路由。

2026-04-16

LLM Primer V — 系列导读与索引

LLM Primer V 章节走读的系列导读。这一卷把 AI 工程当作一门独立的工程学科来讲,而不是一套 prompt 技巧;八个章节按栈的方式排列 —— 基础模型、prompt、检索、智能体、评估、可观测性、安全、以及部署经济学 —— 一层一层填出包在概率核心外面的确定性外壳。

2026-04-13

第 12 章 — 协议加固与防御

LLM Primer IV 章节走读第 12 篇。四簇防御 — 密码学背书、OAuth scope 纪律加有界会话、运行时沙箱、人工审批门 — 组合成一种不依赖模型在对抗条件下行为正确的安全姿态。

2026-04-10

第 8 章 — 架构部署形态

LLM Primer IV 章节走读第 8 篇。MCP 生态里浮现出来的三种部署形态 — 可复用 agent、严格纯净、混合 — 以及决定哪一种适合哪个项目的四条约束。

2026-04-06

第 5 章 — 传输协议与发现

LLM Primer IV 章节走读第 5 篇。MCP 支持的三种传输,.well-known 这一层发现机制加 Server Card,以及那些无聊的运维问题 — CORS、Origin 校验、缓存 — 决定一个 server 是合作型网络公民还是负债。

2026-04-03

第 10 章 — 主流评测框架

LLM Primer III 章节走读第十篇。三件套配上了工具箱 — 两脉里八个框架 — 加上对它们其中没人合上的那一块的一次诚实坦白。

2026-03-27

第 7 章 — 落实访问控制

LLM Primer III 章节走读第七篇。为关系数据库和文件系统设计的权限模型,套到检索上不完全合身。访问单位不再是一行或一份文件,而是一个嵌入 — 哪怕原文档已被拦,这个嵌入还能通过相似搜索把它漏出来。

2026-03-24

第 6 章 — RAG 的威胁模型

LLM Primer III 章节走读第六篇。纯 LLM 只有一条信任边界。一套 RAG 系统有很多 — 入库、解析、分块、嵌入、索引、检索、重排、生成、工具、输出 — 每一条都连着对手能塑形的输入。

2026-03-23

第 5 章 — 搭一条检索流水线

LLM Primer III 章节走读第五篇。一次向量搜索是大多数 demo 停下的地方,也是大多数生产故障开始的地方。本章一路走到生成器手里那一组候选,以及每一步存在的理由。

2026-03-22

第 2 章 — 智能文档解析

LLM Primer III 章节走读第二篇。检索系统会继承它输入的质量 — 而那个让 RAG 质量平庸的最常见原因,就悄悄住在输入层。PDF 不是文本文件、版面感知解析器把哪些信号放回来,以及让模型直接读页面图像的那一路多模态。

2026-03-19

第 9 章 — RAG:把新鲜信息缝进上下文

LLM Primer I 章节走读第九篇。RAG(检索增强生成)到底在做什么、它是怎么补上模型的时间缺失和事实弱点的,以及好 RAG 和坏 RAG 的分水岭从哪儿开始。

2026-02-26

大规模语言模型(LLM)全面指南:原理、应用与训练方法

深入探索大规模语言模型(LLM)的世界。本指南涵盖LLM的定义、在自然语言处理(NLP)中的作用、训练方法以及文本生成、翻译、问答系统和代码生成等实际应用。适合希望利用LLM开发创新解决方案的工程师与开发者。

2024-09-01