LLM介绍
本页面为AI爱好者提供从基础到应用的大型语言模型(LLM)指南。
共有7篇文章。 |
当前在第1页,共1页。
第 6 章 — AI 可观测性与追踪
LLM Primer V 章节走读第 6 篇。把一次用户 query 当作一棵因果树,不是一条请求日志,再展示要让这棵树可读需要追踪什么:分布式追踪加 GenAI 语义约定,再加上 TTFT、TPOT、成本、质量这几个指标,以及把生产 trace 送回评估集的导出管道。
2026-04-19第 5 章 — LLM 应用的评估
LLM Primer V 章节走读第 5 篇。承认 assertEqual 在 LLM 输出上已经死掉,再围绕锚点法官、RAG 三角、智能体轨迹测试,把测试纪律重新搭起来 —— 把随机输出变成能守得住的通过/不通过信号。
2026-04-18LLM Primer V — 系列导读与索引
LLM Primer V 章节走读的系列导读。这一卷把 AI 工程当作一门独立的工程学科来讲,而不是一套 prompt 技巧;八个章节按栈的方式排列 —— 基础模型、prompt、检索、智能体、评估、可观测性、安全、以及部署经济学 —— 一层一层填出包在概率核心外面的确定性外壳。
2026-04-13第 9 章 — RAG 评测三件套
LLM Primer III 章节走读第九篇。三种不同的故障塌成同一种症状 — 这个领域为此发明了一只三头的度量,终于告诉团队:那个症状对的是哪一种故障。
2026-03-26第11章 — 评估、校准与推理
LLM Primer II 章节走读第十一篇。怎么去衡量一个什么都能说的机器 — 困惑度、校准、benchmark 上那条少有人写的误差线,以及"测量幻觉"那件事的数学。
2026-03-13第 12 章 — 搭一个 LLM 系统,以及之后
LLM Primer I 章节走读的最后一篇。模型、工具、RAG、评估、护栏 — 缝成一套系统;以及从第 1 卷通往第 2–7 卷的那座桥。
2026-03-01