LLM介紹

本頁面為AI愛好者提供從基礎到應用的大型語言模型(LLM)指南。


共有21篇文章。 | 當前在第1頁,共1頁。

第 17 章 — 未來威脅與新興防禦

LLM Primer VII 章節走讀第十七篇,也是最終篇。本章越過已經成熟到能寫下的紀律,命名那些社群仍在弄清楚的紀律 — 自主 agent、多模態攻擊面、合成身分,以及 2026 年中的 AI-versus-AI 軍備競賽。

2026-05-26

第 16 章 — 安全的微調與適配

LLM Primer VII 章節走讀第十六篇。本章把微調後的模型當作一份其安全屬性必須被爭取、不是被繼承的產物 — 因為同一批教出領域詞彙的梯度步伐,也能侵蝕基底模型帶來的對齊。

2026-05-25

第 12 章 — 存取控制與身分

LLM Primer VII 章節走讀第十二篇。本章回答組合性問題 — 誰被允許呼叫一個 LLM 整合應用的哪一項能力,以及如何在系統元件之間結構化執行。

2026-05-21

第 11 章 — 可觀測性、日誌與事件回應

LLM Primer VII 章節走讀第十一篇。本章把日誌、告警與事件回應當作那個把架構防禦轉成營運者能真正運行之系統的層。

2026-05-20

第 5 章 — 輸入驗證與輸出過濾

LLM Primer VII 章節走讀第五篇。本章把第 4 章的分層緩解框架轉成作業紀律 — 淨化階段、guardrail 工具、結構化輸出、紅隊,以及真正有意義的安全指標。

2026-05-14

第 2 章 — LLM 系統的威脅建模

LLM Primer VII 章節走讀第二篇。本章把 Shostack 的四個問題、STRIDE、PASTA 與 MITRE ATLAS 套用到一個最強大元件把所有輸入都當作可能指令的系統上。

2026-05-11

LLM Primer VII — 系列導論與索引

LLM Primer VII 章節走讀的導論與索引。這是系列的完結之卷:LLM Primer 的工程弧線,最後落在決定這一切能否在對手、監管機關以及機率系統日常故障模式面前存活下來的那個學科。

2026-05-09

第 16 章 — 生產環境的降本策略

LLM Primer VI 章節走讀最終篇。那些各自獨立、但能複利成上個月帳單三分之一到一半的動作目錄。

2026-05-08

第 13 章 — 自動擴縮與冷啟動緩解

LLM Primer VI 章節走讀第十三篇。這一章解釋為什麼預設 Kubernetes 自動擴縮器在 LLM 流量下會造成中斷,以及 KEDA、Knative、CRIU 如何組合成修補方案。

2026-05-05

第 12 章 — 解耦式服務與 Kubernetes

LLM Primer VI 章節走讀第十二篇。這一章終於把 prefill 與 decode 拆到不同的 GPU 池,並展示能把 pod 留在互連正確一側的 Kubernetes 原語。

2026-05-04

第 11 章 — 平台與編排層

LLM Primer VI 章節走讀第十一篇。這一章主張平台的選擇不是關於功能,而是關於哪一種維運模式對得上團隊既有的維運文化。

2026-05-03

第 7 章 — 進階批次處理策略

LLM Primer VI 章節走讀第七篇。這一章展示為什麼批次處理不是最佳化,而是讓受頻寬所困的 decoding 變得可解的關鍵動作 — 以及為什麼「批次」是動詞、不是名詞。

2026-04-29

第 5 章 — 量化去神秘化

LLM Primer VI 章節走讀第五篇。這一章解釋為什麼 70B 模型撐得住 4 位元量化,而 1B 模型撐不住 — 以及怎麼挑配方。

2026-04-27

第 2 章 — KV 快取的挑戰

LLM Primer VI 章節走讀第二篇。這一章替那個會先於權重吃光每個服務系統 VRAM 的資料結構命名。走過主導 KV 快取大小的公式、把它縮小的架構變體,以及會摧毀天真配置方式的碎裂化問題。

2026-04-24

LLM Primer VI — 系列簡介與索引

《LLM Primer VI:擴展 AI 系統》章節走讀的入口。這一卷把 LLM 推論當成一門工程學科來看待,在記憶體頻寬、排程、以及美元符號互相碰撞的地方展開。

2026-04-22

第 8 章 — 效能、服務、成本的最佳化

LLM Primer V 章節走讀最終篇。把生產 LLM 經濟學當分層紀律處理 — 最便宜的呼叫是那個沒發生的,而下面每一層是讓下一次呼叫變便宜的那一層。

2026-04-21

第 6 章 — AI 可觀測性與追蹤

LLM Primer V 章節走讀第六篇。把使用者的查詢當一棵因果樹處理、不當請求日誌。走過 OpenTelemetry GenAI 語意慣例、TTFT/TPOT/cost/quality 這些真的重要的指標,以及把 trace 餵回評估的匯出管線。

2026-04-19

第 4 章 — AI 代理與工具呼叫

LLM Primer V 章節走讀第四篇。把代理當一個「對著工具跑迴圈的語言模型」處理 — 工具 schema、記憶層、多代理接線都得先工程好,迴圈才能被信任去做真的事。

2026-04-17

第 2 章 — 基礎模型與提示詞工程

LLM Primer V 章節走讀第二篇。提示詞工程就是工程 — 版本化的模板、防禦式界定符、結構化輸出。從模型分層、取樣參數走到 Pydantic/Zod schema 強制、Outlines 文法約束解碼。

2026-04-15

第 1 章 — AI 工程作為一門學科

LLM Primer V 章節走讀第一篇。你的 demo 會動、生產系統不會動,原因不在模型 — 是工程問題,而且那門工程有名字。走過可靠性裂縫、確定性包裝、以及五根柱子。

2026-04-14

LLM Primer V — 系列導讀與索引

LLM Primer V 系列導讀。從 demo 走到生產環境會踩到的那個縫、AI 工程作為一門獨立學科的框架,以及八章走過的八個工程面 — 基礎模型、提示詞、檢索、代理、評估、可觀測性、安全、服務經濟。

2026-04-13