Введение в LLM
Эта страница предоставляет понятное руководство по большим языковым моделям (LLM), от основ до приложений для любителей ИИ.
Глава 17 — Будущие угрозы и формирующиеся защиты
Глава 17 — Будущие угрозы и формирующиеся защиты Семнадцатый и заключительный пост поглавного разбора LLM Primer VII: AI Security. Глава, смотрящая за пределы д…
2026-05-26Глава 16 — Безопасный файн-тюнинг и адаптация
Глава 16 — Безопасный файн-тюнинг и адаптация Шестнадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с файн-тюненным моделью как…
2026-05-25Глава 15 — Построение безопасной ИИ-организации
Глава 15 — Построение безопасной ИИ-организации Пятнадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с культурой безопасности, r…
2026-05-24Глава 14 — Смещение, справедливость и ответственный ИИ
Глава 14 — Смещение, справедливость и ответственный ИИ Четырнадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с ответственным ИИ…
2026-05-23Глава 13 — Регуляторный ландшафт
Глава 13 — Регуляторный ландшафт Тринадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, отображающая плюральный, всё ещё консолидирующийся регу…
2026-05-22Глава 12 — Контроль доступа и идентичность
Глава 12 — Контроль доступа и идентичность Двенадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, отвечающая на композиционный вопрос — кому ра…
2026-05-21Глава 11 — Наблюдаемость, логирование и реагирование на инциденты
Глава 11 — Наблюдаемость, логирование и реагирование на инциденты Одиннадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с логиро…
2026-05-20Глава 10 — Проектирование безопасных архитектур LLM
Глава 10 — Проектирование безопасных архитектур LLM Десятый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с архитектурой как с первич…
2026-05-19Глава 9 — Целостность модели и риски цепочки поставок
Глава 9 — Целостность модели и риски цепочки поставок Девятый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с артефактом модели как с…
2026-05-18Глава 8 — Adversarial-атаки на модели
Глава 8 — Adversarial-атаки на модели Восьмой пост поглавного разбора LLM Primer VII: AI Security. Глава, прослеживающая adversarial-атаки от работы Гудфеллоу 2…
2026-05-17Глава 7 — Галлюцинации и надёжность
Глава 7 — Галлюцинации и надёжность Седьмой пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с надёжностью как со свойством безопасности…
2026-05-16Глава 6 — Риски retrieval-augmented generation
Глава 6 — Риски retrieval-augmented generation Шестой пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с retrieval-корпусом как с недове…
2026-05-15Глава 5 — Валидация входа и фильтрация выхода
Глава 5 — Валидация входа и фильтрация выхода Пятый пост поглавного разбора LLM Primer VII: AI Security. Глава, превращающая многослойную рамку смягчения главы…
2026-05-14Глава 4 — Prompt injection и джейлбрейки
Глава 4 — Prompt injection и джейлбрейки Четвёртый пост поглавного разбора LLM Primer VII: AI Security. Глава, сидящая в центре практической проблемы безопаснос…
2026-05-13Глава 3 — Безопасность данных и приватность
Глава 3 — Безопасность данных и приватность Третий пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с данными как с активом, имеющим жиз…
2026-05-12Глава 2 — Моделирование угроз для систем LLM
Глава 2 — Моделирование угроз для систем LLM Второй пост поглавного разбора LLM Primer VII: AI Security. Глава, берущая четыре вопроса Шостака, STRIDE, PASTA и…
2026-05-11Глава 1 — Почему безопасность ИИ иная
Глава 1 — Почему безопасность ИИ иная Первый пост поглавного разбора LLM Primer VII: AI Security. Глава, утверждающая, что безопасность ИИ — это не традиционная…
2026-05-10LLM Primer VII — Введение в серию и указатель
LLM Primer VII — Введение в серию и указатель Поглавный разбор книги LLM Primer VII: AI Security — финального тома серии, где инженерная дуга LLM Primer приходи…
2026-05-09Глава 16 — Стратегии сокращения затрат в продакшене
Глава 16 — Стратегии сокращения затрат в продакшене Заключительный пост поглавного разбора LLM Primer VI: Scaling AI Systems. Каталог ортогональных приёмов, скл…
2026-05-08Глава 15 — Serverless API против выделенной инфраструктуры
Глава 15 — Serverless API против выделенной инфраструктуры Пятнадцатый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, кладущая арифметику точ…
2026-05-07Глава 14 — Экономика токенов и цены API
Глава 14 — Экономика токенов и цены API Четырнадцатый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, соединяющая физику из главы 1 со строкам…
2026-05-06Глава 13 — Автоскейлинг и смягчение холодного старта
Глава 13 — Автоскейлинг и смягчение холодного старта Тринадцатый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, объясняющая, почему дефолтный…
2026-05-05Глава 12 — Дизагрегированный serving и Kubernetes
Глава 12 — Дизагрегированный serving и Kubernetes Двенадцатый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, наконец разделяющая prefill и de…
2026-05-04Глава 11 — Слой платформы и оркестрации
Глава 11 — Слой платформы и оркестрации Одиннадцатый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, утверждающая, что выбор платформы — не пр…
2026-05-03Глава 10 — Слой движка LLM
Глава 10 — Слой движка LLM Десятый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, называющая границу между движком и платформой и обходящая п…
2026-05-02Глава 9 — Спекулятивный декодинг
Глава 9 — Спекулятивный декодинг Девятый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, показывающая, что у последовательного узкого места ав…
2026-05-01Глава 8 — KV-кэш следующего поколения
Глава 8 — KV-кэш следующего поколения Восьмой пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, переносящая понимание операционно-системного паг…
2026-04-30Глава 7 — Продвинутые стратегии батчинга
Глава 7 — Продвинутые стратегии батчинга Седьмой пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, показывающая, что батчинг — не оптимизация, а…
2026-04-29Глава 6 — Обрезка и дистилляция знаний
Глава 6 — Обрезка и дистилляция знаний Шестой пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, атакующая количество весов напрямую — сначала об…
2026-04-28Глава 5 — Демистификация квантизации
Глава 5 — Демистификация квантизации Пятый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, объясняющая, почему 70B-модель выживает 4-битную кв…
2026-04-27Глава 4 — Специализированный ИИ-кремний и ASIC
Глава 4 — Специализированный ИИ-кремний и ASIC Четвёртый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, утверждающая, что выбор между GPU и A…
2026-04-26Глава 3 — Дата-центровые GPU для генеративного ИИ
Глава 3 — Дата-центровые GPU для генеративного ИИ Третий пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, утверждающая, что serving-GPU нужно п…
2026-04-25Глава 2 — Проблема KV-кэша
Глава 2 — Проблема KV-кэша Второй пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, называющая структуру данных, которая съедает VRAM каждой ser…
2026-04-24Глава 1 — Механика генерации токенов
Глава 1 — Механика генерации токенов Первый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, утверждающая, что почти каждый трудный вопрос serv…
2026-04-23LLM Primer VI — Введение в серию и указатель
LLM Primer VI — Введение в серию и указатель Поглавный разбор книги LLM Primer VI: Scaling AI Systems — тома, где инференс LLM рассматривается как инженерная ди…
2026-04-22Глава 6 — Наблюдаемость и трассировка ИИ
Глава 6 — Наблюдаемость и трассировка ИИ Шестой пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к пользовательско…
2026-04-19Глава 5 — Оценка LLM-приложений
Глава 5 — Оценка LLM-приложений Пятый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, признающая, что assertEqual для LLM-вых…
2026-04-18Глава 4 — ИИ-агенты и вызов инструментов
Глава 4 — ИИ-агенты и вызов инструментов Четвёртый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к агенту как к…
2026-04-17Глава 3 — Retrieval-Augmented Generation
Глава 3 — Retrieval-Augmented Generation Третий пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, проходящая RAG-конвейер от на…
2026-04-16LLM Primer V — Введение в серию и оглавление
LLM Primer V — Введение в серию и оглавление Поглавный разбор LLM Primer V: Building Real-World LLM Applications — тома, который относится к AI-инженерии как к…
2026-04-13Глава 14 — Бенчмаркинг, тестирование и производительность
Пятнадцатый и финальный пост поглавного разбора LLM Primer IV. MCP-Universe Benchmark на реальных серверах, два системных режима отказа, которые он раскрыл, десятикратный разрыв пропускной способности между session-per-request и пулом сессий, и мост к тому V.
2026-04-12Глава 13 — Фреймворки и облачная интеграция
Четырнадцатый пост поглавного разбора LLM Primer IV. Strands с Bedrock, AWS state-layer-паттерн, Microsoft Agent Framework, LangChain, Semantic Kernel — и три продакшен-формы интеграции, к которым команды приходят независимо.
2026-04-11Глава 12 — Закаливание протокола и защиты
Двенадцатый пост поглавного разбора LLM Primer IV. Четыре кластера защит — криптографическая аттестация, OAuth-дисциплина скоупов с ограниченными сессиями, runtime-песочница и human-in-the-loop-ворота — складываются в позицию, не зависящую от того, что модель ведёт себя правильно в адверсариальных условиях.
2026-04-10Глава 11 — Поверхности атак и уязвимости протокола
Одиннадцатый пост поглавного разбора LLM Primer IV. Классические атаки, адаптированные к MCP — Confused Deputy, Token Passthrough, Session Hijacking — протокол-уровневые изъяны вокруг capability escalation и неаутентифицированного sampling, и неявное распространение доверия, делающее отравление контекста структурной проблемой, а не вопросом гигиены.
2026-04-09Глава 10 — Память для долгих задач
Десятый пост поглавного разбора LLM Primer IV. Краткосрочная память через окна и ReAct-черновики, долгосрочная память через эпизодические векторы и семантические хранилища, и техники сжатия, держащие агента продуктивным часами и днями.
2026-04-08Глава 9 — Управление бюджетом внимания
Девятый пост поглавного разбора LLM Primer IV. Context rot, обрыв lost-in-the-middle, tool-loadout rot и три архитектурных ответа — MCP, RAG, дообучение — на вопрос, где на самом деле живёт недостающее знание модели.
2026-04-07Глава 8 — Архитектурные раскладки развёртывания
Восьмой пост поглавного разбора LLM Primer IV. Три раскладки развёртывания, проявившиеся в MCP-экосистеме — reusable agent, strict purity, hybrid, — и четыре связывающих ограничения, определяющих, какая подходит какому проекту.
2026-04-06Глава 7 — Продвинутые совместные и динамические паттерны
Седьмой пост поглавного разбора LLM Primer IV. Консенсус roundtable, handoff-маршрутизация и magentic-оркестрация — паттерны, возникающие, когда топологию приходится строить под запрос, и режимы отказа (не-завершение, мисс-маршрутизация, ускользающее планирование), которых избегают простые паттерны.
2026-04-05Глава 6 — Фундаментальные стратегии оркестрации
Шестой пост поглавного разбора LLM Primer IV. Две базовые формы оркестрации — последовательные пайплайны и параллельный scatter-gather — и предварительный вопрос, который должна задать каждая команда: является ли мультиагентная система вообще правильным ответом?
2026-04-04Глава 5 — Транспортные протоколы и обнаружение
Пятый пост поглавного разбора LLM Primer IV. Три транспорта, поддерживаемых MCP, слой обнаружения .well-known с Server Cards и скучные операционные заботы — CORS, валидация origin, кэширование, — решающие, является ли сервер кооперативным гражданином сети или обузой.
2026-04-03