Введение в LLM
Эта страница предоставляет понятное руководство по большим языковым моделям (LLM), от основ до приложений для любителей ИИ.
Глава 17 — Будущие угрозы и формирующиеся защиты
Глава 17 — Будущие угрозы и формирующиеся защиты Семнадцатый и заключительный пост поглавного разбора LLM Primer VII: AI Security. Глава, смотрящая за пределы д…
2026-05-26Глава 15 — Построение безопасной ИИ-организации
Глава 15 — Построение безопасной ИИ-организации Пятнадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с культурой безопасности, r…
2026-05-24Глава 14 — Смещение, справедливость и ответственный ИИ
Глава 14 — Смещение, справедливость и ответственный ИИ Четырнадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с ответственным ИИ…
2026-05-23Глава 12 — Контроль доступа и идентичность
Глава 12 — Контроль доступа и идентичность Двенадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, отвечающая на композиционный вопрос — кому ра…
2026-05-21Глава 11 — Наблюдаемость, логирование и реагирование на инциденты
Глава 11 — Наблюдаемость, логирование и реагирование на инциденты Одиннадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с логиро…
2026-05-20Глава 10 — Проектирование безопасных архитектур LLM
Глава 10 — Проектирование безопасных архитектур LLM Десятый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с архитектурой как с первич…
2026-05-19Глава 9 — Целостность модели и риски цепочки поставок
Глава 9 — Целостность модели и риски цепочки поставок Девятый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с артефактом модели как с…
2026-05-18Глава 8 — Adversarial-атаки на модели
Глава 8 — Adversarial-атаки на модели Восьмой пост поглавного разбора LLM Primer VII: AI Security. Глава, прослеживающая adversarial-атаки от работы Гудфеллоу 2…
2026-05-17Глава 7 — Галлюцинации и надёжность
Глава 7 — Галлюцинации и надёжность Седьмой пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с надёжностью как со свойством безопасности…
2026-05-16Глава 6 — Риски retrieval-augmented generation
Глава 6 — Риски retrieval-augmented generation Шестой пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с retrieval-корпусом как с недове…
2026-05-15Глава 5 — Валидация входа и фильтрация выхода
Глава 5 — Валидация входа и фильтрация выхода Пятый пост поглавного разбора LLM Primer VII: AI Security. Глава, превращающая многослойную рамку смягчения главы…
2026-05-14Глава 4 — Prompt injection и джейлбрейки
Глава 4 — Prompt injection и джейлбрейки Четвёртый пост поглавного разбора LLM Primer VII: AI Security. Глава, сидящая в центре практической проблемы безопаснос…
2026-05-13Глава 3 — Безопасность данных и приватность
Глава 3 — Безопасность данных и приватность Третий пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с данными как с активом, имеющим жиз…
2026-05-12Глава 2 — Моделирование угроз для систем LLM
Глава 2 — Моделирование угроз для систем LLM Второй пост поглавного разбора LLM Primer VII: AI Security. Глава, берущая четыре вопроса Шостака, STRIDE, PASTA и…
2026-05-11Глава 1 — Почему безопасность ИИ иная
Глава 1 — Почему безопасность ИИ иная Первый пост поглавного разбора LLM Primer VII: AI Security. Глава, утверждающая, что безопасность ИИ — это не традиционная…
2026-05-10LLM Primer VII — Введение в серию и указатель
LLM Primer VII — Введение в серию и указатель Поглавный разбор книги LLM Primer VII: AI Security — финального тома серии, где инженерная дуга LLM Primer приходи…
2026-05-09Глава 14 — Экономика токенов и цены API
Глава 14 — Экономика токенов и цены API Четырнадцатый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, соединяющая физику из главы 1 со строкам…
2026-05-06Глава 10 — Слой движка LLM
Глава 10 — Слой движка LLM Десятый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, называющая границу между движком и платформой и обходящая п…
2026-05-02Глава 8 — KV-кэш следующего поколения
Глава 8 — KV-кэш следующего поколения Восьмой пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, переносящая понимание операционно-системного паг…
2026-04-30Глава 6 — Обрезка и дистилляция знаний
Глава 6 — Обрезка и дистилляция знаний Шестой пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, атакующая количество весов напрямую — сначала об…
2026-04-28Глава 8 — Оптимизация производительности, serving и стоимости
Глава 8 — Оптимизация производительности, serving и стоимости Финальный пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относ…
2026-04-21Глава 7 — Безопасность LLM и guardrails
Глава 7 — Безопасность LLM и guardrails Седьмой пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, называющая новую ось безопасн…
2026-04-20Глава 6 — Наблюдаемость и трассировка ИИ
Глава 6 — Наблюдаемость и трассировка ИИ Шестой пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к пользовательско…
2026-04-19Глава 5 — Оценка LLM-приложений
Глава 5 — Оценка LLM-приложений Пятый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, признающая, что assertEqual для LLM-вых…
2026-04-18Глава 4 — ИИ-агенты и вызов инструментов
Глава 4 — ИИ-агенты и вызов инструментов Четвёртый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к агенту как к…
2026-04-17Глава 2 — Foundation-модели и prompt engineering
Глава 2 — Foundation-модели и prompt engineering Второй пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к prompt…
2026-04-15Глава 1 — Дисциплина AI-инженерии
Глава 1 — Дисциплина AI-инженерии Первый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, утверждающая, что причина, по которо…
2026-04-14Глава 13 — Фреймворки и облачная интеграция
Четырнадцатый пост поглавного разбора LLM Primer IV. Strands с Bedrock, AWS state-layer-паттерн, Microsoft Agent Framework, LangChain, Semantic Kernel — и три продакшен-формы интеграции, к которым команды приходят независимо.
2026-04-11Глава 12 — Закаливание протокола и защиты
Двенадцатый пост поглавного разбора LLM Primer IV. Четыре кластера защит — криптографическая аттестация, OAuth-дисциплина скоупов с ограниченными сессиями, runtime-песочница и human-in-the-loop-ворота — складываются в позицию, не зависящую от того, что модель ведёт себя правильно в адверсариальных условиях.
2026-04-10Глава 10 — Память для долгих задач
Десятый пост поглавного разбора LLM Primer IV. Краткосрочная память через окна и ReAct-черновики, долгосрочная память через эпизодические векторы и семантические хранилища, и техники сжатия, держащие агента продуктивным часами и днями.
2026-04-08Глава 9 — Управление бюджетом внимания
Девятый пост поглавного разбора LLM Primer IV. Context rot, обрыв lost-in-the-middle, tool-loadout rot и три архитектурных ответа — MCP, RAG, дообучение — на вопрос, где на самом деле живёт недостающее знание модели.
2026-04-07Глава 8 — Архитектурные раскладки развёртывания
Восьмой пост поглавного разбора LLM Primer IV. Три раскладки развёртывания, проявившиеся в MCP-экосистеме — reusable agent, strict purity, hybrid, — и четыре связывающих ограничения, определяющих, какая подходит какому проекту.
2026-04-06Глава 7 — Продвинутые совместные и динамические паттерны
Седьмой пост поглавного разбора LLM Primer IV. Консенсус roundtable, handoff-маршрутизация и magentic-оркестрация — паттерны, возникающие, когда топологию приходится строить под запрос, и режимы отказа (не-завершение, мисс-маршрутизация, ускользающее планирование), которых избегают простые паттерны.
2026-04-05Глава 6 — Фундаментальные стратегии оркестрации
Шестой пост поглавного разбора LLM Primer IV. Две базовые формы оркестрации — последовательные пайплайны и параллельный scatter-gather — и предварительный вопрос, который должна задать каждая команда: является ли мультиагентная система вообще правильным ответом?
2026-04-04Глава 3 — Серверные примитивы: экспонирование контекста и возможностей
Третий пост поглавного разбора LLM Primer IV. Три существительных, которые может предложить MCP-сервер — Resources (чтение состояния), Prompts (переиспользуемые шаблоны), Tools (действия записи), — их схемы, жизненные циклы, модели ошибок и дисциплина выбора правильного примитива.
2026-04-01Глава 2 — Знакомство с Model Context Protocol (MCP)
Второй пост поглавного разбора LLM Primer IV. Что именно стандартизирует MCP, трёхролевое разделение Host, Client, Server, чем динамическое обнаружение и двунаправленный обмен сообщениями отличаются от REST в значимых случаях, и жизненный цикл сессии, открывающийся согласованием возможностей.
2026-03-31Глава 1 — Кризис интеграций ИИ и подъём агентной архитектуры
Первый пост поглавного разбора LLM Primer IV. Почему монолитные агенты распадаются по мере роста системных промптов, проблема интеграций N на M, скрытая под этим, и переход от prompt engineering к context engineering, под который и был построен MCP.
2026-03-30LLM Primer IV — Введение в серию и оглавление
Открываем поглавный разбор четвёртой книги серии LLM Primer — Проектирование когнитивных способностей ИИ с MCP. Почему агентам нужен протокольный слой, чтобы выйти за пределы демо, для кого эта книга и расписание четырнадцати постов с 30 марта по 12 апреля.
2026-03-29Глава 9 — Триада оценки RAG
Девятый пост разбора LLM Primer III. RAG-система может отказывать в трёх разных местах, а отказы снаружи неразличимы. Триада оценки — релевантность контекста, верность и релевантность ответа — это малый словарь, не дающий чинить одну ошибку, измеряя другую.
2026-03-26Глава 7 — Реализация контроля доступа
Седьмой пост разбора LLM Primer III. Документ-уровневые ACL как фундамент, RBAC с метками чувствительности Microsoft Purview, ReBAC с Zanzibar и SpiceDB и дисциплина pre-filter против post-filter, работающая под всеми ними.
2026-03-24Глава 6 — Модели угроз и уязвимости RAG
Шестой пост разбора LLM Primer III. Расширенная поверхность атаки поиска — отравление корпуса, adversarial-чанки, непрямой prompt injection, инверсия эмбеддингов и проблема confused deputy в агентном RAG. Конкретные атаки, каждая продемонстрирована, каждая воспроизводима.
2026-03-23Глава 4 — Выбор подходящей векторной базы данных
Четвёртый пост разбора LLM Primer III. Архитектурный раздел между специализированными векторными базами и расширениями вроде Postgres, лидеры managed-сегмента (Pinecone, Vertex), open-source поле (Qdrant, Milvus, Weaviate), встраиваемые опции и три операционные оси — резидентность, ops, стоимость, на которых решается реальный выбор.
2026-03-21Глава 3 — Продвинутые фреймворки чанкинга
Третий пост разбора LLM Primer III. Спектр чанкинга от фиксированного размера до учёта структуры, миф об overlap, обрыв контекста, тихо разрушающий поиск, и техники contextual retrieval и late chunking, переписавшие фронтир.
2026-03-20Глава 1 — Эволюция архитектуры RAG
Первый пост разбора LLM Primer III. Четыре архитектурные позы RAG — Naive, Advanced, Modular, Agentic — читаются как история о передаче LLM всё большей агентности по одному решению за раз, и честный ответ на вопрос, когда дообучение лучше поиска.
2026-03-18LLM Primer III — Введение в серию и оглавление
Открываем поглавный разбор третьей книги серии LLM Primer — Корпоративный ИИ с RAG. Почему retrieval-augmented generation выглядит просто снаружи и состоит из стопки дисциплин внутри, для кого эта книга и расписание одиннадцати постов с 18 по 28 марта.
2026-03-17Глава 8 — Когда одной модели мало: инструменты и агенты
Восьмой пост разбора LLM Primer I по главам. Территория, где модель обретает руки — использование инструментов, вызов функций, агенты — и новый §8.6 издания 2026 года с паттернами агентов: ReAct, планировщик-исполнитель, рефлексия.
2026-02-25Глава 7 — Промпт-инжиниринг как ремесло
Седьмой пост разбора LLM Primer I по главам. Четыре паттерна промптов, которые несут основную нагрузку — system prompt, few-shot, цепочка размышления, роль — и почему каждый из них работает, в свете механизма следующего токена.
2026-02-24Глава 4 — Как модель обучается
Четвёртый пост разбора LLM Primer I по главам. Почему предобучение задаёт потолок способностей, почему fine-tuning лепит характер, и как RLHF превращает простого предсказателя токенов в того ассистента, которому мы доверяем ежедневно.
2026-02-21Глава 1 — Что такое, в сущности, Большая Языковая Модель?
Первый пост разбора LLM Primer I по главам. Что на самом деле означают слова «большая», «языковая» и «модель», как мы прошли путь от систем на правилах до нейросетей, и три мифа, от которых стоит избавиться сразу.
2026-02-18