Введение в LLM
Эта страница предоставляет понятное руководство по большим языковым моделям (LLM), от основ до приложений для любителей ИИ.
Глава 12 — Контроль доступа и идентичность
Глава 12 — Контроль доступа и идентичность Двенадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, отвечающая на композиционный вопрос — кому ра…
2026-05-21Глава 10 — Проектирование безопасных архитектур LLM
Глава 10 — Проектирование безопасных архитектур LLM Десятый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с архитектурой как с первич…
2026-05-19Глава 2 — Моделирование угроз для систем LLM
Глава 2 — Моделирование угроз для систем LLM Второй пост поглавного разбора LLM Primer VII: AI Security. Глава, берущая четыре вопроса Шостака, STRIDE, PASTA и…
2026-05-11Глава 16 — Стратегии сокращения затрат в продакшене
Глава 16 — Стратегии сокращения затрат в продакшене Заключительный пост поглавного разбора LLM Primer VI: Scaling AI Systems. Каталог ортогональных приёмов, скл…
2026-05-08Глава 15 — Serverless API против выделенной инфраструктуры
Глава 15 — Serverless API против выделенной инфраструктуры Пятнадцатый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, кладущая арифметику точ…
2026-05-07Глава 11 — Слой платформы и оркестрации
Глава 11 — Слой платформы и оркестрации Одиннадцатый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, утверждающая, что выбор платформы — не пр…
2026-05-03LLM Primer VI — Введение в серию и указатель
LLM Primer VI — Введение в серию и указатель Поглавный разбор книги LLM Primer VI: Scaling AI Systems — тома, где инференс LLM рассматривается как инженерная ди…
2026-04-22Глава 8 — Оптимизация производительности, serving и стоимости
Глава 8 — Оптимизация производительности, serving и стоимости Финальный пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относ…
2026-04-21Глава 7 — Безопасность LLM и guardrails
Глава 7 — Безопасность LLM и guardrails Седьмой пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, называющая новую ось безопасн…
2026-04-20Глава 6 — Наблюдаемость и трассировка ИИ
Глава 6 — Наблюдаемость и трассировка ИИ Шестой пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к пользовательско…
2026-04-19Глава 5 — Оценка LLM-приложений
Глава 5 — Оценка LLM-приложений Пятый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, признающая, что assertEqual для LLM-вых…
2026-04-18Глава 4 — ИИ-агенты и вызов инструментов
Глава 4 — ИИ-агенты и вызов инструментов Четвёртый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к агенту как к…
2026-04-17Глава 3 — Retrieval-Augmented Generation
Глава 3 — Retrieval-Augmented Generation Третий пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, проходящая RAG-конвейер от на…
2026-04-16Глава 1 — Дисциплина AI-инженерии
Глава 1 — Дисциплина AI-инженерии Первый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, утверждающая, что причина, по которо…
2026-04-14LLM Primer V — Введение в серию и оглавление
LLM Primer V — Введение в серию и оглавление Поглавный разбор LLM Primer V: Building Real-World LLM Applications — тома, который относится к AI-инженерии как к…
2026-04-13Глава 14 — Бенчмаркинг, тестирование и производительность
Пятнадцатый и финальный пост поглавного разбора LLM Primer IV. MCP-Universe Benchmark на реальных серверах, два системных режима отказа, которые он раскрыл, десятикратный разрыв пропускной способности между session-per-request и пулом сессий, и мост к тому V.
2026-04-12Глава 13 — Фреймворки и облачная интеграция
Четырнадцатый пост поглавного разбора LLM Primer IV. Strands с Bedrock, AWS state-layer-паттерн, Microsoft Agent Framework, LangChain, Semantic Kernel — и три продакшен-формы интеграции, к которым команды приходят независимо.
2026-04-11Глава 11 — Поверхности атак и уязвимости протокола
Одиннадцатый пост поглавного разбора LLM Primer IV. Классические атаки, адаптированные к MCP — Confused Deputy, Token Passthrough, Session Hijacking — протокол-уровневые изъяны вокруг capability escalation и неаутентифицированного sampling, и неявное распространение доверия, делающее отравление контекста структурной проблемой, а не вопросом гигиены.
2026-04-09Глава 10 — Память для долгих задач
Десятый пост поглавного разбора LLM Primer IV. Краткосрочная память через окна и ReAct-черновики, долгосрочная память через эпизодические векторы и семантические хранилища, и техники сжатия, держащие агента продуктивным часами и днями.
2026-04-08Глава 9 — Управление бюджетом внимания
Девятый пост поглавного разбора LLM Primer IV. Context rot, обрыв lost-in-the-middle, tool-loadout rot и три архитектурных ответа — MCP, RAG, дообучение — на вопрос, где на самом деле живёт недостающее знание модели.
2026-04-07Глава 8 — Архитектурные раскладки развёртывания
Восьмой пост поглавного разбора LLM Primer IV. Три раскладки развёртывания, проявившиеся в MCP-экосистеме — reusable agent, strict purity, hybrid, — и четыре связывающих ограничения, определяющих, какая подходит какому проекту.
2026-04-06Глава 6 — Фундаментальные стратегии оркестрации
Шестой пост поглавного разбора LLM Primer IV. Две базовые формы оркестрации — последовательные пайплайны и параллельный scatter-gather — и предварительный вопрос, который должна задать каждая команда: является ли мультиагентная система вообще правильным ответом?
2026-04-04Глава 4 — Клиентские примитивы: агентное поведение и контроль
Четвёртый пост поглавного разбора LLM Primer IV. Sampling, Roots и Elicitation — три небольших, контролируемых отверстия, которые MCP пробивает в стене между хостом и сервером, каждое — отданная назад возможность и принятый от имени пользователя риск.
2026-04-02Глава 2 — Знакомство с Model Context Protocol (MCP)
Второй пост поглавного разбора LLM Primer IV. Что именно стандартизирует MCP, трёхролевое разделение Host, Client, Server, чем динамическое обнаружение и двунаправленный обмен сообщениями отличаются от REST в значимых случаях, и жизненный цикл сессии, открывающийся согласованием возможностей.
2026-03-31Глава 1 — Кризис интеграций ИИ и подъём агентной архитектуры
Первый пост поглавного разбора LLM Primer IV. Почему монолитные агенты распадаются по мере роста системных промптов, проблема интеграций N на M, скрытая под этим, и переход от prompt engineering к context engineering, под который и был построен MCP.
2026-03-30Глава 11 — Непрерывные обновления и оптимизация пайплайна
Одиннадцатый и заключительный пост разбора LLM Primer III. CDC и инкрементальная индексация держат корпус свежим, семантическое кеширование и тиринг моделей держат латентность низкой, а четырёхстадийная петля обратной связи закрывает разрыв между тем, что продакшен говорит команде, и тем, что команда реально меняет — плюс мост в Том IV про Model Context Protocol.
2026-03-28Глава 10 — Ведущие фреймворки оценки
Десятый пост разбора LLM Primer III. Полевой путеводитель по фреймворкам, превращающим Триаду оценки в нечто, что команда способна реально гонять — RAGAS, TruLens, DeepEval с одной стороны, Braintrust, LangSmith, Phoenix, Galileo, Opik с другой, и Evaluation Gap, которую ни один пока не закрыл.
2026-03-27LLM Primer III — Введение в серию и оглавление
Открываем поглавный разбор третьей книги серии LLM Primer — Корпоративный ИИ с RAG. Почему retrieval-augmented generation выглядит просто снаружи и состоит из стопки дисциплин внутри, для кого эта книга и расписание одиннадцати постов с 18 по 28 марта.
2026-03-17Глава 12 — Построить LLM-систему, и что дальше
Последний пост разбора LLM Primer I по главам. Модель, инструменты, RAG, оценка и ограждения, сшитые в одну систему — и мост от Книги 1 к Книгам 2–7 серии.
2026-03-01Глава 11 — Меньше модели, умнее модели
Одиннадцатый пост разбора LLM Primer I по главам. Как уменьшить большие модели до размеров реальной эксплуатации — дистилляция, квантизация, MoE — и новая секция §11.6 издания 2026 года о моделях рассуждения.
2026-02-28Глава 10 — Мультимодальность: за пределами текста
Десятый пост разбора LLM Primer I по главам. Как тот же трансформер научился принимать картинки и звук — vision transformer и токенизация аудио — и честные ограничения за идеей «одна модель, которая видит всё».
2026-02-27Глава 9 — RAG: сшиваем свежую информацию в контекст
Девятый пост разбора LLM Primer I по главам. Что на самом деле делает RAG (Retrieval-Augmented Generation), как он подпирает чувство времени и фактическую точность модели, и где начинается разница между хорошим и плохим RAG.
2026-02-26Глава 8 — Когда одной модели мало: инструменты и агенты
Восьмой пост разбора LLM Primer I по главам. Территория, где модель обретает руки — использование инструментов, вызов функций, агенты — и новый §8.6 издания 2026 года с паттернами агентов: ReAct, планировщик-исполнитель, рефлексия.
2026-02-25Глава 7 — Промпт-инжиниринг как ремесло
Седьмой пост разбора LLM Primer I по главам. Четыре паттерна промптов, которые несут основную нагрузку — system prompt, few-shot, цепочка размышления, роль — и почему каждый из них работает, в свете механизма следующего токена.
2026-02-24