Введение в LLM

Эта страница предоставляет понятное руководство по большим языковым моделям (LLM), от основ до приложений для любителей ИИ.


Всего доступно 40 статей. | Текущая страница 1 из 1.

Глава 12 — Контроль доступа и идентичность

Глава 12 — Контроль доступа и идентичность Двенадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, отвечающая на композиционный вопрос — кому ра…

2026-05-21

Глава 11 — Наблюдаемость, логирование и реагирование на инциденты

Глава 11 — Наблюдаемость, логирование и реагирование на инциденты Одиннадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с логиро…

2026-05-20

Глава 10 — Проектирование безопасных архитектур LLM

Глава 10 — Проектирование безопасных архитектур LLM Десятый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с архитектурой как с первич…

2026-05-19

Глава 7 — Галлюцинации и надёжность

Глава 7 — Галлюцинации и надёжность Седьмой пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с надёжностью как со свойством безопасности…

2026-05-16

Глава 6 — Риски retrieval-augmented generation

Глава 6 — Риски retrieval-augmented generation Шестой пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с retrieval-корпусом как с недове…

2026-05-15

Глава 4 — Prompt injection и джейлбрейки

Глава 4 — Prompt injection и джейлбрейки Четвёртый пост поглавного разбора LLM Primer VII: AI Security. Глава, сидящая в центре практической проблемы безопаснос…

2026-05-13

Глава 3 — Безопасность данных и приватность

Глава 3 — Безопасность данных и приватность Третий пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с данными как с активом, имеющим жиз…

2026-05-12

Глава 2 — Моделирование угроз для систем LLM

Глава 2 — Моделирование угроз для систем LLM Второй пост поглавного разбора LLM Primer VII: AI Security. Глава, берущая четыре вопроса Шостака, STRIDE, PASTA и…

2026-05-11

Глава 1 — Почему безопасность ИИ иная

Глава 1 — Почему безопасность ИИ иная Первый пост поглавного разбора LLM Primer VII: AI Security. Глава, утверждающая, что безопасность ИИ — это не традиционная…

2026-05-10

Глава 16 — Стратегии сокращения затрат в продакшене

Глава 16 — Стратегии сокращения затрат в продакшене Заключительный пост поглавного разбора LLM Primer VI: Scaling AI Systems. Каталог ортогональных приёмов, скл…

2026-05-08

Глава 14 — Экономика токенов и цены API

Глава 14 — Экономика токенов и цены API Четырнадцатый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, соединяющая физику из главы 1 со строкам…

2026-05-06

Глава 8 — KV-кэш следующего поколения

Глава 8 — KV-кэш следующего поколения Восьмой пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, переносящая понимание операционно-системного паг…

2026-04-30

Глава 7 — Продвинутые стратегии батчинга

Глава 7 — Продвинутые стратегии батчинга Седьмой пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, показывающая, что батчинг — не оптимизация, а…

2026-04-29

Глава 1 — Механика генерации токенов

Глава 1 — Механика генерации токенов Первый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, утверждающая, что почти каждый трудный вопрос serv…

2026-04-23

Глава 8 — Оптимизация производительности, serving и стоимости

Глава 8 — Оптимизация производительности, serving и стоимости Финальный пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относ…

2026-04-21

Глава 7 — Безопасность LLM и guardrails

Глава 7 — Безопасность LLM и guardrails Седьмой пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, называющая новую ось безопасн…

2026-04-20

Глава 4 — ИИ-агенты и вызов инструментов

Глава 4 — ИИ-агенты и вызов инструментов Четвёртый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к агенту как к…

2026-04-17

Глава 3 — Retrieval-Augmented Generation

Глава 3 — Retrieval-Augmented Generation Третий пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, проходящая RAG-конвейер от на…

2026-04-16

Глава 2 — Foundation-модели и prompt engineering

Глава 2 — Foundation-модели и prompt engineering Второй пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к prompt…

2026-04-15

Глава 13 — Фреймворки и облачная интеграция

Четырнадцатый пост поглавного разбора LLM Primer IV. Strands с Bedrock, AWS state-layer-паттерн, Microsoft Agent Framework, LangChain, Semantic Kernel — и три продакшен-формы интеграции, к которым команды приходят независимо.

2026-04-11

Глава 11 — Поверхности атак и уязвимости протокола

Одиннадцатый пост поглавного разбора LLM Primer IV. Классические атаки, адаптированные к MCP — Confused Deputy, Token Passthrough, Session Hijacking — протокол-уровневые изъяны вокруг capability escalation и неаутентифицированного sampling, и неявное распространение доверия, делающее отравление контекста структурной проблемой, а не вопросом гигиены.

2026-04-09

Глава 10 — Память для долгих задач

Десятый пост поглавного разбора LLM Primer IV. Краткосрочная память через окна и ReAct-черновики, долгосрочная память через эпизодические векторы и семантические хранилища, и техники сжатия, держащие агента продуктивным часами и днями.

2026-04-08

Глава 9 — Управление бюджетом внимания

Девятый пост поглавного разбора LLM Primer IV. Context rot, обрыв lost-in-the-middle, tool-loadout rot и три архитектурных ответа — MCP, RAG, дообучение — на вопрос, где на самом деле живёт недостающее знание модели.

2026-04-07

Глава 7 — Продвинутые совместные и динамические паттерны

Седьмой пост поглавного разбора LLM Primer IV. Консенсус roundtable, handoff-маршрутизация и magentic-оркестрация — паттерны, возникающие, когда топологию приходится строить под запрос, и режимы отказа (не-завершение, мисс-маршрутизация, ускользающее планирование), которых избегают простые паттерны.

2026-04-05

Глава 6 — Фундаментальные стратегии оркестрации

Шестой пост поглавного разбора LLM Primer IV. Две базовые формы оркестрации — последовательные пайплайны и параллельный scatter-gather — и предварительный вопрос, который должна задать каждая команда: является ли мультиагентная система вообще правильным ответом?

2026-04-04

Глава 4 — Клиентские примитивы: агентное поведение и контроль

Четвёртый пост поглавного разбора LLM Primer IV. Sampling, Roots и Elicitation — три небольших, контролируемых отверстия, которые MCP пробивает в стене между хостом и сервером, каждое — отданная назад возможность и принятый от имени пользователя риск.

2026-04-02

Глава 3 — Серверные примитивы: экспонирование контекста и возможностей

Третий пост поглавного разбора LLM Primer IV. Три существительных, которые может предложить MCP-сервер — Resources (чтение состояния), Prompts (переиспользуемые шаблоны), Tools (действия записи), — их схемы, жизненные циклы, модели ошибок и дисциплина выбора правильного примитива.

2026-04-01

Глава 1 — Кризис интеграций ИИ и подъём агентной архитектуры

Первый пост поглавного разбора LLM Primer IV. Почему монолитные агенты распадаются по мере роста системных промптов, проблема интеграций N на M, скрытая под этим, и переход от prompt engineering к context engineering, под который и был построен MCP.

2026-03-30

LLM Primer IV — Введение в серию и оглавление

Открываем поглавный разбор четвёртой книги серии LLM Primer — Проектирование когнитивных способностей ИИ с MCP. Почему агентам нужен протокольный слой, чтобы выйти за пределы демо, для кого эта книга и расписание четырнадцати постов с 30 марта по 12 апреля.

2026-03-29

Глава 9 — Триада оценки RAG

Девятый пост разбора LLM Primer III. RAG-система может отказывать в трёх разных местах, а отказы снаружи неразличимы. Триада оценки — релевантность контекста, верность и релевантность ответа — это малый словарь, не дающий чинить одну ошибку, измеряя другую.

2026-03-26

Глава 8 — Анонимизация данных в RAG-пайплайне

Восьмой пост разбора LLM Primer III. Анонимизация до генерации против после, три семейства техник — маскирование, синтетическая замена, дифференциальная приватность — и компромисс полезность–приватность, определяющий, остаётся ли система вообще полезной.

2026-03-25

Глава 2 — Интеллектуальный парсинг документов

Второй пост разбора LLM Primer III. Почему PDF — это не текстовый файл, что на самом деле сохраняют парсеры с учётом макета, текущий ландшафт инструментов (LlamaParse, Docling, Unstructured, Marker-PDF, Firecrawl, DeepSeek-OCR) и мультимодальный трек, ищущий по изображениям страниц напрямую.

2026-03-19

Глава 1 — Эволюция архитектуры RAG

Первый пост разбора LLM Primer III. Четыре архитектурные позы RAG — Naive, Advanced, Modular, Agentic — читаются как история о передаче LLM всё большей агентности по одному решению за раз, и честный ответ на вопрос, когда дообучение лучше поиска.

2026-03-18

Глава 12 — Построить LLM-систему, и что дальше

Последний пост разбора LLM Primer I по главам. Модель, инструменты, RAG, оценка и ограждения, сшитые в одну систему — и мост от Книги 1 к Книгам 2–7 серии.

2026-03-01

Глава 7 — Промпт-инжиниринг как ремесло

Седьмой пост разбора LLM Primer I по главам. Четыре паттерна промптов, которые несут основную нагрузку — system prompt, few-shot, цепочка размышления, роль — и почему каждый из них работает, в свете механизма следующего токена.

2026-02-24

Глава 6 — Безопасность, выравнивание, и что значит «быть полезным»

Шестой пост разбора LLM Primer I по главам. Почему связность и полезность — разные вещи, что именно настраивает выравнивание, и предварительный взгляд на новую секцию §6.6 издания 2026 года — конституционный ИИ, модели на основе дебатов, и свежие направления исследований.

2026-02-23

Глава 5 — Ещё остаются мелкие изъяны

Пятый пост разбора LLM Primer I по главам. Почему галлюцинации, отсутствие чувства времени, проблемы с вычислениями и колебания согласованности — не баги, а свойства одного и того же механизма предсказания следующего токена.

2026-02-22

Глава 2 — Вероятность, токены и текст

Второй пост разбора LLM Primer I по главам. Чем токены отличаются от слов, что такое то распределение вероятностей, которое модель строит на каждом шаге, и как temperature и top-p меняют характер вывода.

2026-02-19

Глава 1 — Что такое, в сущности, Большая Языковая Модель?

Первый пост разбора LLM Primer I по главам. Что на самом деле означают слова «большая», «языковая» и «модель», как мы прошли путь от систем на правилах до нейросетей, и три мифа, от которых стоит избавиться сразу.

2026-02-18

LLM Primer I — разбор по главам: вступление и оглавление

Вступление к серии глав-разборов LLM Primer I. Как устроена сама книга, что даёт каждая глава, и расписание двенадцати постов между 18 февраля и 1 марта.

2026-02-17