Введение в LLM
Эта страница предоставляет понятное руководство по большим языковым моделям (LLM), от основ до приложений для любителей ИИ.
Глава 17 — Будущие угрозы и формирующиеся защиты
Глава 17 — Будущие угрозы и формирующиеся защиты Семнадцатый и заключительный пост поглавного разбора LLM Primer VII: AI Security. Глава, смотрящая за пределы д…
2026-05-26Глава 12 — Контроль доступа и идентичность
Глава 12 — Контроль доступа и идентичность Двенадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, отвечающая на композиционный вопрос — кому ра…
2026-05-21Глава 11 — Наблюдаемость, логирование и реагирование на инциденты
Глава 11 — Наблюдаемость, логирование и реагирование на инциденты Одиннадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с логиро…
2026-05-20Глава 7 — Галлюцинации и надёжность
Глава 7 — Галлюцинации и надёжность Седьмой пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с надёжностью как со свойством безопасности…
2026-05-16Глава 6 — Риски retrieval-augmented generation
Глава 6 — Риски retrieval-augmented generation Шестой пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с retrieval-корпусом как с недове…
2026-05-15Глава 5 — Валидация входа и фильтрация выхода
Глава 5 — Валидация входа и фильтрация выхода Пятый пост поглавного разбора LLM Primer VII: AI Security. Глава, превращающая многослойную рамку смягчения главы…
2026-05-14Глава 4 — Prompt injection и джейлбрейки
Глава 4 — Prompt injection и джейлбрейки Четвёртый пост поглавного разбора LLM Primer VII: AI Security. Глава, сидящая в центре практической проблемы безопаснос…
2026-05-13Глава 3 — Безопасность данных и приватность
Глава 3 — Безопасность данных и приватность Третий пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с данными как с активом, имеющим жиз…
2026-05-12Глава 2 — Моделирование угроз для систем LLM
Глава 2 — Моделирование угроз для систем LLM Второй пост поглавного разбора LLM Primer VII: AI Security. Глава, берущая четыре вопроса Шостака, STRIDE, PASTA и…
2026-05-11Глава 1 — Почему безопасность ИИ иная
Глава 1 — Почему безопасность ИИ иная Первый пост поглавного разбора LLM Primer VII: AI Security. Глава, утверждающая, что безопасность ИИ — это не традиционная…
2026-05-10LLM Primer VII — Введение в серию и указатель
LLM Primer VII — Введение в серию и указатель Поглавный разбор книги LLM Primer VII: AI Security — финального тома серии, где инженерная дуга LLM Primer приходи…
2026-05-09Глава 14 — Экономика токенов и цены API
Глава 14 — Экономика токенов и цены API Четырнадцатый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, соединяющая физику из главы 1 со строкам…
2026-05-06Глава 1 — Механика генерации токенов
Глава 1 — Механика генерации токенов Первый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, утверждающая, что почти каждый трудный вопрос serv…
2026-04-23LLM Primer VI — Введение в серию и указатель
LLM Primer VI — Введение в серию и указатель Поглавный разбор книги LLM Primer VI: Scaling AI Systems — тома, где инференс LLM рассматривается как инженерная ди…
2026-04-22Глава 8 — Оптимизация производительности, serving и стоимости
Глава 8 — Оптимизация производительности, serving и стоимости Финальный пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относ…
2026-04-21Глава 6 — Наблюдаемость и трассировка ИИ
Глава 6 — Наблюдаемость и трассировка ИИ Шестой пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к пользовательско…
2026-04-19Глава 5 — Оценка LLM-приложений
Глава 5 — Оценка LLM-приложений Пятый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, признающая, что assertEqual для LLM-вых…
2026-04-18Глава 4 — ИИ-агенты и вызов инструментов
Глава 4 — ИИ-агенты и вызов инструментов Четвёртый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к агенту как к…
2026-04-17Глава 3 — Retrieval-Augmented Generation
Глава 3 — Retrieval-Augmented Generation Третий пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, проходящая RAG-конвейер от на…
2026-04-16Глава 2 — Foundation-модели и prompt engineering
Глава 2 — Foundation-модели и prompt engineering Второй пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к prompt…
2026-04-15Глава 1 — Дисциплина AI-инженерии
Глава 1 — Дисциплина AI-инженерии Первый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, утверждающая, что причина, по которо…
2026-04-14LLM Primer V — Введение в серию и оглавление
LLM Primer V — Введение в серию и оглавление Поглавный разбор LLM Primer V: Building Real-World LLM Applications — тома, который относится к AI-инженерии как к…
2026-04-13Глава 14 — Бенчмаркинг, тестирование и производительность
Пятнадцатый и финальный пост поглавного разбора LLM Primer IV. MCP-Universe Benchmark на реальных серверах, два системных режима отказа, которые он раскрыл, десятикратный разрыв пропускной способности между session-per-request и пулом сессий, и мост к тому V.
2026-04-12Глава 13 — Фреймворки и облачная интеграция
Четырнадцатый пост поглавного разбора LLM Primer IV. Strands с Bedrock, AWS state-layer-паттерн, Microsoft Agent Framework, LangChain, Semantic Kernel — и три продакшен-формы интеграции, к которым команды приходят независимо.
2026-04-11Глава 10 — Память для долгих задач
Десятый пост поглавного разбора LLM Primer IV. Краткосрочная память через окна и ReAct-черновики, долгосрочная память через эпизодические векторы и семантические хранилища, и техники сжатия, держащие агента продуктивным часами и днями.
2026-04-08Глава 6 — Фундаментальные стратегии оркестрации
Шестой пост поглавного разбора LLM Primer IV. Две базовые формы оркестрации — последовательные пайплайны и параллельный scatter-gather — и предварительный вопрос, который должна задать каждая команда: является ли мультиагентная система вообще правильным ответом?
2026-04-04Глава 11 — Непрерывные обновления и оптимизация пайплайна
Одиннадцатый и заключительный пост разбора LLM Primer III. CDC и инкрементальная индексация держат корпус свежим, семантическое кеширование и тиринг моделей держат латентность низкой, а четырёхстадийная петля обратной связи закрывает разрыв между тем, что продакшен говорит команде, и тем, что команда реально меняет — плюс мост в Том IV про Model Context Protocol.
2026-03-28Глава 10 — Ведущие фреймворки оценки
Десятый пост разбора LLM Primer III. Полевой путеводитель по фреймворкам, превращающим Триаду оценки в нечто, что команда способна реально гонять — RAGAS, TruLens, DeepEval с одной стороны, Braintrust, LangSmith, Phoenix, Galileo, Opik с другой, и Evaluation Gap, которую ни один пока не закрыл.
2026-03-27Глава 5 — Архитектура поискового пайплайна
Пятый пост разбора LLM Primer III. Почему одиночный векторный поиск — это не пайплайн: гибридный поиск, reciprocal rank fusion, cross-encoder reranking и переписывание запроса и HyDE, собранные в продакшен-архитектуру, к которой сходятся зрелые RAG-системы.
2026-03-22Глава 4 — Выбор подходящей векторной базы данных
Четвёртый пост разбора LLM Primer III. Архитектурный раздел между специализированными векторными базами и расширениями вроде Postgres, лидеры managed-сегмента (Pinecone, Vertex), open-source поле (Qdrant, Milvus, Weaviate), встраиваемые опции и три операционные оси — резидентность, ops, стоимость, на которых решается реальный выбор.
2026-03-21Глава 3 — Продвинутые фреймворки чанкинга
Третий пост разбора LLM Primer III. Спектр чанкинга от фиксированного размера до учёта структуры, миф об overlap, обрыв контекста, тихо разрушающий поиск, и техники contextual retrieval и late chunking, переписавшие фронтир.
2026-03-20Глава 2 — Интеллектуальный парсинг документов
Второй пост разбора LLM Primer III. Почему PDF — это не текстовый файл, что на самом деле сохраняют парсеры с учётом макета, текущий ландшафт инструментов (LlamaParse, Docling, Unstructured, Marker-PDF, Firecrawl, DeepSeek-OCR) и мультимодальный трек, ищущий по изображениям страниц напрямую.
2026-03-19Глава 1 — Эволюция архитектуры RAG
Первый пост разбора LLM Primer III. Четыре архитектурные позы RAG — Naive, Advanced, Modular, Agentic — читаются как история о передаче LLM всё большей агентности по одному решению за раз, и честный ответ на вопрос, когда дообучение лучше поиска.
2026-03-18LLM Primer III — Введение в серию и оглавление
Открываем поглавный разбор третьей книги серии LLM Primer — Корпоративный ИИ с RAG. Почему retrieval-augmented generation выглядит просто снаружи и состоит из стопки дисциплин внутри, для кого эта книга и расписание одиннадцати постов с 18 по 28 марта.
2026-03-17Глава 11 — Оценка, калибровка и вывод
Одиннадцатый пост разбора LLM Primer II: Language Models Through Mathematics по главам. Глава, в которой мы задаёмся вопросом: как вообще измерить машину, способную сказать что угодно — и обнаруживаем, что уверенная модель часто оказывается плохо откалиброванной.
2026-03-13Глава 9 — RAG: сшиваем свежую информацию в контекст
Девятый пост разбора LLM Primer I по главам. Что на самом деле делает RAG (Retrieval-Augmented Generation), как он подпирает чувство времени и фактическую точность модели, и где начинается разница между хорошим и плохим RAG.
2026-02-26