Введение в LLM

Эта страница предоставляет понятное руководство по большим языковым моделям (LLM), от основ до приложений для любителей ИИ.


Всего доступно 36 статей. | Текущая страница 1 из 1.

Глава 17 — Будущие угрозы и формирующиеся защиты

Глава 17 — Будущие угрозы и формирующиеся защиты Семнадцатый и заключительный пост поглавного разбора LLM Primer VII: AI Security. Глава, смотрящая за пределы д…

2026-05-26

Глава 12 — Контроль доступа и идентичность

Глава 12 — Контроль доступа и идентичность Двенадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, отвечающая на композиционный вопрос — кому ра…

2026-05-21

Глава 11 — Наблюдаемость, логирование и реагирование на инциденты

Глава 11 — Наблюдаемость, логирование и реагирование на инциденты Одиннадцатый пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с логиро…

2026-05-20

Глава 7 — Галлюцинации и надёжность

Глава 7 — Галлюцинации и надёжность Седьмой пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с надёжностью как со свойством безопасности…

2026-05-16

Глава 6 — Риски retrieval-augmented generation

Глава 6 — Риски retrieval-augmented generation Шестой пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с retrieval-корпусом как с недове…

2026-05-15

Глава 5 — Валидация входа и фильтрация выхода

Глава 5 — Валидация входа и фильтрация выхода Пятый пост поглавного разбора LLM Primer VII: AI Security. Глава, превращающая многослойную рамку смягчения главы…

2026-05-14

Глава 4 — Prompt injection и джейлбрейки

Глава 4 — Prompt injection и джейлбрейки Четвёртый пост поглавного разбора LLM Primer VII: AI Security. Глава, сидящая в центре практической проблемы безопаснос…

2026-05-13

Глава 3 — Безопасность данных и приватность

Глава 3 — Безопасность данных и приватность Третий пост поглавного разбора LLM Primer VII: AI Security. Глава, обращающаяся с данными как с активом, имеющим жиз…

2026-05-12

Глава 2 — Моделирование угроз для систем LLM

Глава 2 — Моделирование угроз для систем LLM Второй пост поглавного разбора LLM Primer VII: AI Security. Глава, берущая четыре вопроса Шостака, STRIDE, PASTA и…

2026-05-11

Глава 1 — Почему безопасность ИИ иная

Глава 1 — Почему безопасность ИИ иная Первый пост поглавного разбора LLM Primer VII: AI Security. Глава, утверждающая, что безопасность ИИ — это не традиционная…

2026-05-10

LLM Primer VII — Введение в серию и указатель

LLM Primer VII — Введение в серию и указатель Поглавный разбор книги LLM Primer VII: AI Security — финального тома серии, где инженерная дуга LLM Primer приходи…

2026-05-09

Глава 14 — Экономика токенов и цены API

Глава 14 — Экономика токенов и цены API Четырнадцатый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, соединяющая физику из главы 1 со строкам…

2026-05-06

Глава 1 — Механика генерации токенов

Глава 1 — Механика генерации токенов Первый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, утверждающая, что почти каждый трудный вопрос serv…

2026-04-23

LLM Primer VI — Введение в серию и указатель

LLM Primer VI — Введение в серию и указатель Поглавный разбор книги LLM Primer VI: Scaling AI Systems — тома, где инференс LLM рассматривается как инженерная ди…

2026-04-22

Глава 8 — Оптимизация производительности, serving и стоимости

Глава 8 — Оптимизация производительности, serving и стоимости Финальный пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относ…

2026-04-21

Глава 6 — Наблюдаемость и трассировка ИИ

Глава 6 — Наблюдаемость и трассировка ИИ Шестой пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к пользовательско…

2026-04-19

Глава 5 — Оценка LLM-приложений

Глава 5 — Оценка LLM-приложений Пятый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, признающая, что assertEqual для LLM-вых…

2026-04-18

Глава 4 — ИИ-агенты и вызов инструментов

Глава 4 — ИИ-агенты и вызов инструментов Четвёртый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к агенту как к…

2026-04-17

Глава 3 — Retrieval-Augmented Generation

Глава 3 — Retrieval-Augmented Generation Третий пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, проходящая RAG-конвейер от на…

2026-04-16

Глава 2 — Foundation-модели и prompt engineering

Глава 2 — Foundation-модели и prompt engineering Второй пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к prompt…

2026-04-15

Глава 1 — Дисциплина AI-инженерии

Глава 1 — Дисциплина AI-инженерии Первый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, утверждающая, что причина, по которо…

2026-04-14

LLM Primer V — Введение в серию и оглавление

LLM Primer V — Введение в серию и оглавление Поглавный разбор LLM Primer V: Building Real-World LLM Applications — тома, который относится к AI-инженерии как к…

2026-04-13

Глава 14 — Бенчмаркинг, тестирование и производительность

Пятнадцатый и финальный пост поглавного разбора LLM Primer IV. MCP-Universe Benchmark на реальных серверах, два системных режима отказа, которые он раскрыл, десятикратный разрыв пропускной способности между session-per-request и пулом сессий, и мост к тому V.

2026-04-12

Глава 13 — Фреймворки и облачная интеграция

Четырнадцатый пост поглавного разбора LLM Primer IV. Strands с Bedrock, AWS state-layer-паттерн, Microsoft Agent Framework, LangChain, Semantic Kernel — и три продакшен-формы интеграции, к которым команды приходят независимо.

2026-04-11

Глава 10 — Память для долгих задач

Десятый пост поглавного разбора LLM Primer IV. Краткосрочная память через окна и ReAct-черновики, долгосрочная память через эпизодические векторы и семантические хранилища, и техники сжатия, держащие агента продуктивным часами и днями.

2026-04-08

Глава 6 — Фундаментальные стратегии оркестрации

Шестой пост поглавного разбора LLM Primer IV. Две базовые формы оркестрации — последовательные пайплайны и параллельный scatter-gather — и предварительный вопрос, который должна задать каждая команда: является ли мультиагентная система вообще правильным ответом?

2026-04-04

Глава 11 — Непрерывные обновления и оптимизация пайплайна

Одиннадцатый и заключительный пост разбора LLM Primer III. CDC и инкрементальная индексация держат корпус свежим, семантическое кеширование и тиринг моделей держат латентность низкой, а четырёхстадийная петля обратной связи закрывает разрыв между тем, что продакшен говорит команде, и тем, что команда реально меняет — плюс мост в Том IV про Model Context Protocol.

2026-03-28

Глава 10 — Ведущие фреймворки оценки

Десятый пост разбора LLM Primer III. Полевой путеводитель по фреймворкам, превращающим Триаду оценки в нечто, что команда способна реально гонять — RAGAS, TruLens, DeepEval с одной стороны, Braintrust, LangSmith, Phoenix, Galileo, Opik с другой, и Evaluation Gap, которую ни один пока не закрыл.

2026-03-27

Глава 5 — Архитектура поискового пайплайна

Пятый пост разбора LLM Primer III. Почему одиночный векторный поиск — это не пайплайн: гибридный поиск, reciprocal rank fusion, cross-encoder reranking и переписывание запроса и HyDE, собранные в продакшен-архитектуру, к которой сходятся зрелые RAG-системы.

2026-03-22

Глава 4 — Выбор подходящей векторной базы данных

Четвёртый пост разбора LLM Primer III. Архитектурный раздел между специализированными векторными базами и расширениями вроде Postgres, лидеры managed-сегмента (Pinecone, Vertex), open-source поле (Qdrant, Milvus, Weaviate), встраиваемые опции и три операционные оси — резидентность, ops, стоимость, на которых решается реальный выбор.

2026-03-21

Глава 3 — Продвинутые фреймворки чанкинга

Третий пост разбора LLM Primer III. Спектр чанкинга от фиксированного размера до учёта структуры, миф об overlap, обрыв контекста, тихо разрушающий поиск, и техники contextual retrieval и late chunking, переписавшие фронтир.

2026-03-20

Глава 2 — Интеллектуальный парсинг документов

Второй пост разбора LLM Primer III. Почему PDF — это не текстовый файл, что на самом деле сохраняют парсеры с учётом макета, текущий ландшафт инструментов (LlamaParse, Docling, Unstructured, Marker-PDF, Firecrawl, DeepSeek-OCR) и мультимодальный трек, ищущий по изображениям страниц напрямую.

2026-03-19

Глава 1 — Эволюция архитектуры RAG

Первый пост разбора LLM Primer III. Четыре архитектурные позы RAG — Naive, Advanced, Modular, Agentic — читаются как история о передаче LLM всё большей агентности по одному решению за раз, и честный ответ на вопрос, когда дообучение лучше поиска.

2026-03-18

LLM Primer III — Введение в серию и оглавление

Открываем поглавный разбор третьей книги серии LLM Primer — Корпоративный ИИ с RAG. Почему retrieval-augmented generation выглядит просто снаружи и состоит из стопки дисциплин внутри, для кого эта книга и расписание одиннадцати постов с 18 по 28 марта.

2026-03-17

Глава 11 — Оценка, калибровка и вывод

Одиннадцатый пост разбора LLM Primer II: Language Models Through Mathematics по главам. Глава, в которой мы задаёмся вопросом: как вообще измерить машину, способную сказать что угодно — и обнаруживаем, что уверенная модель часто оказывается плохо откалиброванной.

2026-03-13

Глава 9 — RAG: сшиваем свежую информацию в контекст

Девятый пост разбора LLM Primer I по главам. Что на самом деле делает RAG (Retrieval-Augmented Generation), как он подпирает чувство времени и фактическую точность модели, и где начинается разница между хорошим и плохим RAG.

2026-02-26