Введение в LLM

Эта страница предоставляет понятное руководство по большим языковым моделям (LLM), от основ до приложений для любителей ИИ.


Всего доступно 18 статей. | Текущая страница 1 из 1.

Глава 16 — Стратегии сокращения затрат в продакшене

Глава 16 — Стратегии сокращения затрат в продакшене Заключительный пост поглавного разбора LLM Primer VI: Scaling AI Systems. Каталог ортогональных приёмов, скл…

2026-05-08

Глава 15 — Serverless API против выделенной инфраструктуры

Глава 15 — Serverless API против выделенной инфраструктуры Пятнадцатый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, кладущая арифметику точ…

2026-05-07

Глава 7 — Продвинутые стратегии батчинга

Глава 7 — Продвинутые стратегии батчинга Седьмой пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, показывающая, что батчинг — не оптимизация, а…

2026-04-29

Глава 6 — Обрезка и дистилляция знаний

Глава 6 — Обрезка и дистилляция знаний Шестой пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, атакующая количество весов напрямую — сначала об…

2026-04-28

Глава 2 — Проблема KV-кэша

Глава 2 — Проблема KV-кэша Второй пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, называющая структуру данных, которая съедает VRAM каждой ser…

2026-04-24

LLM Primer VI — Введение в серию и указатель

LLM Primer VI — Введение в серию и указатель Поглавный разбор книги LLM Primer VI: Scaling AI Systems — тома, где инференс LLM рассматривается как инженерная ди…

2026-04-22

Глава 5 — Оценка LLM-приложений

Глава 5 — Оценка LLM-приложений Пятый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, признающая, что assertEqual для LLM-вых…

2026-04-18

Глава 2 — Foundation-модели и prompt engineering

Глава 2 — Foundation-модели и prompt engineering Второй пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относящаяся к prompt…

2026-04-15

Глава 1 — Дисциплина AI-инженерии

Глава 1 — Дисциплина AI-инженерии Первый пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, утверждающая, что причина, по которо…

2026-04-14

LLM Primer V — Введение в серию и оглавление

LLM Primer V — Введение в серию и оглавление Поглавный разбор LLM Primer V: Building Real-World LLM Applications — тома, который относится к AI-инженерии как к…

2026-04-13

Глава 9 — Управление бюджетом внимания

Девятый пост поглавного разбора LLM Primer IV. Context rot, обрыв lost-in-the-middle, tool-loadout rot и три архитектурных ответа — MCP, RAG, дообучение — на вопрос, где на самом деле живёт недостающее знание модели.

2026-04-07

Глава 6 — Фундаментальные стратегии оркестрации

Шестой пост поглавного разбора LLM Primer IV. Две базовые формы оркестрации — последовательные пайплайны и параллельный scatter-gather — и предварительный вопрос, который должна задать каждая команда: является ли мультиагентная система вообще правильным ответом?

2026-04-04

Глава 5 — Транспортные протоколы и обнаружение

Пятый пост поглавного разбора LLM Primer IV. Три транспорта, поддерживаемых MCP, слой обнаружения .well-known с Server Cards и скучные операционные заботы — CORS, валидация origin, кэширование, — решающие, является ли сервер кооперативным гражданином сети или обузой.

2026-04-03

LLM Primer IV — Введение в серию и оглавление

Открываем поглавный разбор четвёртой книги серии LLM Primer — Проектирование когнитивных способностей ИИ с MCP. Почему агентам нужен протокольный слой, чтобы выйти за пределы демо, для кого эта книга и расписание четырнадцати постов с 30 марта по 12 апреля.

2026-03-29

Глава 10 — Ведущие фреймворки оценки

Десятый пост разбора LLM Primer III. Полевой путеводитель по фреймворкам, превращающим Триаду оценки в нечто, что команда способна реально гонять — RAGAS, TruLens, DeepEval с одной стороны, Braintrust, LangSmith, Phoenix, Galileo, Opik с другой, и Evaluation Gap, которую ни один пока не закрыл.

2026-03-27

Глава 3 — Продвинутые фреймворки чанкинга

Третий пост разбора LLM Primer III. Спектр чанкинга от фиксированного размера до учёта структуры, миф об overlap, обрыв контекста, тихо разрушающий поиск, и техники contextual retrieval и late chunking, переписавшие фронтир.

2026-03-20

Глава 5 — Ещё остаются мелкие изъяны

Пятый пост разбора LLM Primer I по главам. Почему галлюцинации, отсутствие чувства времени, проблемы с вычислениями и колебания согласованности — не баги, а свойства одного и того же механизма предсказания следующего токена.

2026-02-22

Глава 2 — Вероятность, токены и текст

Второй пост разбора LLM Primer I по главам. Чем токены отличаются от слов, что такое то распределение вероятностей, которое модель строит на каждом шаге, и как temperature и top-p меняют характер вывода.

2026-02-19