Введение в LLM
Эта страница предоставляет понятное руководство по большим языковым моделям (LLM), от основ до приложений для любителей ИИ.
Глава 9 — Спекулятивный декодинг
Глава 9 — Спекулятивный декодинг Девятый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, показывающая, что у последовательного узкого места ав…
2026-05-01Глава 6 — Обрезка и дистилляция знаний
Глава 6 — Обрезка и дистилляция знаний Шестой пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, атакующая количество весов напрямую — сначала об…
2026-04-28Глава 5 — Демистификация квантизации
Глава 5 — Демистификация квантизации Пятый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, объясняющая, почему 70B-модель выживает 4-битную кв…
2026-04-27LLM Primer VI — Введение в серию и указатель
LLM Primer VI — Введение в серию и указатель Поглавный разбор книги LLM Primer VI: Scaling AI Systems — тома, где инференс LLM рассматривается как инженерная ди…
2026-04-22Глава 8 — Оптимизация производительности, serving и стоимости
Глава 8 — Оптимизация производительности, serving и стоимости Финальный пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относ…
2026-04-21Глава 11 — Меньше модели, умнее модели
Одиннадцатый пост разбора LLM Primer I по главам. Как уменьшить большие модели до размеров реальной эксплуатации — дистилляция, квантизация, MoE — и новая секция §11.6 издания 2026 года о моделях рассуждения.
2026-02-28Глава 10 — Мультимодальность: за пределами текста
Десятый пост разбора LLM Primer I по главам. Как тот же трансформер научился принимать картинки и звук — vision transformer и токенизация аудио — и честные ограничения за идеей «одна модель, которая видит всё».
2026-02-27LLM Primer I — разбор по главам: вступление и оглавление
Вступление к серии глав-разборов LLM Primer I. Как устроена сама книга, что даёт каждая глава, и расписание двенадцати постов между 18 февраля и 1 марта.
2026-02-17