Введение в LLM
Эта страница предоставляет понятное руководство по большим языковым моделям (LLM), от основ до приложений для любителей ИИ.
Глава 9 — Спекулятивный декодинг
Глава 9 — Спекулятивный декодинг Девятый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, показывающая, что у последовательного узкого места ав…
2026-05-01Глава 6 — Обрезка и дистилляция знаний
Глава 6 — Обрезка и дистилляция знаний Шестой пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, атакующая количество весов напрямую — сначала об…
2026-04-28Глава 5 — Демистификация квантизации
Глава 5 — Демистификация квантизации Пятый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, объясняющая, почему 70B-модель выживает 4-битную кв…
2026-04-27Глава 4 — Специализированный ИИ-кремний и ASIC
Глава 4 — Специализированный ИИ-кремний и ASIC Четвёртый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, утверждающая, что выбор между GPU и A…
2026-04-26Глава 3 — Дата-центровые GPU для генеративного ИИ
Глава 3 — Дата-центровые GPU для генеративного ИИ Третий пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, утверждающая, что serving-GPU нужно п…
2026-04-25Глава 1 — Механика генерации токенов
Глава 1 — Механика генерации токенов Первый пост поглавного разбора LLM Primer VI: Scaling AI Systems. Глава, утверждающая, что почти каждый трудный вопрос serv…
2026-04-23Глава 8 — Оптимизация производительности, serving и стоимости
Глава 8 — Оптимизация производительности, serving и стоимости Финальный пост поглавного разбора LLM Primer V: Building Real-World LLM Applications. Глава, относ…
2026-04-21Глава 11 — Меньше модели, умнее модели
Одиннадцатый пост разбора LLM Primer I по главам. Как уменьшить большие модели до размеров реальной эксплуатации — дистилляция, квантизация, MoE — и новая секция §11.6 издания 2026 года о моделях рассуждения.
2026-02-28Глава 10 — Мультимодальность: за пределами текста
Десятый пост разбора LLM Primer I по главам. Как тот же трансформер научился принимать картинки и звук — vision transformer и токенизация аудио — и честные ограничения за идеей «одна модель, которая видит всё».
2026-02-27LLM Primer I — разбор по главам: вступление и оглавление
Вступление к серии глав-разборов LLM Primer I. Как устроена сама книга, что даёт каждая глава, и расписание двенадцати постов между 18 февраля и 1 марта.
2026-02-17