LLM入門

このページでは、AI技術に関心のある方のために、LLM(大規模言語モデル)の基礎から応用までをわかりやすく解説します。


合計 9 件の記事があります。 | 現在 1 ページ中の 1 ページ目です。

第9章 — モデル整合性とサプライチェーンリスク

『LLM Primer VII: AIセキュリティ』章別ウォークスルー第9回。モデル成果物を第三者配布のバイナリとして扱う章 — バイナリ配布が常に伴ってきたデシリアライゼーション、バックドア、出所の懸念を辿る。

2026-05-18

第11章 — プラットフォームとオーケストレーション層

『LLM Primer VI』ウォークスルー第11回。プラットフォームの選択はフィーチャーではなく、どの運用モデルがチームの既存文化に合うかの問題である。

2026-05-03

第6章 — プルーニングと知識蒸留

『LLM Primer VI』ウォークスルー第6回。重み数を直接攻める章。無関係な重みをゼロにし、大きな教師の振る舞いを小さな生徒に転写する。Hopperの2:4スパース性、蒸留、そして3圧縮の順序。

2026-04-28

第4章 — 専用AIシリコンとASIC

『LLM Primer VI』ウォークスルー第4回。GPUかASICかの選択はワークロード形状の問題であり、Groq、Inferentia2、TPU、Gaudi 3のそれぞれが勝つ領域と失敗モードを歩く。

2026-04-26

第14章 — エンジニアのための実践的知識

LLM Primer II 第14章、歩き読みシリーズの最終回です。本書を読み終えたあと、どのように理解を深め続けるか。PyTorch、JAX、Hugging Face、vLLM などの道具立てを数学に重ね、シリーズの次の巻へとご案内します。

2026-03-16

4.3 LLMのモデル圧縮技術|知識蒸留、量子化、プルーニングの解説

知識蒸留、量子化、プルーニングなどのモデル圧縮技術を使い、LLMの計算コストと推論速度を改善する方法を解説します。Pythonの実装例も紹介。

2024-11-15

4.2 LLMの推論速度を最適化する方法|バッチ推論と半精度推論の活用

LLMの推論速度を改善するための技術を解説。バッチ推論、ONNX Runtime、半精度推論(FP16)など、効率的な推論手法とその実装例を紹介します。

2024-11-14

4.0 LLMのモデル圧縮と推論速度の最適化|効率的なパフォーマンス改善

LLMのモデル圧縮技術と推論速度の最適化手法を解説。量子化、知識蒸留、ONNXを使用したPython実装例で効率的なLLMのデプロイをサポート。

2024-11-12

9.2 LLMの実装に向けたリソースと学習の提案 - 効果的なツールとコースの活用

LLM(大規模言語モデル)の実装に必要なリソースや学習方法を紹介します。オープンソースフレームワーク、クラウドプラットフォーム、データセット、オンラインコースなど、実践的なアプローチに必要なリソースを提供します。

2024-10-27