LLM入門

このページでは、AI技術に関心のある方のために、LLM(大規模言語モデル)の基礎から応用までをわかりやすく解説します。


合計 3 件の記事があります。 | 現在 1 ページ中の 1 ページ目です。

第12章 — 分離型サービングとKubernetes

『LLM Primer VI』ウォークスルー第12回。プリフィルとデコードを別GPUプールに分割し、KVキャッシュをNVLink/InfiniBand上で運ぶ。ポッドを正しい側に留めるKubernetesのプリミティブ。

2026-05-04

第11章 — プラットフォームとオーケストレーション層

『LLM Primer VI』ウォークスルー第11回。プラットフォームの選択はフィーチャーではなく、どの運用モデルがチームの既存文化に合うかの問題である。

2026-05-03

6.1 LLMアプリケーションのスケーラブルなデプロイ | DockerとKubernetesの活用

LLMアプリケーションをDockerでコンテナ化し、Kubernetesでスケーラブルにデプロイする方法を解説します。Pythonベースのアプリケーションに最適なデプロイ手法です。

2024-11-21