KVキャッシュとは
LLM / 推論
要点
モデルがすでに読んだ入力の途中計算を保存し、同じ先頭部分を再計算せずに続きから処理する仕組みです。
KVキャッシュの意味と、制作資料の中でどのように使われているかを確認します。
正式な意味
モデルがすでに読んだ入力の途中計算を保存し、同じ先頭部分を再計算せずに続きから処理する仕組みです。
- 英語:
- Key-Value Cache
この説明を書くときに確認した情報
できるだけ公式資料や原著論文を確認しています。
- 公式資料・NVIDIADynamo Routing Concepts
最終確認: 2026-08-09