KVキャッシュとは

LLM / 推論

要点

モデルがすでに読んだ入力の途中計算を保存し、同じ先頭部分を再計算せずに続きから処理する仕組みです。

KVキャッシュの意味と、制作資料の中でどのように使われているかを確認します。

正式な意味

モデルがすでに読んだ入力の途中計算を保存し、同じ先頭部分を再計算せずに続きから処理する仕組みです。

英語:
Key-Value Cache

この説明を書くときに確認した情報

できるだけ公式資料や原著論文を確認しています。

  1. 公式資料NVIDIA
    Dynamo Routing Concepts

    最終確認: 2026-08-09