#KV cache

3 件の記事

18
6月 2026
テクノロジー

KVキャッシュ枯渇でLLMが眠るCMUの新研究

コンテキストを増やしても、モデルは過去の情報を深く推論できな…

11
6月 2026
テクノロジー

LCLMが16倍圧縮で長文LLMの速度と精度を両立

長文を扱うLLMは、入力が長くなるほどKVキャッシュが膨らみ…

22
4月 2026
テクノロジー

AI推論のボトルネックはGPUではない Graidが示すKV Cache再設計

AIエージェントの性能は、GPUの速さだけでは決まりません。…