Eviction as Estimation: A Fixed-Lag Smoothing View of Test-Time Memory, and When Measuring Beats Accumulating
arXiv cs.AI ・ 2026-07-27
AI による要約
LLMの限定されたワーキングメモリ管理(KVキャッシュ破棄)を推定問題として捉え直す理論的枠組みと新手法「RMM」が発表された。追加学習なしで直近の注目パターンを数ステップ観察してから破棄判断を行うことで、メモリ効率と生成精度の両立を実現している。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。