トレンド一覧

Eviction as Estimation: A Fixed-Lag Smoothing View of Test-Time Memory, and When Measuring Beats Accumulating

arXiv cs.AI ・ 2026-07-27

AI による要約

LLMの限定されたワーキングメモリ管理(KVキャッシュ破棄)を推定問題として捉え直す理論的枠組みと新手法「RMM」が発表された。追加学習なしで直近の注目パターンを数ステップ観察してから破棄判断を行うことで、メモリ効率と生成精度の両立を実現している。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。

LLM・基盤モデル / 研究・論文