LLMファミリー間におけるKVキャッシュ転送とPrefill再利用手法
arXiv cs.LG ・ 2026-08-04
原題: Cross-Model KV Cache Transfer in LLM Families: A Closed-Form Linear Mapping for Prefill Reuse
AI による要約
LLMファミリー内でモデルを変更する際、既存のKVキャッシュを線形写像を用いて再利用しPrefill処理を省略する手法が提案された。これによりモデル切り替え時の計算コストを大幅に削減し、動的なルーティングやコスト最適化が容易になる。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.LG)をご確認ください。