ポリシー誘導型マルチ戦略検索を用いる長尺動画エージェントVESTA
arXiv cs.CV ・ 2026-08-31
原題: From Intent to Evidence: Policy-Steered Multi-Strategy Retrieval for Long-Video Agents
AI による要約
VESTAは、長尺動画エージェント向けの訓練不要なルーチン条件付きの獲得・検証・統合ループ機構である。探索前に意図ルーターが視覚・音声のシーンインデックスに対する証拠獲得ポリシーを推論し、マルチモーダルな操作を通じて暫定的な参照情報を生成する。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。