エントロピーに基づく選択的エージェントガイダンス手法 SAGE
arXiv cs.AI ・ 2026-09-01
原題: Selective Agent Guidance via Entropy: Learning Autonomous Policies from Imperfect VLM Teachers
AI による要約
VLM を教師として活用し、不確実性が高い場合のみクエリする軽量な自律ポリシー学習手法 SAGE を提案する。VLM のアドバイスを信頼度に応じて重み付けし、環境との相互作用でポリシーを改善する。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。