模倣学習における対話的クエリと表現力のトレードオフの解明
arXiv cs.AI ・ 2026-07-31
原題: When Does On-Policy Interaction Help? Representational Tradeoffs in Value-Based Imitation Learning
AI による要約
模倣学習においてエキスパートとの対話的クエリや価値関数推定がパフォーマンスを向上させる理由と、その相互作用が解明された。エキスパートとの相互作用により学習者の表現力要求が緩和されることが示されている。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。