視覚世界モデルの評価をエージェント化するHarnessEval-Wを発表
arXiv cs.CV ・ 2026-08-17
原題: HarnessEval-W: Agentifying the Evaluation of Visual Worlds
AI による要約
視覚世界モデルの評価にエージェント型の枠組みを導入した「HarnessEval-W」を開発した。評価結果の根拠を明確化し、物理法則や因果関係の正確性を自動で検証する仕組みを提供する。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。