Visual Credit Audit for Multimodal Spatial Reasoning
arXiv cs.AI ・ 2026-07-29
AI による要約
マルチモーダルモデルの空間推論において、画像情報が実際の推論にどの程度寄与しているかを検証するフレームワーク「Visual Credit Audit」を提案する。従来の空間ベンチマークにおける「画像なしでも正解できるケース」を分離し、モデルの視覚的根拠を正確に評価する。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。