空間関係分類を制御する自己グラウンディング証拠インタフェースSEER
arXiv cs.CV ・ 2026-08-04
原題: SEER: A Self-Grounded Evidence Interface for Controlled Spatial Relation Classification
AI による要約
ビジョン言語モデルが画像内の空間関係を問われた際に、クエリ固有の証拠を明示的に与えることで誤った推論を防ぐ推論時インタフェース「SEER」を提案した。追加の学習なしでVLMの空間推論精度を向上させることができる。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。