VISOR:視覚言語モデルの属性ホールシネーションのメカニスト的研究
arXiv cs.CV ・ 2026-08-11
原題: When Visual Signals Mislead: A Mechanistic Study of Attribute Hallucination in Vision-Language Models
AI による要約
視覚言語モデル(VLM)では、属性ホールシネーション(attribute hallucination)が発生することがある。研究者は、VISORフレームワークを提案しており、VLMの属性ホールシネーションのメカニズムを解明する。VISORは、視覚信号と言語先行信号を分離し、属性ホールシネーションの原因を分析する。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。