Evidence Attribution in Visual Document Understanding without Coordinates or Region Labels
arXiv cs.CL ・ 2026-07-27
AI による要約
視覚的文書理解モデルにおいて、根拠領域をバウンディングボックスの座標で直接出力させる従来のインターフェースが誤認識の原因になっていることが指摘された。テキストの直接引用とレイアウトパーサーを組み合わせた言語ベースの形式を採用することで、根拠特定の正確性が著しく向上することが示された。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。