医療視覚言語セグメンテーションにおけるテキスト感度評価
arXiv cs.CV ・ 2026-09-02
原題: Characterizing Text Branch Sensitivity in Medical Vision-Language Segmentation via Evidence Decoupling
AI による要約
医療画像セグメンテーションにおいて、事前学習済み視覚言語モデル(VLM)のピクセル単位の予測に臨床テキストがどの程度寄与しているかを体系的に調査した。一般的な融合モジュールに対する性能の非感度を確認した上で、エビデンス深層学習と深層監視に基づく「Evidence Decoupling Decoder(EDD)」を提案した。EDDを用いることで、画像エージェントとテキスト変調されたエージェントの証拠をデコード過程で分解し、テキスト情報の役割を明示した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。