VLMの挙動: 科学的図の認識におけるVLMの挙動の評価
arXiv cs.CL ・ 2026-08-13
原題: How Do VLMs Behave When Blind or Misled? Behavioral Evaluation of VLMs on Scientific Figures
AI による要約
この研究では、VLMの認識精度と行動の信頼性を評価するためのベンチマークを提案した。SciFigBenchというベンチマークでは、VLMが科学的図を認識する際の挙動を評価する。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。