マルチモーダルLLMの空間推論のためのトレーニング不要フレームワーク
arXiv cs.CL ・ 2026-08-05
原題: Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs
AI による要約
マルチモーダルLLMの空間推論で生じる不正確な中間判断を検証・修正する「Spatial Evidence Graph (SEG)」を用いたトレーニング不要のフレームワークを提案し、最終的な回答精度を向上させた。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。