トレンド一覧

多モードLLMの幻覚を文脈較正で軽減するDirect Preference Optimization

arXiv cs.CV ・ 2026-08-12

原題: Context Blindness in DPO: Mitigating Object Hallucination in MLLMs via Context-Calibrated Preference Optimization

AI による要約

多峰性大言語モデル(MLLM)の物体ハルシネーション(幻覚)を抑制するため、モデルの文脈利用度を測る指標Contextual Preference Gainを導入した。従来の選好最適化が文脈を十分に活用できていない問題を解消し、文脈較正選好最適化によってハルシネーションを削減させた。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。

LLM・基盤モデル / 研究・論文

この話題に関わるコラム