視覚的推論を高めるマルチモーダル自己蒸留手法OPD-V
arXiv cs.AI ・ 2026-08-05
原題: OPD-V: Visual On-Policy Self-Distillation with Modality Balance
AI による要約
マルチモーダル大規模言語モデルの視覚的推論能力を向上させるため、モダリティの不均衡に着目した新しい自己蒸留手法「OPD-V」が開発された。テキスト情報への過度な依存による情報の見落としを防ぎ、マルチモーダル入力を十分に統合することで推論精度を高める。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。