X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment
arXiv cs.LG ・ 2026-07-23
AI による要約
大規模音声言語モデルの推論能力を向上させるため、テキストモデルから知識を蒸留するフレームワーク「X^3-OPD」が提案された。クロスモーダルなアプローチにより、音声認識だけでなく高度な論理推論の獲得を目指す。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.LG)をご確認ください。