外部コンテキストの信頼性を学習する選好的選好最適化の手法
arXiv cs.AI ・ 2026-08-06
原題: Learning When to Trust via Selective Context Preference Optimization
AI による要約
言語モデルが誤解を招く外部シグナルによって正解を誤らせる問題に対し、コンテキストの信頼性を判定する選択的信頼の枠組みが提案された。評価用ベンチマーク「MIST」と評価指標「SC2W」の構築に加え、DPOを活用して誤答パターンを学習する手法「SCOPE」を開発した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。