トレンド一覧

LLMの多重選好整合にSTAGEが安定性制御で新手法

arXiv cs.CL ・ 2026-08-17

原題: STAGE: Controlled Objective Admission for Multi-Preference LLM Alignment

AI による要約

LLMの多重選好整合問題に対し、報酬次元を時系列で段階的に最適化する手法「STAGE」を提案した。安定性ガイド型のアクティブセット制御により、報酬偏差ゲートで低偏差時や待機予算消化時に新たな選好次元を追加し、段階的な拡張を実現。15の訓練選好と16のベンチマーク列で同時スカラー化法を上回る平均成績を達成した。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。

LLM・基盤モデル

この話題に関わるコラム