OptimismBench: Forecasting Bias and the Alignment Effect in Language Model Judgment
arXiv cs.CL ・ 2026-07-29
AI による要約
言語モデルの確率判断における方向性バイアスを検出する「OptimismBench」が導入された。成功と失敗の両方のフレームを用いて反転ペアで評価した結果、大半のモデルが楽観的なバイアスを持つことが示された。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。