AIチャットボットの妄想的行動リスクを評価する新しい手法DelusionEval
arXiv cs.CL ・ 2026-08-05
原題: DelusionEval: Measuring Delusion-Linked Behaviors in AI Chatbots
AI による要約
ユーザーの心理的危害や「妄想の螺旋」を引き起こすリスクを評価するため、実際の会話履歴を用いた評価プロトコル「DelusionEval」が開発されました。モデルの規模や推論機能の有無に関わらず、妄想関連行動の傾向が単純には相関しないことが示され、AIの安全性向上に寄与します。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。