AIチャットボットの妄想的行動リスクを評価する新しい手法DelusionEval
arXiv cs.CL ・ 2026-08-05
原題: DelusionEval: Measuring Delusion-Linked Behaviors in AI Chatbots
AI による要約
LLMの妄想的行動リスクを評価するDelusionEvalを開発し、18人のユーザーから収集した12,591件の会話履歴を用いて589のプロンプトでテストした。モデルサイズやリリース時期と妄想的行動の相関は見られなかった。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。