トレンド一覧

AIチャットボットの妄想的行動リスクを評価する新しい手法DelusionEval

arXiv cs.CL ・ 2026-08-05

原題: DelusionEval: Measuring Delusion-Linked Behaviors in AI Chatbots

AI による要約

LLMの妄想的行動リスクを評価するDelusionEvalを開発し、18人のユーザーから収集した12,591件の会話履歴を用いて589のプロンプトでテストした。モデルサイズやリリース時期と妄想的行動の相関は見られなかった。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。

規制・倫理 / LLM・基盤モデル

この話題に関わるコラム