ソーシャルディダクションゲームを用いたLLMの推論と欺瞞行動の評価
arXiv cs.CL ・ 2026-07-30
原題: Can Agents Deceive? Evaluating Reasoning and Deception in ParliamentBench using a Social Deduction Game
AI による要約
大規模言語モデルの医療や法制などの重要設定への導入を見据え、欺瞞的・説得的行動能力を評価するためのベンチマークフレームワーク「ParliamentBench」を提案する研究。複数モデルを対象にゲームを通じた協調と欺瞞のパフォーマンスを検証しています。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。