大言語モデルの拒否行動に対するドア・イン・ザ・フェイス手法の効果
arXiv cs.AI ・ 2026-09-02
原題: Door-in-the-Face Requests and Refusal Behaviour in Large Language Models
AI による要約
大言語モデルに対し「ドア・イン・ザ・フェイス」手法を適用した実験結果を発表した。AnthropicのOpus 5では、大きな要求を拒否した後に小さな要求を受け入れる確率が65.8%に上昇したが、OpenAIやGoogleの最新モデルでは逆に受諾率が低下。要求の関連性が効果の鍵であることを示した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。