トレンド一覧

大言語モデルの拒否行動に対するドア・イン・ザ・フェイス手法の効果

arXiv cs.AI ・ 2026-09-02

原題: Door-in-the-Face Requests and Refusal Behaviour in Large Language Models

AI による要約

大言語モデルに対し「ドア・イン・ザ・フェイス」手法を適用した実験結果を発表した。AnthropicのOpus 5では、大きな要求を拒否した後に小さな要求を受け入れる確率が65.8%に上昇したが、OpenAIやGoogleの最新モデルでは逆に受諾率が低下。要求の関連性が効果の鍵であることを示した。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。

研究・論文

この話題に関わるコラム