LLMサービスの分解攻撃に対するステートフル防御の限界を理論的に証明
arXiv cs.CL ・ 2026-08-18
原題: Decomposition Attacks Across Unlinkable Identities: Limits of Stateful Defenses for LLM Services
AI による要約
LLMサービスのステートレス防御が分解攻撃に対して脆弱であることを理論的に示す。攻撃者は有害タスクを複数の許容可能なリクエストに分割し、回答を組み合わせることで回避できる。ステートフルなモニタリングが必要だが、攻撃者はリンク不可能なIDを用いて回答を統合するため、防御が困難になることを証明した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。