視覚言語モデルに潜む動的制御可能なバックドア攻撃手法
arXiv cs.CV ・ 2026-08-11
原題: Once Poisoned, Arbitrarily Controlled: A Programmable Backdoor in VLMs
AI による要約
視覚言語モデル(VLM)において、推論時に攻撃者が任意のターゲットキャプションとトリガーを生成できる制御可能なバックドア手法を実証した。単一の毒化プロセスによりモデルへ命令としてのトリガー構造を埋め込むことで、モデルの再学習なしに動的な標的制御を可能にする。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。