深層強化学習ベースのサイバー防御を破るためのエージェント型LLMレッドチーミングフレームワークTrident
arXiv cs.MA ・ 2026-08-05
原題: Trident : How to Break Deep Reinforcement Learning Cyber Defenses (Agentic)
AI による要約
深層強化学習ベースのサイバー防御を攻撃するためのLLMレッドチーミングフレームワークTridentを開発した。CybORG CAGE 4やCyberWheelを用いた動的ベンチマークと13,000以上の高忠実度相互作用データセットを提供し、Code-as-Policy型のRLVRエージェントを実装した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.MA)をご確認ください。