トレンド一覧

MulRobBench: A Decision-Level Benchmark for Safe and Security-Policy-Compliant Multimodal UAV Agents

arXiv cs.MA ・ 2026-07-26

AI による要約

ドローンなどのマルチモーダルVLAエージェントが、安全規則やセキュリティポリシーに適合した意思決定を行えるかを評価するベンチマーク「MulRobBench」が提案された。実環境のプロトコル遵守やリスク判断能力を定量評価できる枠組みを提供し、安全な自律飛行エージェントの開発を支援する。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.MA)をご確認ください。

AIエージェント / 研究・論文