国家主導の情報操作に対抗するフロンティアLLMの安全評価ベンチマーク
arXiv cs.AI ・ 2026-07-30
原題: InfoOps Bench: A live information operations safety benchmark
AI による要約
国家主導の情報操作に対する大規模言語モデル(LLM)の安全性を測定するリアルタイムベンチマーク「InfoOps Bench」が公開された。17のモデルを評価した結果、拒絶率に大きな隔たりがあり、多くのモデルが情報操作に悪用されるリスクが浮き彫りとなった。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。