トレンド一覧

国家主導の情報操作に対抗するフロンティアLLMの安全評価ベンチマーク

arXiv cs.AI ・ 2026-07-30

原題: InfoOps Bench: A live information operations safety benchmark

AI による要約

国家主導の情報操作に対する大規模言語モデル(LLM)の安全性を測定するリアルタイムベンチマーク「InfoOps Bench」が公開された。17のモデルを評価した結果、拒絶率に大きな隔たりがあり、多くのモデルが情報操作に悪用されるリスクが浮き彫りとなった。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。

LLM・基盤モデル / 規制・倫理