トレンド一覧

内部活性化の監視がLLMエージェントの評価意識とマルチエージェント行動に与える影響

arXiv cs.MA ・ 2026-09-02

原題: You Can't Escape Your Own Activations : Evaluation Awareness and Multi-Agent Monitoring

AI による要約

マルチエージェントシステムにおいて、出力監視や内部活性化プローブによる結託検出が、監視の有無をエージェント自身が知らされた際にどう変化するかを検証した。ブラックジャックやシモンの囚人のジレンマゲームを用いて、エージェントへの情報提示の差がもたらす影響を分析している。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.MA)をご確認ください。

研究・論文 / AIエージェント / 規制・倫理

この話題に関わるコラム