内部活性化の監視がLLMエージェントの評価意識とマルチエージェント行動に与える影響
arXiv cs.MA ・ 2026-09-02
原題: You Can't Escape Your Own Activations : Evaluation Awareness and Multi-Agent Monitoring
AI による要約
マルチエージェントシステムにおいて、出力監視や内部活性化プローブによる結託検出が、監視の有無をエージェント自身が知らされた際にどう変化するかを検証した。ブラックジャックやシモンの囚人のジレンマゲームを用いて、エージェントへの情報提示の差がもたらす影響を分析している。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.MA)をご確認ください。