トレンド一覧

自己改善エージェントの脆弱性:評価のばらつきとタスク順序の影響

arXiv cs.AI ・ 2026-08-18

原題: On the Fragility of Self-Improving Agents: Variance, Task Order, and Underspecification

AI による要約

メモリベースの自己改善エージェントがタスク順序や実行回数によって成績が大きく変動する脆弱性を指摘する。複雑な環境下でノイズが増幅され、タスク順序によって改善効果が左右されることを実験で示した。既存手法の信頼性に関する包括的な再評価を行う。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。

AIエージェント

この話題に関わるコラム