ContinualSkillBench: LLM エージェントの継続的スキル学習
arXiv cs.AI ・ 2026-08-04
原題: ContinualSkillBench: Can LLM Agents Truly Evolve Their Capabilities?
AI による要約
LLMエージェントの継続的スキル学習を評価する「ContinualSkillBench」を新たに提案し、5つの分野で100のサブタスクを順次実行する動的評価フレームワークを開発。シーケンシャル実行により性能向上が見られるが、モデルや分野によってばらつきがあることを確認した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。