実行フィードバックを用いたスキル最適化手法 WER を提案
arXiv cs.CL ・ 2026-08-18
原題: Write, Execute, Refine: From Skill Followers to Skill Optimizers via Reinforcement Learning from Execution Feedback
AI による要約
エージェントが実行フィードバックからスキルを最適化する手法「WER(Write, Execute, Refine)」を開発した。スキル作成・実行・検証のサイクルを通じて、失敗と成功の軌道を比較し、スキルの質を向上させる。エージェント作成のスキルが専門家作成を上回る可能性を示した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。