Skill-Use: LLMがスキルを使用できるか
arXiv cs.CL ・ 2026-08-05
原題: Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?
AI による要約
LLMエージェントがスキル(構造化文書)を自ら認識して実行する能力を評価するベンチマーク「Skill-Use」を開発し、スキルの呼び出し・手順遵守・禁止操作回避の3要素を測定する。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。