トレンド一覧

Skill-Use: LLMがスキルを使用できるか

arXiv cs.CL ・ 2026-08-05

原題: Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?

AI による要約

LLMエージェントがスキル(構造化文書)を自ら認識して実行する能力を評価するベンチマーク「Skill-Use」を開発し、スキルの呼び出し・手順遵守・禁止操作回避の3要素を測定する。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。

LLM・基盤モデル

この話題に関わるコラム