トレンド一覧

Can AI agents conduct open-ended AI research? Early evidence from two case studies

arXiv cs.AI ・ 2026-07-29

AI による要約

フロンティアAIエージェントがオープンエンドなAI研究をどの程度自動化できるかを測定する新しい評価手法「シャドウ評価」が提案された。未発表の査読論文の中核的な研究課題をエージェントに解かせたところ、エンジニアリングは完遂したものの、論文の核心的な進展には至らなかった。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。

研究・論文