トレンド一覧

主要LLMによる科学論文の査読は人間の専門家による評価とどこまで一致するのか

arXiv cs.CL ・ 2026-08-04

原題: How Closely Do LLM Reviews Align with Human Peer Review?

AI による要約

OpenAI GPT-5.4、Google Gemini 3.1 Pro Preview、Anthropic Claude Opus 4.6が生成する科学論文の査読を、実際のICLR 2026の投稿論文300件に対する人間の査読および最終決定と比較した。各モデルは採択・不採択の区別や弱点の特定において一定の一致を示し、AIによる査読支援の可能性と特性を明らかにしている。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。

LLM・基盤モデル / ビジネス・資金調達