主要LLMによる科学論文の査読は人間の専門家による評価とどこまで一致するのか
arXiv cs.CL ・ 2026-08-04
原題: How Closely Do LLM Reviews Align with Human Peer Review?
AI による要約
OpenAIのGPT-5.4、GoogleのGemini 3.1 Pro Preview、AnthropicのClaude Opus 4.6が、ICLR 2026に投稿された300本の論文を対象に、人間の査読者と同じ基準で自動査読を実施した。各モデルは採択・ポスター・却下の判定カテゴリーごとに、人間のレビューとの一致度を分析した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。