Aggregate-then-Calibrate: 人間中心の評価のための理論的保証
arXiv cs.LG ・ 2026-08-03
原題: Aggregate-then-Calibrate for Human-centered Assessment with Theoretical Guarantees
AI による要約
人間中心の評価タスクは、人間の判断に大きく依存しており、通常、検証可能な基準が不足している。既存のアプローチは、人間の判断のみを使用する方法と、モデル生成スコアのみを使用する方法の2つのアプローチのどちらかを取る必要がある。Aggregate-then-Calibrate(AtC)は、人間の比較判断を集約してランキングを作成し、モデル生成スコアを順序一貫性を保ちながら調整する2段階のフレームワークである。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.LG)をご確認ください。