トレンド一覧

複数翻訳を同時に評価し人手評価のコストと騒音を削減するcESA

arXiv cs.CL ・ 2026-07-29

原題: Contrastive ESA: Human Evaluation of Multiple Translations at Once

AI による要約

従来の単一出力を個別に評価する機械翻訳の人手評価手順を改め、複数の翻訳候補を同時に比較評価する新プロトコル「cESA」が提案されました。英日翻訳の12モデルを用いた大規模実験により、評価時間の短縮とアノテーションのばらつき低減を実現しながら絶対評価値を取得できることが実証されました。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。

LLM・基盤モデル / 研究・論文