医療チャットボットの事実誤認を多層裁定で高精度に検出する手法
arXiv cs.CL ・ 2026-09-03
原題: Beyond Majority Vote: Multi-Perspective Adjudication for Medical Hallucination Detection
AI による要約
医療向けチャットボットが生成した長文内の事実誤認を検出するため単一アノテーションを超えた多視点裁定フレームワークが構築された。人間の初期アノテーションとLLM-as-a-Judgeによる候補抽出に加え医療専門家とエビデンスに基づく2種類の裁定を組み合わせている。実験では初期アノテーターやLLM単体では見落とされる微妙な誤りが多数特定され、複数視点での事実確認の必要性が実証された。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。