D-Score: A Spectral Hidden-State Signal for Hallucination Detection in Large Language Models
arXiv cs.CL ・ 2026-07-27
AI による要約
大規模言語モデルのハルシネーション(幻覚)を検出するための新しい隠れ状態シグナル「D-Score」を提案した研究。単一のフォワードパスから計算されるスペクトル統計量を用いて、モデルが内部状態と矛盾するテキストを生成しているかを判定する。LLMの信頼性向上や安全性確保において重要なアプローチとなる。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。