LLMの推論崩壊を克服する正解回復手法を提案
arXiv cs.AI ・ 2026-08-31
原題: Wrong Prediction, Right Answer: Recovering Evidence from Collapsed LLM Sequence Scores
AI による要約
LLMが推論タスクに失敗しても、内部状態から正解を復元できる可能性を示す。Qwen3.5モデルで隠れ状態プローブを用いると、シーケンススコアが崩壊しても正解を9〜34ポイント回復できる。OLMo-2-1BやLlama-3.1-8Bでも同様の効果を確認した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。