トレンド一覧

LLMの推論崩壊を克服する正解回復手法を提案

arXiv cs.AI ・ 2026-08-31

原題: Wrong Prediction, Right Answer: Recovering Evidence from Collapsed LLM Sequence Scores

AI による要約

LLMが推論タスクに失敗しても、内部状態から正解を復元できる可能性を示す。Qwen3.5モデルで隠れ状態プローブを用いると、シーケンススコアが崩壊しても正解を9〜34ポイント回復できる。OLMo-2-1BやLlama-3.1-8Bでも同様の効果を確認した。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。

研究・論文

この話題に関わるコラム