因果推論の知識蒸留に向けたCausalOPDフレームワークの提案
arXiv cs.LG ・ 2026-08-04
原題: CausalOPD: First-Wrong-Step Supervision for Distilling Causal Chain Reasoning
AI による要約
因果推論タスク向けに、教師モデルがドメイン固有のルールに基づく軌道を生成し、学生モデルの最初の誤りステップを特定して修正するCausalOPDフレームワークが提案された。プロセスエラーをオンラインで検出し、知識蒸留を効率化する。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.LG)をご確認ください。