連続制御のためのプレフィックス最適動的拡散ポリシー
arXiv cs.LG ・ 2026-08-05
原題: Learning When to Stop: Prefix-Optimal Dynamic Diffusion Policies for Continuous Control
AI による要約
連続制御のためのPOGP(Prefix-Optimal Generative Policies)を発表した。拡散ポリシーのステップ数を最適化し、MuJoCo環境で12のベースラインを上回る効率を達成した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.LG)をご確認ください。