トレンド一覧

連続制御のためのプレフィックス最適動的拡散ポリシー

arXiv cs.LG ・ 2026-08-05

原題: Learning When to Stop: Prefix-Optimal Dynamic Diffusion Policies for Continuous Control

AI による要約

連続制御のためのPOGP(Prefix-Optimal Generative Policies)を発表した。拡散ポリシーのステップ数を最適化し、MuJoCo環境で12のベースラインを上回る効率を達成した。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.LG)をご確認ください。

研究・論文

この話題に関わるコラム