ラテントダイナミクス推論を用いたビデオワールドモデルの学習
arXiv cs.CV ・ 2026-08-10
原題: Learning How the World Evolves: Extrapolative Video World Models via Latent Dynamics Reasoning
AI による要約
従来のビデオディフュージョンモデルは、ピクセルの変化を捉えていなかった。ラテントダイナミクス推論を用いた新しいアプローチが提案され、ピクセルの変化をより正確に捉えることが可能になった。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。