UniJEPA:タスク非依存ビジュアルワールドモデリングのための統一ジョイント埋め込み予測アーキテクチャ
arXiv cs.CV ・ 2026-08-07
原題: UniJEPA: A Unified Joint-Embedding Predictive Architecture for Task-Agnostic Visual World Modeling
AI による要約
UniJEPA は、タスク非依存ビジュアルワールドモデリングのための統一ジョイント埋め込み予測アーキテクチャである。UniJEPA は、画像レベルとビデオレベルのワールドモデリングを統一的に学習する。単一のエンコーダー、予測器、反収束正則化器を使用する。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。