自己教師あり時間的セルフディスティレーションによる動画内の視覚的状態追跡
arXiv cs.CV ・ 2026-09-03
原題: Temporal Self-Distillation: Learning Visual State Tracking in Videos Without Supervision
AI による要約
ラベルや報酬信号を一切使用せず、動画の状態追跡を自己教師あり学習で行うフレームワーク「S$^3$T」を提案した。時間的サンプリング密度の高い教師ビューの次トークン分布を、疎なビューの学生モデルが模倣することで、推論コストを追加せずに精度を向上させた。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。