Vision Transformersの訓練:再帰、ニューラルODE、ディープサーパービジョン
arXiv cs.CV ・ 2026-08-05
原題: Training Crossroads for Recurrent Vision Transformers: Recurrence, Neural ODEs, and Deep Supervision
AI による要約
Vision Transformers(ViTs)が画像認識タスクで高い性能を示すことが知られているが、パラメータ数が線形に増加する問題がある。この研究では、再帰的なViTsの訓練方法を提案し、従来の手法と比較した。結果は、再帰的なアプローチが有効であることを示している。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。