トレンド一覧

Vision Transformersの訓練:再帰、ニューラルODE、ディープサーパービジョン

arXiv cs.CV ・ 2026-08-05

原題: Training Crossroads for Recurrent Vision Transformers: Recurrence, Neural ODEs, and Deep Supervision

AI による要約

Vision Transformer (ViT) の再帰的な訓練手法 bViT を CIFAR-100 で評価し、FLOPs 制約下では標準 ViT が優れる一方、パラメータメモリ制約下では再帰が有効な場合があることを確認。ニューラル ODE ソルバーの次数が数値精度と構造的バイアスの双方に影響することも示した。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。

画像・動画生成

この話題に関わるコラム