フィボナッチサンプリングを用いた効率的な時間的VLAモデル
arXiv cs.CV ・ 2026-07-31
原題: FibVLA: An Efficient Temporal Vision-Language-Action Model with Fibonacci Sampling
AI による要約
長期の文脈履歴を効率的に処理しつつ物理世界の行動を推論する、新たな時間的視覚言語行動モデル(VLA)FibVLAを提案した。冗長性を最小限に抑えながら長期の時間依存性を捉えることで、エンボイディッドAIの推論効率を向上させる。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。