MODUS: Decoder-Only Any-to-Any Modeling of Diverse Modalities
arXiv cs.AI ・ 2026-07-28
AI による要約
任意のモダリティを入力および出力として相互変換できるDecoder-only型のマルチモーダルモデル「Modus」を提案した論文。モダリティ固有の追加ヘッドや特別損失関数を必要とせず、単一ネットワーク内で対等に複数モダリティを処理し、連鎖生成やクロスモーダル変換を可能にした。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。