トレンド一覧

xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding

arXiv cs.AI ・ 2026-08-03

AI による要約

推測デコーディングにおいて拡散ベースのドラフターが持つ因果関係の欠如を修復し、早期リジェクトを減らす並列リファインメント手法 xPressを提案した研究。独立にサンプリングされた周辺確率分布から生成されるトークンの整合性を高め、推論時の生成効率と受容長を改善する。LLMの高速化技術において重要な改善をもたらす。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。

LLM・基盤モデル / 研究・論文