トレンド一覧

AngelSpec: Towards Real-World High Performance Inference with Speculative Decoding

arXiv cs.CL ・ 2026-07-28

AI による要約

大規模言語モデルの推論を高速化する投機的解読(Speculative Decoding)に向けた統合訓練フレームワーク「AngelSpec」を発表した論文。マルチトークン予測(MTP)とブロック並列拡散モデルという異なる構造を、対話やコードなどのタスク特性に応じて最適化・使い分けることで実用的な推論速度向上を実現する。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。

LLM・基盤モデル / インフラ・半導体