離散拡散モデルを用いた大規模言語モデルのロスレス高速化手法
arXiv cs.LG ・ 2026-09-03
原題: Unlocking Lossless Speedups in LLMs via Discrete Diffusion
AI による要約
自己回帰型の大規模言語モデル(LLM)の逐次生成ボトルネックを解消するため、標準的な次トークン予測と同時に複数トークンを並列生成する拡散拡張LLMを提案している。訓練済みパイプラインへの負荷を抑えつつロスレスな高速化と推論時スケーリングを可能にする。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.LG)をご確認ください。