Qwen3.8-Flash-Nextで専門家キャッシュによりデコード速度25-29 t/sに向上
r/LocalLLaMA ・ 2026-09-03
原題: Qwen3.8-Flash-Next on 2x3090 + DDR4: 17 → 25-29 t/s decode with the expert cache PR
AI による要約
Qwen3.8-Flash-Nextモデルで、専門家キャッシュを導入した結果、デコード速度が17 t/sから25-29 t/sに向上した。2x RTX 3090 + DDR4環境で測定され、コーディングタスクで効果を確認した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。