トレンド一覧

Qwen3.8-Flash-Nextで専門家キャッシュによりデコード速度25-29 t/sに向上

r/LocalLLaMA ・ 2026-09-03

原題: Qwen3.8-Flash-Next on 2x3090 + DDR4: 17 → 25-29 t/s decode with the expert cache PR

AI による要約

Qwen3.8-Flash-Nextモデルで、専門家キャッシュを導入した結果、デコード速度が17 t/sから25-29 t/sに向上した。2x RTX 3090 + DDR4環境で測定され、コーディングタスクで効果を確認した。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。

この話題に関わるコラム