トレンド一覧

Qwen3.8-27Bの推論速度をRTX 3090で138 tpsに向上

r/LocalLLaMA ・ 2026-08-19

原題: I pushed Qwen3.8-27B limits again... Dflash2 - 134 tps on a RTX 3090

AI による要約

Qwen3.8-27Bの推論エンジンを最適化し、RTX 3090で138 tpsを達成した。同時処理時は942 tpsを記録し、長文チャットの応答時間も1秒に短縮した。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。

開発ツール

この話題に関わるコラム