Qwen 3.6 27BでデュアルRTX 3090の処理速度を4倍に向上
r/LocalLLaMA ・ 2026-08-06
原題: Dual 3090 setup: 400 pp t/s to 1600 pp t/s on Qwen 3.6 27B... with slightly lower tps.
AI による要約
デュアルRTX 3090環境でQwen 3.6 27Bモデルの処理速度を400pp t/sから1600pp t/sに向上させた。当初はllama.cppのtensor分割モードで動作していたが、メモリ不足によりプロンプト処理がCPUで行われていたため、パラメータの適合に失敗していた。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。