KVキャッシュ量子化ベンチマーク:Qwen 3.6 27BとGemma 4 31Bで413通りを検証
r/LocalLLaMA ・ 2026-08-06
原題: KV cache quantization benchmarks: 413 pairs tested on Qwen 3.6 27B, Gemma 4 31B. KLD with BeeLlama.cpp v0.4.0: KVarN 6-bit beats q8_0, precision tail 1024 dominates
AI による要約
Qwen 3.6 27BとGemma 4 31Bを対象に、KVキャッシュ量子化の413通りのベンチマークを実施した。BeeLlama.cpp v0.4.0を用い、KVarN 6-bitがq8_0を上回る精度を示した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。