Gemma 4 12Bでテンソル単位の量子化配分によりコーディング性能が8.55%向上
r/LocalLLaMA ・ 2026-08-13
原題: Gemma 4 12B Q3: +8.55% Coding Performance From Tensor-Level Quantization Allocation
AI による要約
特定タスクにおける量子化の精度劣化を抑えるため、テンソル単位でビット予算を最適配分する手法が検証された。Gemma 4 12BのQ3量子化モデルにおいて、モデルサイズを+0.119%にとどめたままベンチマークスコアが45.974から49.905へと8.55%向上した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。