トレンド一覧

DeepSeek-v4-Flash-Miniを2bit量子化で軽量実行する検証

r/LocalLLaMA ・ 2026-08-04

原題: DeepSeek-v4-Flash-Mini 54GB GGUF running at ~20.5 t/s

AI による要約

DeepSeek-V4-Flashモデルに対して積極的な量子化手法を適用し、軽量なミニ版GGUFとして動作させた実験の記録です。極端な2bit量子化によりVRAM使用量を大幅に削減しつつ推論を維持しています。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。

インフラ・半導体