トレンド一覧

DeepSeek-V4-Flashの重みが商用利用可能に無料公開

Google News (Anthropic) ・ 2026-08-05

原題: 「DeepSeek-V4-Flash」の正式版、重みが商用利用可能で無料公開。量子化版は82.5GBから(生成AIクローズアップ) - テクノエッジ TechnoEdge

AI による要約

DeepSeek-V4-Flashの正式版が公開され、重みが商用利用可能となった。量子化版は82.5GBから提供され、コスト効率の高いAIモデルの普及が期待される。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(Google News (Anthropic))をご確認ください。

LLM・基盤モデル

この話題のこれまで

DeepSeek V4 Flashの量子化モデルが7月に相次いでリリースされ、Unslothによる4ビット・8ビット版やDS4エンジン向けGGUF版、専門家テンソルの再量子化手法が公開された。8月にはMferenceが大規模Mixture of ExpertsモデルをSSDからのストリーミングで動作させる技術を、DGX Spark上での専用エンジンによる推論速度の検証も行われた。Alibabaが最大級AIモデルを発表し価格競争が激化する中、DeepSeekは低価格路線で抗戦を続けている。最終的に、DeepSeek-V4-Flashの重みが商用利用可能な状態で無料公開され、量子化版が82.5GBから提供されることになった。

  1. DeepSeek V4 FlashのUnsloth量子化モデルがリリース 2026-07-31 ・ r/LocalLLaMA
  2. DeepSeek v4 Flash向けのDS4エンジン用GGUFモデルが公開 2026-07-31 ・ r/LocalLLaMA
  3. DeepSeek-V4-Flashの専門家テンソル量子化手法でCPU処理が1.4倍高速化 2026-08-02 ・ r/LocalLLaMA
  4. DeepSeek-V4-Flash 284Bを5.3GBのメモリで動作させる技術 2026-08-02 ・ r/LocalLLaMA
  5. DGX Spark1台でDeepSeek-V4-Flash 0731を専用エンジンにより30〜40tok/sで駆動 2026-08-03 ・ Zenn LLM
  6. Alibabaが最大級AIモデルを発表しDeepSeekは超低価格で抗戦 2026-08-03 ・ Google News (中国AI企業)

当サイトが集めた記事から、同じ話題のものを古い順に並べています。

この話題に関わるコラム