トレンド一覧

DGX Spark上でローカル動作するLing-3.0-flash MXFP4の公開

r/LocalLLaMA ・ 2026-08-05

原題: Ling-3.0-flash MXFP4 released and running locally on one DGX Spark.

AI による要約

Ling-3.0-flash MXFP4がリリースされ、単一のDGX Spark上でローカル推論が実行可能になった。高速なデコードとプリフィル性能を示し、複数の同時ユーザーによるプライベートな環境での利用を実現している。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。

LLM・基盤モデル

この話題のこれまで

LongCat-Flash-Lite-Sparseの重みが公開され、ローカル実行の選択肢拡大に貢献した。次に、Qwen3.8-27Bがローカル環境での動作が期待できるサイズとして登場した。DeepSeek-V4-Flash-0731が自宅PCで稼働し、ローカル環境での大規模モデル実行の進展を示した。さらに、Qwenシリーズの新たなパラメータサイズのモデルが公開予定であることが示唆され、Mach-1 AdditiveがQwen 3.6 35B並みの性能を10分の1のサイズで実現することが話題となった。クローズド環境向けローカルLLMの選定に関する実測比較も行われた。最後に、Ling-3.0-flash MXFP4がリリースされ、単一のDGX Spark上でローカル推論が実行可能になった。

  1. 1Mコンテキスト対応のLongCat-Flash-Lite-Sparse重みが公開 2026-08-01 ・ r/LocalLLaMA
  2. ローカル環境で期待を集める新型Qwen3.8-27B 2026-08-03 ・ r/LocalLLaMA
  3. フロンティアモデルDeepSeek-V4-Flash-0731が自宅PCで稼働 2026-08-03 ・ r/LocalLLaMA
  4. Qwenモデルの新たなパラメータサイズ版が近く登場へ 2026-08-04 ・ r/LocalLLaMA
  5. Qwen 3.6 35B並みの性能を10分の1のサイズで実現するMach-1 Additive 2026-08-04 ・ r/LocalLLaMA
  6. クローズド環境向けローカルLLMの選定、M2 Ultraでの4モデル実測比較 2026-08-05 ・ Zenn LLM

当サイトが集めた記事から、同じ話題のものを古い順に並べています。