トレンド一覧

16基のGB10クラスターで動作するKimi K3フルモデルの検証

r/LocalLLaMA ・ 2026-08-04

原題: Kimi K3 full model running on 16x GB10 cluster at 20+tps

AI による要約

NVIDIAのGB10クラスター上で、Kimi K3のフルモデルが平均20+ tpsの速度で動作したことが報告されました。大規模なハードウェア環境を用いた最先端LLMのローカル実行と最適化の事例を示しています。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。

インフラ・半導体 / LLM・基盤モデル

この話題のこれまで

中国のAIモデル「Kimi K3」の開発でNVIDIAの輸出規制対象の半導体が使用された可能性が報じられた。中国のDFSXがNVIDIAのGB200を上回るメモリ帯域幅を持つハードウェアを発表した。中国製AI「Kimi K3」が米国の主要モデルに匹敵する性能を示している一方、エヌビディア製半導体の不正利用に関する指摘も浮上している。NVIDIAのNemotronLabsによる全二重音声チャットモデルがHugging Faceで公開され、NVIDIAが米国科学財団の地域AIハブプログラムに参加することを発表した。Nvidiaが主導するOpen Secure AI AllianceがAIエージェントに対する防御策の提案を出している。NVIDIAのGB10クラスターでKimi K3のフルモデルが平均20+ tpsの速度で動作したことが報告された。

  1. 中国AI「Kimi K3」の開発でNVIDIAの禁輸半導体が使用された疑い 2026-07-30 ・ Google News (中国のAI)
  2. NVIDIAのGB200を超えるメモリ帯域幅を持つ中国DFSX 2026-08-02 ・ r/LocalLLaMA
  3. 中国製AI「Kimi K3」が米大手に迫る性能を見せるも半導体不正利用の指摘も 2026-08-03 ・ Google News (中国のAI)
  4. NVIDIA-NemotronLabs-VoiceChat-11BモデルがHugging Faceに登場 2026-08-03 ・ r/LocalLLaMA
  5. NVIDIAがNSFの地域AIハブプログラムに参加し研究基盤拡大へ 2026-08-04 ・ NVIDIA Blog
  6. Nvidiaが主導するOpen Secure AI Allianceの進展 2026-08-04 ・ TechCrunch AI

当サイトが集めた記事から、同じ話題のものを古い順に並べています。