トレンド一覧

ThinkStation PGXでGPUクロックが固定され推論速度が半減したトラブルと対処

Zenn LLM ・ 2026-08-06

原題: ThinkStationPGX(DGX Spark OEM)のGPUクロックが702MHzに張り付き、LLM推論速度が半減した話

AI による要約

ThinkStation PGXでvLLMを用いてgpt-oss-120bを動かしていたところ、GPUのSMクロックが702MHzに固定され推論速度が半減した。電源ケーブルを抜いて放置することで回復したと報告されている。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(Zenn LLM)をご確認ください。

インフラ・半導体 / 開発ツール

この話題のこれまで

IntelのコンシューマープラットフォームがマルチGPUのAI推論に適さない理由が検証され、ローカルLLM向けハードウェア選びでは容量や帯域の重要性が指摘された。その後、NvidiaのGeForce RTX GPUの値上げが見込まれ、推論高速化技術の組み合わせに注意が必要なバグも報告された。DeepSeek V4 Flashの最適化により長文処理が高速化され、vLLMを用いた複数GPU環境での稼働も成功したが、ThinkStation PGXでSMクロック固定により推論速度が半減するトラブルが発生した。

  1. マルチGPU構築にIntel製コンシューマー向けプラットフォームを使うべき理由 2026-07-25 ・ r/LocalLLaMA
  2. ローカルLLM向けハードウェアを「容量・帯域・MoE・TTFT」で選ぶ 2026-07-26 ・ Zenn LLM
  3. NvidiaのGeForce RTX GPUが最大30%値上げされる見通し 2026-07-29 ・ r/LocalLLaMA
  4. speculative decoding×prefix cachingの罠:組み合わせで遅くなるケース 2026-08-02 ・ Zenn LLM
  5. DeepSeek V4 Flashの最適化により長文プロンプトのプリフィル処理が大幅に高速化 2026-08-04 ・ r/LocalLLaMA
  6. vLLMを用いて複数GPU環境でDeepSeek-V4-Flashを稼働させる構成 2026-08-05 ・ r/LocalLLaMA

当サイトが集めた記事から、同じ話題のものを古い順に並べています。

この話題に関わるコラム