トレンド一覧

WebGPUカーネルでMuse Glimmer 30Bをブラウザ内で実行

r/LocalLLaMA ・ 2026-08-11

原題: Muse Glimmer 30B running locally in-browser with custom WebGPU kernels at ~25 tok/s on an M4 Max (same speed as llama.cpp)

AI による要約

Muse Glimmer 30BをWebGPUカーネルでブラウザ内実行し、M4 Maxで約25tok/sの推論速度を達成した。llama.cppと同等の速度で、ローカルLLMの新たな実行環境を示す。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。

この話題に関わるコラム