ACRL:訓練-推論エンジン乖離の適応制御でFP8量子化下のRL学習を安定化
LLMの強化学習における訓練と推論エンジンの乖離が引き起こす学習崩壊を防ぐため、Huaweiが新手法「ACRL」を提案しました。FP8量子化下でもBF16基線を上回る精度をわずかなオーバーヘッドで達成し、学習の安定化に寄与します。
Zenn LLM ・ 2026-07-30
Huawei に関する AI ニュースを新しい順に 3 件。3 時間おきに自動収集し、AI が要約しています。
LLMの強化学習における訓練と推論エンジンの乖離が引き起こす学習崩壊を防ぐため、Huaweiが新手法「ACRL」を提案しました。FP8量子化下でもBF16基線を上回る精度をわずかなオーバーヘッドで達成し、学習の安定化に寄与します。
Zenn LLM ・ 2026-07-30
Moonshot AIの新型モデル「Kimi K3」が、アリババクラウドおよびHuawei AscendからのDay 0サポートを獲得しました。主要なクラウド・ハードウェアエコシステムとの迅速な統合が進むことで、同社モデルの普及と実用性が高まります。
Google News (中国AI企業) ・ 2026-07-29
アリババとファーウェイが、中国のAIモデル「Kimi K3」に対する自社サーバーインフラの対応を発表しました。中国国内のハードウェアとソフトウエアの連携を強めることで、自国主導の計算基盤とAIエコシステムの強化を図る狙いがあります。
Google News (中国AI企業) ・ 2026-07-28