トレンド一覧

NVIDIA の AI ニュース

NVIDIA に関する AI ニュースを新しい順に 130 件。3 時間おきに自動収集し、AI が要約しています。

RTX 5090でのQwen3.8-27B推論:NInfer・llama.cpp・vLLMを比較

単一のRTX 5090環境において、Qwen3.8-27B(NVFP4)を用いたllama.cpp、vLLM、NInferの推論速度と出力品質を比較検証した。並行リクエスト処理の必要性から、KVキャッシュの量子化設定や最大コンテキスト長を含めた客観的な評価を行っている。

r/LocalLLaMA ・ 2026-09-05

RTX 3090環境でQwen3.8-Flash-Nextを動かす最適な設定を検証

NVIDIA RTX 3090の24GB VRAMと128GBのDDR4 RAMを搭載した単一のPC環境において、Qwen3.8-Flash-NextのGGUFモデルをllama.cppのサーバー機能で動作させる検証が行われた。全レイヤーをGPUにオフロードしつつ、MoEレイヤーの一部をCPUとRAM側に保持する構成でテストされている。

r/LocalLLaMA ・ 2026-09-05

Hugging Faceからモデルダウンロードが困難化、P2P配布を求める声

ユーザーはHugging Faceからのモデルダウンロード速度が不安定で、1Gbpsの接続でも700kb/sから98Mb/sまで激しく変動し、しばしば3Mb/s以下に低下。NVIDIAによる買収後もインフラが対応できず、大規模なモデルリリース時に大規模なダウンロード混雑が懸念される。ユーザーはP2P配布の導入を求めている。

r/LocalLLaMA ・ 2026-09-04

Amazon SageMaker HyperPodでのNVIDIA Cosmos 3モデルファクトリー構築手法

Amazon EKS上のAmazon SageMaker HyperPodクラスターで、NVIDIA Cosmos 3を用いた物理AIシステムの継続的パイプラインを構築する手法が解説されている。合成データ生成や事後学習、クローズドループ評価をGPUスループットを指標として実行する。

AWS Machine Learning Blog ・ 2026-09-04

ハードウェアを意識したFP4 FlashAttention-4

Blackwellの4ビット浮動小数点(FP4)テンソルコアに対応する非因果的推論向けの「Direct-P」と因果的パスを開発した。Direct-PによりNVIDIA GB200上でbfloat16の最大2.13倍のスループットを達成し、80億パラメータモデルの単一GPU学習を最大1.14倍に高速化した。

arXiv cs.LG ・ 2026-09-03

NVIDIAがIFA 2026でローカルAIの加速を発表

NVIDIAはIFA 2026で、Microsoftと提携しローカルAIの推論高速化とエージェント実行を支援する新ツールを発表した。NVIDIA RTX Spark Windows PCも10月に発売され、ローカルAIの普及を加速させる。

NVIDIA Blog ・ 2026-09-03

NVIDIA DLSS 5搭載でNBA 2K27がGeForce NOWに登場

NVIDIAが、DLSS 5の3Dガイド型ニューラルレンダリング機能を搭載した「NBA 2K27」を含む28タイトルをGeForce NOWに追加すると発表した。同機能により、コート上の光や素材のリアリズムが向上する。

NVIDIA Blog ・ 2026-09-03

NVIDIA Nemotron 3.5 LightningがAmazon SageMaker JumpStartで利用可能に

NVIDIA Nemotron 3.5 LightningがAmazon SageMaker JumpStartで利用可能になった。30BのMixture-of-Expertsモデル(3Bアクティブ)で、エージェント向けワークロードで最大4倍のスループットと30%のタスク完了時間短縮を実現する。

AWS Machine Learning Blog ・ 2026-08-17

AnthropicのIPO

Anthropicの2兆ドルIPOやザッカーバーグのAIマニフェスト、NVIDIAの5000億ドルのAI賭け、Grokの復活について紹介しています。

Google News (Anthropic) ・ 2026-08-14

GeForce NOW、LinuxやChromebookに対応

GeForce NOWは、LinuxやChromebookに対応したクラウドゲームサービスを提供している。新しい最適化により、フレーム生成がよりレスポンシブになる。

NVIDIA Blog ・ 2026-08-13

NVIDIA、30Bのオープンモデル「Nemotron 3.5 Lightning」を公開

NVIDIAは30Bのオープンモデル「Nemotron 3.5 Lightning」を公開した。このモデルは「OpenClaw」など常時稼働エージェント向けに設計されており、「gpt-oss-120b」同等の性能を約4分の1の規模で実現するという。

ITmedia AI+ ・ 2026-08-12

NVIDIA AI Factoryのコンピューティングが投資可能な資産クラスになる

NVIDIA AI Factoryのコンピューティングが投資可能な資産クラスになることが発表された。NVIDIAはApollo、BlackRock、Blackstone、Brookfield、Goldman Sachs、KKRとのパートナーシップを通じて、AIインフラストラクチャーの構築を支援するための独立した資金調達プラットフォームを設立する。

NVIDIA Blog ・ 2026-08-12

24GB GPUで30B・256Kコンテキスト・Visionモデルの動作検証に成功

単一の24GB GPU上で、30B規模のDenseモデル、256Kトークンのコンテキスト窓、画像認識機能を同時に動作させる実証実験が行われた。MetaのMuse Glimmer 30BやDFlashドラフター等を組み合わせ、単一指標の最大化ではなくシステム全体の実行性能を最適化させている。

Zenn LLM ・ 2026-08-11

Intel N100とRTX 5060Ti

Intel N100とRTX 5060Tiを使用して、低電力のllama.cppサーバーを構築する。DockerとOpenVINOを使用して、メディアライブラリの処理を高速化する。

r/LocalLLaMA ・ 2026-08-11

NVIDIA、Nemotron 3.5 Lightningを発表

NVIDIAがNemotron 3.5 Lightningを発表した。最高効率のモデルで、長時間のAgentic AIワークロードに適している。

NVIDIA Blog ・ 2026-08-11