RTX 5090でのQwen3.8-27B推論:NInfer・llama.cpp・vLLMを比較
単一のRTX 5090環境において、Qwen3.8-27B(NVFP4)を用いたllama.cpp、vLLM、NInferの推論速度と出力品質を比較検証した。並行リクエスト処理の必要性から、KVキャッシュの量子化設定や最大コンテキスト長を含めた客観的な評価を行っている。
r/LocalLLaMA ・ 2026-09-05
NVIDIA に関する AI ニュースを新しい順に 130 件。3 時間おきに自動収集し、AI が要約しています。
単一のRTX 5090環境において、Qwen3.8-27B(NVFP4)を用いたllama.cpp、vLLM、NInferの推論速度と出力品質を比較検証した。並行リクエスト処理の必要性から、KVキャッシュの量子化設定や最大コンテキスト長を含めた客観的な評価を行っている。
r/LocalLLaMA ・ 2026-09-05
NVIDIA RTX 3090の24GB VRAMと128GBのDDR4 RAMを搭載した単一のPC環境において、Qwen3.8-Flash-NextのGGUFモデルをllama.cppのサーバー機能で動作させる検証が行われた。全レイヤーをGPUにオフロードしつつ、MoEレイヤーの一部をCPUとRAM側に保持する構成でテストされている。
r/LocalLLaMA ・ 2026-09-05
ユーザーはHugging Faceからのモデルダウンロード速度が不安定で、1Gbpsの接続でも700kb/sから98Mb/sまで激しく変動し、しばしば3Mb/s以下に低下。NVIDIAによる買収後もインフラが対応できず、大規模なモデルリリース時に大規模なダウンロード混雑が懸念される。ユーザーはP2P配布の導入を求めている。
r/LocalLLaMA ・ 2026-09-04
エヌビディアが、ミラ・ムラティ氏が立ち上げたAIスタートアップ企業に対して25億ドルの出資を行う方向で交渉を進めている。AI業界における大型出資案件として注目されている。
Google News (AIスタートアップ) ・ 2026-09-04
Amazon EKS上のAmazon SageMaker HyperPodクラスターで、NVIDIA Cosmos 3を用いた物理AIシステムの継続的パイプラインを構築する手法が解説されている。合成データ生成や事後学習、クローズドループ評価をGPUスループットを指標として実行する。
AWS Machine Learning Blog ・ 2026-09-04
NVIDIA製AIチップの中国市場への導入が制限される中、DeepSeekが華為技術(Huawei)製のAIチップ16万個の調達に動いた。米国の輸出規制に対応する形で調達先を切り替えている。
Google News (中国AI企業) ・ 2026-09-04
NVIDIAのCMP 170HX(GA100マイニングカード)にコミュニティ製パッチドライバを適用し、VRAMを8GBから64GBに拡張。ローカルLLM用途での長時間負荷試験で、常用可能性を検証。価格と性能のバランスを評価。
Zenn LLM ・ 2026-09-04
エヌビディアによるHugging Faceの2兆円規模の買収劇について、その背後にいる創業者の素顔にウォール・ストリート・ジャーナルが迫っている。
Google News (AIスタートアップ) ・ 2026-09-04
NVIDIAがAI新興企業を約2兆円で買収した。中国勢とのAI競争が激化する中、大型買収で技術獲得を加速させる。買収額は約2兆円に上る見込みだ。
Google News (中国のAI) ・ 2026-09-03
Blackwellの4ビット浮動小数点(FP4)テンソルコアに対応する非因果的推論向けの「Direct-P」と因果的パスを開発した。Direct-PによりNVIDIA GB200上でbfloat16の最大2.13倍のスループットを達成し、80億パラメータモデルの単一GPU学習を最大1.14倍に高速化した。
arXiv cs.LG ・ 2026-09-03
NVIDIAはIFA 2026で、Microsoftと提携しローカルAIの推論高速化とエージェント実行を支援する新ツールを発表した。NVIDIA RTX Spark Windows PCも10月に発売され、ローカルAIの普及を加速させる。
NVIDIA Blog ・ 2026-09-03
NVIDIAが、AIモデルのプラットフォーム「Hugging Face」を約129億ドルで買収すると発表した。1800万人以上の開発者と20万社が利用する同プラットフォームを通じ、同社はAIモデルの流通網を掌握する。
The Decoder ・ 2026-09-03
Tesla P40 24GBでQwenを動作させた推論速度を、Tesla V100 PCIe 32GBとNVIDIA CMP 170HXと比較したベンチマーク結果を報告する。Pascal世代のP40はテンソルコア非搭載でFP16性能に制約がある。
Zenn LLM ・ 2026-09-03
NVIDIAが、AI開発プラットフォームを運営するHugging Faceを129億3030万ドルで買収することに合意した。ジェンスン・フアンCEOはオープンモデルの重要性を改めて強調した。
ITmedia AI+ ・ 2026-09-03
NVIDIAが、DLSS 5の3Dガイド型ニューラルレンダリング機能を搭載した「NBA 2K27」を含む28タイトルをGeForce NOWに追加すると発表した。同機能により、コート上の光や素材のリアリズムが向上する。
NVIDIA Blog ・ 2026-09-03
TechCrunch Disrupt 2026に「Real World AI Stage」が新設され、NVIDIAやロボット、絶滅動物をテーマとした展示が行われる。デジタルと物理の融合を扱う場となる。
TechCrunch AI ・ 2026-09-02
エヌビディアとセールスフォースの決算発表がAI半導体市場に与える影響について、野村證券のアナリストが分析した。両社の業績動向が半導体需要やエコシステムの変化を反映しており、業界全体のトレンドを示唆する。
Google News (Salesforce / Agentforce) ・ 2026-09-02
NVIDIAとCrowdStrikeがエージェント型サイバーセキュリティ分野で提携を発表した。CrowdStrike SafeMindと呼ばれる新システムが共同開発され、自動化された防御が可能になる。
NVIDIA Blog ・ 2026-09-01
NVIDIAがMediaTekの転換社債に35億ドルを投資し、AI基盤の協業を拡大する。独自AIチップのラック統合やPC・車載向けチップの共同開発を推進し、NVIDIAは顧客囲い込み、MediaTekは受託設計事業を強化する。
ITmedia AI+ ・ 2026-09-01
AnthropicがLambdaと350億ドル規模のAI計算リソース契約を締結した。LambdaはNVIDIA製GPUを採用したハット8のデータセンターを活用し、最先端モデルの需要増加に対応する。
Google News (Anthropic) ・ 2026-09-01
NVIDIAが台湾の半導体メーカーMediaTekに35億ドルを投資し、AIチップ基盤の構築で提携する。ビッグテックが独自のAIチップを開発する中、NVIDIAの存在感を維持する狙い。
TechCrunch AI ・ 2026-08-31
中国のAIスタートアップ「ディープシーク」の創業者が、NVIDIAを巡る発言を流出させた。NVIDIAの市場支配力に対する批判が中国のAI業界で広がっている。
Google News (中国のAI) ・ 2026-08-19
中国がNVIDIAのH200チップの流入を段階的に解禁し、米国との競争力強化を目指す国内AI企業を支援する。小規模なバッチでチップが流入する状況が続く。
The Decoder ・ 2026-08-19
GoogleとNVIDIAが動画生成AIを活用してロボットの未来を予測する取り組みを発表した。世界モデルを用いることで、日本が技術面で優位に立つ可能性が示された。
Google News (画像・動画生成) ・ 2026-08-17
NVIDIA Nemotron 3.5 LightningがAmazon SageMaker JumpStartで利用可能になった。30BのMixture-of-Expertsモデル(3Bアクティブ)で、エージェント向けワークロードで最大4倍のスループットと30%のタスク完了時間短縮を実現する。
AWS Machine Learning Blog ・ 2026-08-17
米国政府による中国向けAI技術封じ込め政策の有効性や責任を巡る議論が、GPU大手のエヌビディアにも波及している。先端半導体の輸出規制と対中ビジネスのバランスが改めて争点となっている。
Google News (中国のAI) ・ 2026-08-15
RTX 5060 Ti向けローカルLLMリポジトリ「club-5060ti」が刷新された。Qwenなどのモデル向けに動作確認済みのコピー可能な設定プリセットや、高コンテキスト検証用ハーネスが整備されている。
r/LocalLLaMA ・ 2026-08-15
Anthropicの2兆ドルIPOやザッカーバーグのAIマニフェスト、NVIDIAの5000億ドルのAI賭け、Grokの復活について紹介しています。
Google News (Anthropic) ・ 2026-08-14
AI暴走事故を受け、NVIDIAなど米IT大手が「オープン型」のAI防御同盟を結成した。安全性向上に向けた業界横断の取り組みが始動する。
Google News (中国のAI) ・ 2026-08-13
GeForce NOWは、LinuxやChromebookに対応したクラウドゲームサービスを提供している。新しい最適化により、フレーム生成がよりレスポンシブになる。
NVIDIA Blog ・ 2026-08-13
NVIDIAのCEO、Jensen HuangがGlassdoorの2026年ベストCEOに選ばれた。Huangは、99%の従業員から支持を得ている。
NVIDIA Blog ・ 2026-08-12
NVIDIAのBlackwell GPU、RTX PRO 6000の価格が16,000ドルに上昇し、初期価格のほぼ2倍になった。
r/LocalLLaMA ・ 2026-08-12
NVIDIAは30Bのオープンモデル「Nemotron 3.5 Lightning」を公開した。このモデルは「OpenClaw」など常時稼働エージェント向けに設計されており、「gpt-oss-120b」同等の性能を約4分の1の規模で実現するという。
ITmedia AI+ ・ 2026-08-12
NVIDIA AI Factoryのコンピューティングが投資可能な資産クラスになることが発表された。NVIDIAはApollo、BlackRock、Blackstone、Brookfield、Goldman Sachs、KKRとのパートナーシップを通じて、AIインフラストラクチャーの構築を支援するための独立した資金調達プラットフォームを設立する。
NVIDIA Blog ・ 2026-08-12
単一の24GB GPU上で、30B規模のDenseモデル、256Kトークンのコンテキスト窓、画像認識機能を同時に動作させる実証実験が行われた。MetaのMuse Glimmer 30BやDFlashドラフター等を組み合わせ、単一指標の最大化ではなくシステム全体の実行性能を最適化させている。
Zenn LLM ・ 2026-08-11
NVIDIAは、AIコンピューティングの進化に伴って新しいパワー・アーキテクチャの必要性を強調した。AIコンピューティングの進化は、より高性能なインフラストラクチャの必要性を生み出している。
NVIDIA Blog ・ 2026-08-11
Intel N100とRTX 5060Tiを使用して、低電力のllama.cppサーバーを構築する。DockerとOpenVINOを使用して、メディアライブラリの処理を高速化する。
r/LocalLLaMA ・ 2026-08-11
NVIDIAはNemotron-3.5-Lightning-30B-A3B-BF16という大規模言語モデルをHugging Faceで公開した。同モデルは300億パラメータでBF16形式に対応している。
r/LocalLLaMA ・ 2026-08-11
NVIDIAがNemotron 3.5 Lightningを発表した。最高効率のモデルで、長時間のAgentic AIワークロードに適している。
NVIDIA Blog ・ 2026-08-11
NVIDIAがローカルAIコミュニティやパートナー企業と連携し、ローカル環境で動作するオープンモデルやAIエージェントの開発支援を強化している。最新のオープンモデルやソフトウェアツールを提供し、エコシステム拡大を図る。
NVIDIA Blog ・ 2026-08-11