トレンド一覧

LLM・基盤モデル の AI ニュース

LLM・基盤モデル に関する AI ニュースを新しい順に 239 件。3 時間おきに自動収集し、AI が要約しています。

Chinese AI startup Kimi K3 sends U.S. chip stocks tumbling - qz.com

中国のAIスタートアップが発表した「Kimi K3」の圧倒的な性能とコスト効率により、米国の半導体関連株が下落する市場反応が起きました。中国製AIモデルの進化が米国のAI・半導体産業の優位性を脅かす可能性を株式市場が強く意識した出来事です。

Google News (中国AI企業) ・ 2026-07-29

中国AI「Kimi K3」の登場で大きく変わる世界のAI勢力図。中島聡が考察、中国発モデルが世界最高水準に迫るワケ - まぐまぐ

中国発の最新AIモデル「Kimi K3」が世界最高水準のAIに迫る性能を示し、グローバルなAI勢力図を塗り替えつつあることが考察されています。米中間のAI覇権争いが激化する中で、中国製モデルの急速な進化と影響力を象徴するニュースです。

Google News (中国のAI) ・ 2026-07-29

米政府の事前評価巡りOpenAIとAnthropic対立 オープンウェイト包括規制に主要各社反対 - CHOSUNBIZ - Chosunbiz

米政府によるAIモデルの事前評価制度を巡りOpenAIとAnthropicが対立する一方、主要AI各社はオープンウェイトモデルへの包括規制に反対姿勢を示しています。AI安全基準の法制化と技術競争力のバランスを巡る政策議論の激化を象徴しています。

Google News (Anthropic) ・ 2026-07-29

Anyone tried the Q1 Kimi K3 yet? (555GB)

RedditのLocalLLaMAコミュニティにて、555GBという超大規模なモデル「Kimi K3」の試用感に関する意見交換が行われた。オープンウェイトおよびローカル環境で超大型モデルを運用する技術者層の関心の高さを示している。

r/LocalLLaMA ・ 2026-07-29

A.X-K2 released

韓国の国家基盤モデルプロジェクトにおいて「A.X-K2」シリーズがリリースされました。政府主導のAIプロジェクトにおける継続的な評価と選定プロセスの一環であり、韓国のソブリンAI開発動向を示しています。

r/LocalLLaMA ・ 2026-07-29

Kimi K3: DeepSeek 2.0, or is this Time Different? - TradingView

中国の新しいAIモデル「Kimi K3」について、DeepSeek 2.0に続くゲームチェンジャーとなるかが分析されています。低コストかつ高性能な中国製AIの台頭が注目を集めています。

Google News (中国AI企業) ・ 2026-07-29

Zuck's opinion: The AI Future Is for Everyone

Metaのマーク・ザッカーバーグ氏が、WSJへの寄稿で先進的AIは一部のラボや政府に独占されるべきではなく、オープンなエコシステムを通じて広く共有されるべきだと主張した。AIのオープンな普及と個人のエージェンシー拡大の重要性を訴える内容となっている。

r/LocalLLaMA ・ 2026-07-28

Sam Altman is ready to decelerate

OpenAIのサム・アルトマンが、自身が強く体感したセキュリティインシデントを受けて開発の加速を見直す姿勢を示している。AIの急速な進化と安全性確保のバランスを見直す契機となっている。

TechCrunch AI ・ 2026-07-28

Anthropic says its Mythos model found vulnerabilities in cryptographic algorithms that secure the internet

AnthropicのAIモデル「Claude Mythos Preview」が、耐量子暗号スキームであるHAWKなどの暗号アルゴリズムにおける脆弱性を低コストかつ短時間で発見しました。AIが人間の専門家を超えるセキュリティ監査能力を示し、将来的なネットセキュリティの前提を問い直す契機となる重要な成果です。

The Decoder ・ 2026-07-28

Spend Experts Where You Are Unsure: Confidence-Adaptive Routing for Mixture-of-Experts LoRA

MoE構造を持つLoRAにおいて、トークンごとの不確実性に応じて起動するエキスパート数を動的に変化させるルーティング手法「CARE」が提案されました。簡単なトークンへの計算資源の浪費を防ぎ、難解なトークンに集中的にリソースを割り振ることで、追加パラメーターなしでモデル推論と学習の効率を向上させます。

arXiv cs.LG ・ 2026-07-28

Pass the Baton: Trajectory-Relayed On-Policy Distillation

LLMのオンポリシー蒸留において、生徒モデルが初期の推論で躓いた際に教師モデルが一時的に生成を引き継ぐ「Relay-OPD」手法が提案されました。この手法により、無駄な計算を削減しながら重要な誤り発生ポイントで効率的な学習指導が可能になり、モデルの蒸留性能が向上します。

arXiv cs.AI ・ 2026-07-28

Appreciation for Gemma 4 26b A4b

オープン重みモデル「Gemma」の派生版に関する利用レビューが投稿され、ローカル環境での高速な推論性能や多言語・マルチモーダル対応が高く評価されています。エッジ環境や個人開発において、実用的なローカルLLMの需要と性能向上を示す重要なフィードバックです。

r/LocalLLaMA ・ 2026-07-28

UniMem: Complementary Episodic-to-Parametric Memory for Boundary-Agnostic Task Streams

LLMエージェントの継続的な学習とタスク実行を支えるため、外部エピソード記憶とパラメトリック記憶を統合するメモリフレームワーク「UniMem」が提案されました。脳の記憶定着プロセスに着想を得た動的ルーティングにより、検索コストの削減と経験の定着を両立し、タスク境界のない環境での安定動作を実現します。

arXiv cs.CL ・ 2026-07-28

Instruction-Tuned Models Locally Reuse Human Syntax More Than Humans Do

対話型言語モデルが人間の発話における構文構造を人間以上に強く再利用・模倣していることを明らかにした論文です。事前学習モデルと指示チューニングモデルの比較分析により、指示チューニングを施したモデルほど直前の人間の構文ルールを過度に再現する傾向が確認されました。

arXiv cs.CL ・ 2026-07-28

A 5B-active model doesn't know much, and I've stopped counting that as a flaw

5Bのアクティブパラメータを持つモデルが、知識の量ではなく、情報の検索能力を重視するべきであると主張されている。AIモデルが情報を検索する能力を高めることで、より有効な活用方法が模索されている。AIの知識の蓄積とその応用の方法が議論されている。

r/LocalLLaMA ・ 2026-07-28

Sharpness-Aware Minimization and Muon: Robustness under the Spectral Norm

モデルの汎化性能を高める最適化手法SAMにスペクトルノルムに基づく行列摂動を導入し、最適化手法Muonと組み合わせた研究。隠れ層の行列構造を考慮したパラメータ更新を行うことで、ViTやResNetにおいて優れた堅牢性と汎化性能が得られることを実証した。

arXiv cs.LG ・ 2026-07-28

MemLens: A Value-Aware Memory Management System with Interactive Analytics for LLM-based Agents

LLMベースのエージェント向けに、記憶レコードの価値を認識して管理するシステム「MemLens」を提案した論文。対話記録を均一に扱う従来手法の冗長性を解消するため、Shapley値による記憶評価やインタラクティブな分析ダッシュボードを提供し、効率的な記憶の保存と活用を実現する。

arXiv cs.AI ・ 2026-07-28

Knowledge-Guided Multimodal Reasoning over Interacting Streams for Video-Level Ambivalence and Hesitancy Recognition

動画データから人間の葛藤や躊躇(Ambivalence/Hesitancy)といった複雑な感情状態を認識するマルチモーダル推論フレームワーク「PRISM-AH」を提案した論文。顔、音声、言語、身体の複数モダリティにおける時系列での不一致を捉えることで、行動変化の遅延や断念の前兆を高精度に判定する。

arXiv cs.AI ・ 2026-07-28

Detecting Knowledge Inconsistencies Across Text, Tables, and Knowledge Graphs

テキスト、表、ナレッジグラフ間に生じるデータ不一致を自動検出・分類するフレームワーク「Kontrast」を開発した論文。Text-to-SPARQLとLLMの推論を組み合わせることでモダリティ間の情報矛盾や食い違いを分析し、RAGやLLM事前学習データの信頼性向上に貢献する。

arXiv cs.AI ・ 2026-07-28