NVIDIA と CoreWeave、Vera Rubin NVL72 を本番導入、最初の顧客は Cognition
CoreWeave は、Spectrum-X 102.4T Ethernet と組み合わせた NVIDIA Vera Rubin NVL72 システムが CoreWeave Cloud で利用可能になったと発表した。Cognition が本番環境でこのシステムを運用する最初の顧客となる。
NVIDIA の AI チップとエコシステム:新しい GPU、CUDA、ロボティクス基盤、AI 計算資源市場の動向。
CoreWeave は、Spectrum-X 102.4T Ethernet と組み合わせた NVIDIA Vera Rubin NVL72 システムが CoreWeave Cloud で利用可能になったと発表した。Cognition が本番環境でこのシステムを運用する最初の顧客となる。
AMDは空間知能に特化したスタートアップWorld Labsを約82億ドルの全株式交換取引で買収すると発表した。取引は規制当局の承認を待ち、2026年末までの完了を見込む。World Labs創業者の李飛飛氏はAMDに加わり、執行副社長兼チーフサイエンティストとしてCEOの蘇姿丰氏に直接報告し、最先端研究を担当する。
NVIDIAはオープンソースの表形式基盤モデルKumo Tabularを公開した。ラベル付きの表の行を入力すると、学習、調整、特徴量設計なしに、単一の順伝播で新しい行のラベルを予測し、分類と回帰に対応する。28M〜215Mの3サイズを提供し、人工合成の表のみで事前学習した。商用利用可能なOpenMDW-1.1ライセンスを採用し、TabArena、BeyondArena、TALENT、ScoringBenchの4ベンチマークで首位だった。
AMDは李飛飛が共同設立したAI研究所World Labsを約82億ドルの全額株式交換で買収すると発表した。年末までに完了する見込みだ。World Labsは2024年に設立され、数か月で評価額10億ドルに達した。2025年には初の商用製品Marbleを公開し、プロンプトから操作可能な3D世界を生成できる。
NVIDIAはGoogle DeepMind、EMBL-EBIなどの世界的研究連合に加わり、AlphaFold Databaseで2800種超のウイルスのタンパク質複合体の予測3D構造を公開した。科学者は誰でも無料で使える。
NVIDIA は Toronto の ROSCon で Isaac ROS 5.0 を公開した。ROS ベースの GPU 高速化パッケージ群で、エージェントのワークフローとプラットフォーム対応を追加し、ロボットアプリの構築、カスタマイズ、配備を速める。
NVIDIA は MLPerf Inference v6.1 に Vera Rubin NVL72 のプレビュー結果を初提出した。スループットは GB300 NVL72 に対し、Qwen3-VL で最大3.7倍、DeepSeek-R1 で最大2.5倍だった。
SalesforceはDreamforceで初のCRM推論モデルKoaを発表した。NVIDIA Nemotron 3 Superを事後学習し、約30年の企業CRM導入から作った独自の合成データで学習した。製造、金融サービス、医療、旅行など14以上の業界を対象とする。
NVIDIA は AI Infra Summit で、一定の電力予算内で AI 工場のトークンスループットを高める DSX を紹介した。Lambda は5ラック・19ノードの HGX B200 クラスターで DSX MaxLPS を検証し、16ノードの最大電力と同じ予算で19ノードを稼働させた。トークンスループットは毎秒約400万から500万に24%増え、1ワット当たり性能は23%向上した。
NVIDIAはAI Infra SummitでVera RubinとDSXプラットフォームの複数の進展を公表し、1メガワット当たりのトークン処理量のエネルギー効率最適化を重点的に示した。
Hugging Face は、音声認識のベンチマーク最適化を数値化するため、合意不一致プローブ、マスクした固有表現の検索、綴りの切り替えという三つのテストを提案した。11のオープンソース ASR モデルを評価し、一部の高得点モデルは音声が矛盾する場合、該当語が無音の場合、両方の表記が音声上成立する場合でも、VoxPopuli や LibriSpeech の正解転写の誤りを再現することを見つけた。
NVIDIAは3億6400万パラメーターのオープンウェイト音声合成モデルMagpie TTS Multilingualを公開した。英語、スペイン語、フランス語、ドイツ語、イタリア語、ベトナム語、中国語、ヒンディー語、日本語に加え、新たな現代標準アラビア語、韓国語、ブラジルポルトガル語の計12言語に対応する。
Mistral AIは30億パラメーターのオープンウェイト安全分類器ShieldstralをApache 2.0で公開した。16GBのNVIDIA GPU1枚で動く。コンテンツ審査を方針に適応する質問回答として扱い、推論時に方針を自然言語で記述すれば、再学習なしで校正済みの安全スコアを返す。文字と画像を共通に処理する。公式説明では、文字の安全性で最大7倍の規模のモデルに匹敵し、マルチモーダル審査のベンチマークで新たな最高成績を達成した。
Hugging FaceはLeRobot v0.6.0を公開し、ロボット学習の循環に向け、世界モデル方策VLA-JEPA、FastWAM、LingBot-VA、新たなVLA群GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT、統一報酬モデルAPIのRobometerとTOPRewardを導入した。
Google DeepMindは実験的オープンソースモデルDiffusionGemmaを公開した。テキスト拡散で文章の塊を並列生成し、専用GPUで推論速度を最大4倍に高める。
Googleはコンテンツの透明性・検証ツールをSearch、Gemini、Chrome、Pixel、Cloudへ拡大すると発表した。SynthIDは1000億超の画像と動画、6万年分の音声に透かしを付けた。Geminiアプリ内のSynthID検証は5000万回利用され、今後数週間でSearchとChromeにも導入される。
Mistral は Mistral 3 シリーズを公開した。14B、8B、3B の小型 dense モデルと、過去最強の Mistral Large 3 を含む。後者は稼働41B・総675Bの疎な MoE で、すべて Apache 2.0 で公開する。