NVIDIA と CoreWeave、Vera Rubin NVL72 を本番導入、最初の顧客は Cognition
CoreWeave は、Spectrum-X 102.4T Ethernet と組み合わせた NVIDIA Vera Rubin NVL72 システムが CoreWeave Cloud で利用可能になったと発表した。Cognition が本番環境でこのシステムを運用する最初の顧客となる。
CoreWeave は、Spectrum-X 102.4T Ethernet と組み合わせた NVIDIA Vera Rubin NVL72 システムが CoreWeave Cloud で利用可能になったと発表した。Cognition が本番環境でこのシステムを運用する最初の顧客となる。
トランプ氏は火曜日、行政サービスや情報を探すための AI チャットボット America.gov の公開を発表した。Google は参加と Gemini モデルの提供を認めたが、他の AI 企業の参加は不明だ。トランプ氏は、何万もの政府サイトや規則を探さずに、統一窓口ですべての質問に答えられるとした。記事は、大規模言語モデルがなおハルシネーションを起こしやすく、食料補助の申請、ビザ更新、税申告の情報を誤ると、期限の見落とし、給付の拒否、罰則につながると指摘する。
Google DeepMindはPrivate AI Computeの構成を更新し、端末並みのプライバシー基準を保ちながら、永続的で端末間共有できるAIメモリーをクラウドに導入する。データは暗号化ストレージに封じ、復号鍵はユーザー端末だけに保持する。モデルがアクセスするときはエンドツーエンド暗号化経路でクラウドのsecure enclaveにつなぎ、隔離メモリー内で一時復号し、新しい文脈を保存した直後に再暗号化する。
SalesforceはDreamforceで初のCRM推論モデルKoaを発表した。NVIDIA Nemotron 3 Superを事後学習し、約30年の企業CRM導入から作った独自の合成データで学習した。製造、金融サービス、医療、旅行など14以上の業界を対象とする。
NVIDIA は AI Infra Summit で、一定の電力予算内で AI 工場のトークンスループットを高める DSX を紹介した。Lambda は5ラック・19ノードの HGX B200 クラスターで DSX MaxLPS を検証し、16ノードの最大電力と同じ予算で19ノードを稼働させた。トークンスループットは毎秒約400万から500万に24%増え、1ワット当たり性能は23%向上した。
NVIDIAはAI Infra SummitでVera RubinとDSXプラットフォームの複数の進展を公表し、1メガワット当たりのトークン処理量のエネルギー効率最適化を重点的に示した。