NVIDIA 与 CoreWeave 将 Vera Rubin NVL72 投入生产,Cognition 为首家客户
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 上可用,Cognition 成为首个在生产环境运行该系统的客户。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 上可用,Cognition 成为首个在生产环境运行该系统的客户。
特朗普周二宣布白宫推出 America.gov,一个帮助民众查找政府服务与信息的 AI 聊天机器人,Google 确认参与该发布并提供其 AI 模型 Gemini,其他 AI 公司是否参与尚不清楚。特朗普称民众不再需要在数万个政府网站和规则中搜索,将有一个统一入口回答所有问题。文章指出大语言模型仍易产生幻觉,若民众用它查询申请食品券、续签签证或报税等信息,出错可能导致错过截止日期、福利被拒或受罚。
Google DeepMind 公布 Private AI Compute 架构更新,将持久化、跨设备的 AI 记忆引入云端,同时保持端侧级别的隐私标准。新架构把数据封存在加密存储中,解密密钥只保留在用户设备上,模型需要访问时通过端到端加密通道连到云端安全隔离区(secure enclave),在隔离内存中临时解密、保存新上下文后立即重新加密。
Salesforce 在 Dreamforce 上发布其首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 后训练,训练语料为近三十年企业 CRM 部署衍生的专有合成数据集,覆盖制造、金融服务、医疗和旅游等 14 个以上行业。
NVIDIA 在 AI Infra Summit 上介绍 DSX 平台,用于在固定电力预算下提升 AI 工厂的 token 吞吐。Lambda 在五机架 19 节点 HGX B200 集群上验证 DSX MaxLPS,以 19 节点运行在 16 节点满功耗的同一预算内,集群 token 吞吐提升 24%,从约每秒 400 万 token 增至 500 万,每瓦性能提升 23%。
NVIDIA 在 AI Infra Summit 上公布 Vera Rubin 与 DSX 平台的多项进展,重点展示每兆瓦 token 吞吐的能效优化。