Destro AI 获 800 万美元种子轮,用智能层让机器人与人类协同作业
Destro 结束隐身状态并获得 800 万美元种子轮融资,其 AI 智能层同时指挥机器人和人类工人,在 Yusen Logistics 的物流场景中完成交叉转运。该方案基于开放权重视觉-语言-动作模型,由 Vision 操作系统驱动机器人,Mothership 操作系统统一调度人、货与车辆。目前试点已从 3 台机器人扩展至 26 台,并在南加州启动 17 台机器人的新试点。
Destro 结束隐身状态并获得 800 万美元种子轮融资,其 AI 智能层同时指挥机器人和人类工人,在 Yusen Logistics 的物流场景中完成交叉转运。该方案基于开放权重视觉-语言-动作模型,由 Vision 操作系统驱动机器人,Mothership 操作系统统一调度人、货与车辆。目前试点已从 3 台机器人扩展至 26 台,并在南加州启动 17 台机器人的新试点。
AMD 宣布以约 82 亿美元全股票交易收购专注空间智能的初创公司 World Labs,交易预计在 2026 年底前完成,尚待监管批准。World Labs 创始人李飞飞将加入 AMD 担任执行副总裁兼首席科学家,直接向 CEO 苏姿丰汇报并负责前沿研究。
AMD 宣布以 82 亿美元收购 World Labs,后者专注理解物理现实的深度学习模型,交易预计在年底前完成并需通过监管审批。World Labs 创始人李飞飞将加入 AMD 担任执行副总裁兼首席科学家,双方去年已建立推理优化与训练合作。
AMD 以 82 亿美元收购 World Labs。World Labs 自 2024 年成立以来构建了图像、视频和空间重建的模型训练团队,并通过收购 SceniX 推进机器人仿真能力。其近期发布的 Atlas 是一种 omni 模型架构,可从 2D 图像输入预测新视角,结合生成模型与多视图几何,解决了计算机视觉中长期存在的稀疏重建问题,在机器人、设计、工程和科学等领域有直接应用。
据 The Information 报道,特斯拉在得州和加州的工厂让工人穿戴记录动作的特制服装,为 Optimus 人形机器人采集模仿学习数据,但部分工人因认为机器人最终会取代自己而抱怨,特斯拉随后将数据采集转交给专门团队并设立训练中心。
1100 万美元奖金的 XPRIZE Wildfire 竞赛结果揭晓,两大赛道特等奖均空缺。太空探测赛道要求 10 分钟内识别澳大利亚大范围火情,SIRIUS Wildfire Alliance 获 50 万美元一等奖;自主响应赛道在阿拉斯加 386 平方英里区域测试,三支决赛队均在 10 分钟内发现高风险火情,但无一完全扑灭。
微软研究院对移动操作机器人工作负载做了系统性测量,发现把物理 AI 推理从机器人端侧 GPU 卸载到边缘或云端 GPU,可提升任务成功率、支持更大模型并延长续航。
NVIDIA 在加拿大多伦多 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速软件包集合,新增智能体工作流与平台支持,帮助开发者更快构建、定制和部署机器人应用。
NVIDIA 发文阐述物理 AI 规模化部署需要覆盖硬件、软件、AI 行为与运行环境的安全体系,并介绍其全栈安全系统 NVIDIA Halos。
Google DeepMind 发布 Gemini Robotics ER 2,作为机器人的高层大脑,支持视频理解、多步任务编排与多机器人协作,并可将动作执行交给底层 VLA 模型。
Google DeepMind 发布 Gemini Robotics 2,作为新一代机器人智能层,首次实现对完整人形机器人的全身控制,并支持双手与夹爪的精细操作。
NVIDIA 推出 Cosmos-H-Dreams,一个面向手术机器人的实时、动作条件生成式仿真器,通过 FlashDreams 推理库在单张 NVIDIA RTX PRO 6000 GPU 上运行,支持人与策略闭环交互控制。
Hugging Face 发布开源系统 Grabette,用手持夹爪加双摄像头录制操作演示,无需机器人或遥操作设备即可生成机器人可用的数据集。Grabette 手持端物料成本约 490€,配套的电机夹爪 Gripette 约 120€,硬件 CAD、树莓派采集软件和浏览器端处理流程全部开源。
Mistral AI 发布首个具身导航模型 Robostral Navigate,这是一个 8B 模型,仅用单个普通 RGB 相机、无需 LiDAR 或深度传感器,在 R2R-CE 验证集未见环境上取得 76.6% 成功率,比最佳单相机方案高 9.7 个百分点,比使用深度或多相机的最佳系统高 4.5 个百分点。
Hugging Face 发布 LeRobot v0.6.0,围绕机器人学习闭环引入世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新一批 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT)以及统一奖励模型 API(Robometer、TOPReward)。
NVIDIA 推出 ENPIRE 框架,让编码智能体驱动真实机械臂自主实验与迭代,在 PushT、整理插针、用切割器剪扎带等任务上实现 99% 成功率,测试硬件为双 YAM 机械臂加 RTX 5090 工作站。GPT-5.5(Codex)与 Opus 4.7(Claude Code)表现互有胜负,Kimi-2.6 落后;智能体数量增至 8 个时能更快找到更高分方案。
Google DeepMind 推出为期三个月的 Robotics 加速器项目,从欧洲选拔 15 家早期机器人初创公司,提供技术指导并开放其 AI 技术栈与 Gemini 机器人模型。入选企业覆盖物流、制造、医疗、气候和导航等领域,本周在伦敦启动。
Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其面向机器人的推理优先模型升级版,强化了空间推理与多视角理解,并新增仪表读数能力,可读取圆形压力表、液位指示器和数字读数。