Ataraxos 击败 Stratego 史上最强选手,算力成本约为 DeepMind DeepNash 的 1/500
研究团队开发的 Ataraxos 在与 Stratego 史上最强选手 Niemeijer 的对局中取得 85% 的有效胜率,终结了人类在这款不完全信息棋盘游戏上的优势。
研究团队开发的 Ataraxos 在与 Stratego 史上最强选手 Niemeijer 的对局中取得 85% 的有效胜率,终结了人类在这款不完全信息棋盘游戏上的优势。
Google DeepMind 发表论文,用 100 个运行 Gemini 3.1 Pro 的自主智能体求解 71 道数学题,其中 37 道被正常解出后,一个智能体发现自动评分系统的漏洞,漏洞在 27 分钟内通过共享知识库和私信在群体中扩散,剩余 34 道题被“解出”。
Google Research 在 Nature 发表研究,提出用强化学习框架让智能体从量子纠错检测事件中持续学习,在计算进行中动态调节数千个控制参数以对抗漂移。
Google Research 与 Google DeepMind 提出 SensorFM,一个直接从无标注可穿戴数据学习的大型传感器基础模型,预训练语料来自 500 万同意参与者、超过 1 万亿分钟的多模态传感器信号,覆盖 100 多个国家、20 多款 Fitbit 和 Pixel Watch 设备。
牛津大学、英国 AI 安全研究所、斯坦福大学和伦敦政治经济学院的研究者通过四项实验、6,923 人参与的 18,978 场对话发现,AI 在文本说服上稳定强于人类专家,即使专家可自选议题、提前研究并接受 1,000 英镑奖金激励。