Google DeepMind 在塞拉利昂开展 AI 学习试验,数学成绩提升 0.258 个标准差
Google DeepMind 公布在塞拉利昂开展的预注册随机对照试验结果,使用 Guided Learning 的学生数学成绩比对照组提升 0.258 个标准差,约相当于 1.2 至 1.7 年的常规学习进度,试验为期八周。
Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。
Google DeepMind 公布在塞拉利昂开展的预注册随机对照试验结果,使用 Guided Learning 的学生数学成绩比对照组提升 0.258 个标准差,约相当于 1.2 至 1.7 年的常规学习进度,试验为期八周。
Google 在 Gemini Enterprise Agent Platform 上推出由 Agentic RAG 驱动的跨语料检索公开预览版,通过 Orchestrator、Planner、Query Rewriter、Search Fanout 和 Sufficient Context Agent 等角色协作处理多源多跳查询。
Google Research 在 Nature 发表研究,提出 PHRM 系统,利用手机前置摄像头在面部解锁后的几秒内拍摄视频,通过深度学习在后台估算心率和静息心率。
Google Research 在 GitHub 上以 Apache 2.0 许可开源其水文建模框架,供各国气象与水文机构将 AI 洪水预报整合进自身工作流。该框架是使用 PyTorch 的 Python 包,采用 LSTM 网络架构,可基于 Caravan 数据集训练或微调模型,并附带交互式教程 notebook 和视频教程。
Google 发布 Empirical Research Assistance(ERA),一个用 Gemini 编写和优化科学代码的研究工具,相关论文今日发表于 Nature,并作为 Gemini for Science 的一部分向全球科学家开放。
Google DeepMind 在实验性原型 Project Genie 中上线 Street View grounding 能力,用户可通过 Maps 图钉选择美国境内真实地点,再选择风格并描述角色,由 Genie 生成起始位置锚定真实影像的可交互世界。
Google DeepMind 发布 Gemini Omni 系列首个模型 Gemini Omni Flash,可组合图像、音频、视频和文本输入生成高质量视频,并支持通过自然语言对话逐轮编辑视频。
Google DeepMind 发布 Gemini for Science,在 Google Labs 上线三款实验工具:基于 Co-Scientist 的 Hypothesis Generation。
Google 宣布把内容透明度与验证工具扩展到 Search、Gemini、Chrome、Pixel 和 Cloud。SynthID 已为超过 1000 亿张图片和视频、6 万年音频加上水印,Gemini 应用中的 SynthID 验证已被使用 5000 万次,并将在未来几周进入 Search 和 Chrome。
Google DeepMind 与 Google Research 开发的 AI 天气模型 WeatherNext 帮助美国国家飓风中心提前五天以 80% 置信度预测飓风 Melissa 将以五级强度登陆牙买加,三日前置信度接近 100%。
Google DeepMind 发布 Gemini 3.5 模型系列,首发 3.5 Flash,主打智能体与编码能力,即日起在 Gemini app、Google Search 的 AI Mode、Google Antigravity、Gemini API 及 Gemini Enterprise 上线。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,这是一个基于 Gemini 构建的多智能体 AI 系统,可迭代生成、辩论并演化科学假设。
Google DeepMind 发布 AlphaEvolve 一年进展汇总,这款由 Gemini 驱动的编码智能体已从数学与计算机科学的开放问题扩展到基因组、电网、量子物理和 AI 基础设施等领域。
Google DeepMind 宣布 AI co-clinician 研究计划,探索 AI 智能体在医生临床监督下协助患者诊疗。在 98 个真实初级保健查询的盲评中,该系统 97 例无关键错误,医生更偏好其回答而非现有证据综合工具;在 140 项问诊技能评估中,AI 在 68 项达到或超过初级保健医生水平,但专家医生在识别危险信号和指导关键体格检查上整体更优。
Google Research 介绍科学家如何使用其 Empirical Research Assistance(ERA)工具推进科研,涵盖流行病预测、宇宙学、碳监测和神经科学四个方向。
Google Research 宣布在 Google Photos 的 Auto frame 功能中上线一种新方法,可在照片拍摄后调整相机视角。该方法先用内部 3D 点图估计模型重建场景与焦距,再用生成式潜在扩散模型补全新视角下暴露出的空白区域,并自动检测人脸位置与广角畸变来推荐理想取景。该功能已面向含人物的照片自动生效,用户可在 Auto frame 候选中选择重新构图后的版本。
Google DeepMind 发布论文提出 Decoupled DiLoCo 分布式训练架构,把大规模训练拆分为解耦的计算孤岛,孤岛间以异步数据流通信,从而隔离局部硬件故障。
Google Research 发布 ICLR 论文 ReasoningBank,一种从成功和失败经验中提炼高层推理模式的智能体记忆框架,并已开源。
Google DeepMind 推出新一代文本转语音模型 Gemini 3.1 Flash TTS,主打更强的可控性、表现力与音质,即日起面向开发者通过 Gemini API 和 Google AI Studio 预览、企业通过 Vertex AI 预览、Workspace 用户通过 Google Vids 使用。
Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其面向机器人的推理优先模型升级版,强化了空间推理与多视角理解,并新增仪表读数能力,可读取圆形压力表、液位指示器和数字读数。