Google DeepMind 与 Isomorphic Labs 公布生物韧性联合方案
Google DeepMind 与 Isomorphic Labs 公布生物韧性联合方案,从防止模型滥用与赋能防御两端推进,过去 12 个月已与政府机构、生物安全组织和研究团体建立 15 个以上合作。
Google DeepMind 与 Isomorphic Labs 公布生物韧性联合方案,从防止模型滥用与赋能防御两端推进,过去 12 个月已与政府机构、生物安全组织和研究团体建立 15 个以上合作。
Google Research 在 ICLR 2026 论文中揭示,扩散模型的创造力源于神经网络训练中权重衰减等正则化带来的 score smoothing——它使学到的 score function 变平滑,让去噪过程在训练数据点之间插值,从而生成新样本而非简单记忆。
Google DeepMind 在印度启动 ATL Saathi 试点,这是一款由 Gemini 驱动的 Web 应用,为 Atal Tinkering Labs 教育者提供 24/7 备课与培训助手,首批覆盖 100 所试点学校。
Google Research 与 Google DeepMind 提出 SensorFM,一个直接从无标注可穿戴数据学习的大型传感器基础模型,预训练语料来自 500 万同意参与者、超过 1 万亿分钟的多模态传感器信号,覆盖 100 多个国家、20 多款 Fitbit 和 Pixel Watch 设备。
Google Research 在 Nature Cities 发表首个大规模真实世界研究,通过修改 Google Maps 算法将不到 2% 的行程引导至替代路线,在美国 10 座城市测试六个月。结果显示目标路段行驶速度中位数提升约 2%,燃油消耗率中位数下降 0.5% 至 1.0%,每座城市每年可减少数千吨 CO2e 排放。
Google DeepMind 与 A24 宣布达成首个聚焦研究的合作伙伴关系,双方将围绕多个项目展开长期研发协作,让艺术家参与塑造新技术与新工作流。Google 同时对 A24 进行了投资。该合作初期聚焦弥合前沿技术与下一代娱乐之间的差距,具体目标与技术产出将随时间演进。
Hugging Face 与 Cerebras 联合演示了一套实时语音到语音流水线,用 Cerebras 加速 Gemma 4 31B 推理,串联 Nvidia Parakeet 语音识别与阿里 Qwen3TTS 语音合成。
Google Research 将建筑级屋顶反射率(albedo)数据集从 2024 年的 14 座城市扩展至 9 个国家 50+ 城市,并通过新的 Heat Resilience Earth Engine App 开放访问。
Google DeepMind 发布 Nano Banana 2 Lite(gemini-3.1-flash-lite-image)和 Gemini Omni Flash(gemini-omni-flash-preview)两款模型。
Google Research 发布 TabFM,一个面向表格数据分类与回归的零样本基础模型,将表格预测重构为上下文学习问题,无需手动训练、超参数调优和特征工程即可在单次前向传播中完成预测。
Google Research 发布一种新架构,将多 Token 预测(MTP)头接到已冻结的 Gemini Nano v3 模型上,在不改动主干权重的前提下加速端侧推理,已随 Pixel 9 和 10 系列推出。
Google Research 提出线性弹性缓存,将缓存页面淘汰建模为滑雪租赁问题,用浅层决策树预测每个页面的 TTL,动态调整缓存大小以最小化总拥有成本。在 Spanner 生产环境运行数月后,内存占用降低 15.5%,缓存未命中仅增加 5.5%,TCO 下降约 5%,实际 I/O 成本影响仅 0.5%。该方案还在多个公开缓存 trace 上做了验证。
Google Research 在 COLM 2026 发表的论文揭示,推理轨迹能解锁 LLM 原本无法召回的事实性知识,即使问题只是简单的单跳问答。研究在 Gemini-2.5(Flash 和 Pro)与 Qwen3-32B 上验证,发现两个机制:生成额外 token 充当"计算缓冲",以及"事实启动"——模型先输出相关事实为正确答案做语义预热。研究同时指出,模型自生成中间事实可能带来幻觉风险。
Google DeepMind 将 computer use 作为内置工具集成进 Gemini 3.5 Flash,此前它仅以独立的 Gemini 2.5 computer use 模型形式提供。
牛津大学、英国 AI 安全研究所、斯坦福大学和伦敦政治经济学院的研究者通过四项实验、6,923 人参与的 18,978 场对话发现,AI 在文本说服上稳定强于人类专家,即使专家可自选议题、提前研究并接受 1,000 英镑奖金激励。
Google DeepMind 宣布与英国政府、Google Cloud、Faculty 及 Barnet、Camden、Dorset 地方规划部门合作,共同开发一款 AI 规划审批原型工具,目标是帮助审批人员将住户规划申请的处理时间缩短 50%。
Google Research 发布矢量化数据集,将 Farmscapes 2020 的高分辨率栅格地图转为可操作的树篱、石墙与矮林清单,覆盖英国超 13 万平方公里。该框架基于在 3 亿多张全球卫星影像上预训练的 RSF Vision-Transformer 骨干,仅用约 247 平方公里标注数据微调,并用 Polsby–Popper 紧凑度分数(线性特征阈值小于 0.5)区分林地、树丛与树篱。
Google DeepMind 发布 AI Control Roadmap,一套用于构建和管理 Google 内部部署的先进 AI 的框架,采用纵深防御思路,在模型对齐之外增加系统级安全层,即使对齐不完美也能提供保障。
Google 公布两项关于 AI 辅助皮肤问题理解的研究:一项针对 2,345 名参与者的调查显示,使用 AI 工具时参与者尝试命名皮肤状况的比例超 62%(对照组 41%),命名准确率 23%,接近对照组 8% 的三倍。另一项混合方法研究则考察人们如何用这类工具处理自身皮肤问题,以及由此获得的理解与医生沟通的差异。研究同时发现,AI 辅助对判断下一步就医措施帮助有限。
加州大学圣地亚哥分校在 Google 支持下,计划用 2000 台退役 Pixel 手机的主板搭建数据中心,为数百名师生提供低成本、低碳的云计算。SPEC 基准显示 25-50 台手机约等于一台现代服务器,手机被组织成由 Kubernetes 管理的 25-50 台设备集群。该系统预计 2026 年秋季上线。
Google Research 在 AISTATS 2026 提出 Regularized f-Divergence Kernel Tests,用于审计机器遗忘,通过相对距离检验判断模型更接近安全重训模型还是原始受损模型。
Google DeepMind 发布实验性开源模型 DiffusionGemma,采用文本扩散方式并行生成整块文本,在专用 GPU 上推理速度最高提升 4 倍。
Google DeepMind 联合 Schmidt Sciences、Cooperative AI Foundation、ARIA 并获 Google.org 支持,发起最高 1000 万美元的全球技术研究资助,聚焦大规模多智能体 AI 系统的群体行为与安全风险。
Google DeepMind 发布 Gemini 3.5 Live Translate,这是一款支持 70+ 语言的近实时语音到语音翻译音频模型,可自动检测语言并保留说话者的语调、节奏和音高。
Google DeepMind 发布 Gemma 4 12B,一款面向笔记本本地运行的多模态模型,介于边缘端 E4B 与 26B MoE 之间,采用无编码器统一架构,视觉和音频输入直接进入 LLM 主干。
Google DeepMind 推出为期三个月的 Robotics 加速器项目,从欧洲选拔 15 家早期机器人初创公司,提供技术指导并开放其 AI 技术栈与 Gemini 机器人模型。入选企业覆盖物流、制造、医疗、气候和导航等领域,本周在伦敦启动。
Google DeepMind 公布在塞拉利昂开展的预注册随机对照试验结果,使用 Guided Learning 的学生数学成绩比对照组提升 0.258 个标准差,约相当于 1.2 至 1.7 年的常规学习进度,试验为期八周。
本期 Import AI 汇总三项研究:伦敦国王学院、复旦大学与 Alan Turing Institute 构建 SocioHack 基准,用 72 个沙盒社会环境测试 RL 模型能否在合规前提下钻制度空子,模型在历史子集上以 61.25% 召回率和 90.85% 精确率重新发现已被修补的漏洞。
Google 在 Gemini Enterprise Agent Platform 上推出由 Agentic RAG 驱动的跨语料检索公开预览版,通过 Orchestrator、Planner、Query Rewriter、Search Fanout 和 Sufficient Context Agent 等角色协作处理多源多跳查询。
Google Research 在 Nature 发表研究,提出 PHRM 系统,利用手机前置摄像头在面部解锁后的几秒内拍摄视频,通过深度学习在后台估算心率和静息心率。
Google Research 在 GitHub 上以 Apache 2.0 许可开源其水文建模框架,供各国气象与水文机构将 AI 洪水预报整合进自身工作流。该框架是使用 PyTorch 的 Python 包,采用 LSTM 网络架构,可基于 Caravan 数据集训练或微调模型,并附带交互式教程 notebook 和视频教程。
Google Research 在 I/O 2026 上发布 Gemini for Science 实验工具套件,包含基于 ERA 与 AlphaEvolve 的 Computational Discovery、基于 Co-Scientist 的 Hypothesis Generation 以及基于 NotebookLM 的 Literature Insights。
Google 为隐私分析服务推出零信任聚合方案,将新型单次消息加密聚合协议与 TEE 结合,使设备无需多轮在线即可提交数据。该方案保证 Google 只能获得匿名化的群体聚合洞察,原始数据即使在硬件保护范围内也不会被暴露或重建,TEE 认证则向参与者证明协议按公开代码正确执行。
Google DeepMind 在亚太地区启动首届加速器计划,聚焦“AI for the Planet”,面向该地区初创公司、研究团队和非营利组织,为期三个月。入选机构将获得专家指导和定制支持,并借助 Google AI 专家的前沿 AI 与科学 AI 模型,解决自然、气候、农业、能源等领域问题。计划以在新加坡举办的线下训练营启动,现已开放注册意向。
Google 发布 Empirical Research Assistance(ERA),一个用 Gemini 编写和优化科学代码的研究工具,相关论文今日发表于 Nature,并作为 Gemini for Science 的一部分向全球科学家开放。
Google DeepMind 的 Co-Scientist 正被用于加速细胞衰老逆转研究,它扫描数万篇论文后提出 20 多个可测试的新遗传因子,其中几个经实验室验证能成功驱动细胞进入更年轻状态并改善整体功能。它还能将原本长达六个月的筛选数据分析缩短至几天。
Google DeepMind 在实验性原型 Project Genie 中上线 Street View grounding 能力,用户可通过 Maps 图钉选择美国境内真实地点,再选择风格并描述角色,由 Genie 生成起始位置锚定真实影像的可交互世界。
Google DeepMind 发布 Gemini Omni 系列首个模型 Gemini Omni Flash,可组合图像、音频、视频和文本输入生成高质量视频,并支持通过自然语言对话逐轮编辑视频。
Google DeepMind 发布 Gemini for Science,在 Google Labs 上线三款实验工具:基于 Co-Scientist 的 Hypothesis Generation。
Google 宣布把内容透明度与验证工具扩展到 Search、Gemini、Chrome、Pixel 和 Cloud。SynthID 已为超过 1000 亿张图片和视频、6 万年音频加上水印,Gemini 应用中的 SynthID 验证已被使用 5000 万次,并将在未来几周进入 Search 和 Chrome。