跳到正文
原文
Google DeepMind·· 2026-06-16

Google DeepMind 发布 AI Control Roadmap,用纵深防御保障内部 AI 智能体安全

Securing the future of AI agents

AI 导读

Google DeepMind 发布 AI Control Roadmap,一套用于构建和管理 Google 内部部署的先进 AI 的框架,采用纵深防御思路,在模型对齐之外增加系统级安全层,即使对齐不完美也能提供保障。

入选记录

入选两次之和 124 ≥ 门槛的两倍 120

信源等级
官方一手,这一级的门槛是 60 分
预筛
通过:Google DeepMind AI智能体安全控制框架
推荐理由
Google DeepMind 公开内部 AI 控制路线图,给出检测与响应分级和百万条编码智能体轨迹的分析结论。

评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。

来源:Google DeepMind · deepmind.google