Google DeepMind·· 2026-06-16
Google DeepMind 发布 AI Control Roadmap,用纵深防御保障内部 AI 智能体安全
Securing the future of AI agents
AI 导读
Google DeepMind 发布 AI Control Roadmap,一套用于构建和管理 Google 内部部署的先进 AI 的框架,采用纵深防御思路,在模型对齐之外增加系统级安全层,即使对齐不完美也能提供保障。
入选记录
门槛 60官方一手第一次 62第二次 62
入选两次之和 124 ≥ 门槛的两倍 120
- 信源等级
- 官方一手,这一级的门槛是 60 分
- 预筛
- 通过:Google DeepMind AI智能体安全控制框架
- 推荐理由
- Google DeepMind 公开内部 AI 控制路线图,给出检测与响应分级和百万条编码智能体轨迹的分析结论。
评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。
来源:Google DeepMind · deepmind.google