Google DeepMind·· 2026-06-16
Google DeepMind、AI Control Roadmapを公開し多層防御で内部エージェントを保護
Securing the future of AI agents
AI による要約
Google DeepMindはGoogle内部で使う高度なAIの構築と管理に向け、AI Control Roadmapを公開した。多層防御の考え方でモデルのアラインメントに加えてシステム単位の安全層を設け、アラインメントが不完全でも保護を提供する。
入選の記録
基準 60公式・一次情報1 回目 622 回目 62
入選二回の合計 124 ≥ 基準の 2 倍 120
- 情報源の区分
- 公式・一次情報、この区分の基準は 60 点
- 予備審査
- 通過:Google DeepMind AI智能体安全控制框架
- 推薦理由
- 内部AI制御のロードマップで、検知・対応の階層化と100万件のコーディングエージェント軌跡の分析結果を公開する。
採点はモデルが同じ基準で独立に二回行い、満点は 100。二回の合計が基準の 2 倍に届いたものだけが入選します。基準は情報源の区分ごとに決めています。
情報源:Google DeepMind · deepmind.google