本文へ移動
原文
Google DeepMind·· 2026-06-16

Google DeepMind、AI Control Roadmapを公開し多層防御で内部エージェントを保護

Securing the future of AI agents

AI による要約

Google DeepMindはGoogle内部で使う高度なAIの構築と管理に向け、AI Control Roadmapを公開した。多層防御の考え方でモデルのアラインメントに加えてシステム単位の安全層を設け、アラインメントが不完全でも保護を提供する。

入選の記録

入選二回の合計 124 ≥ 基準の 2 倍 120

情報源の区分
公式・一次情報、この区分の基準は 60 点
予備審査
通過:Google DeepMind AI智能体安全控制框架
推薦理由
内部AI制御のロードマップで、検知・対応の階層化と100万件のコーディングエージェント軌跡の分析結果を公開する。

採点はモデルが同じ基準で独立に二回行い、満点は 100。二回の合計が基準の 2 倍に届いたものだけが入選します。基準は情報源の区分ごとに決めています。

情報源:Google DeepMind · deepmind.google