跳到正文
原文
Simon Willison·· 17 小时前

Anthropic 红队:GLM-5.3 在 4% 试验中实现完整控制流劫持

Quoting Anthropic Frontier Red Team

AI 导读

Anthropic Frontier Red Team 在内部 Binary Exploitation 基准的 100 个随机任务上评测多个模型,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。报告称此前模型如 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功,认为一个有意义的能力阈值已被跨过。

入选记录

未入选两次之和 130 < 门槛的两倍 152

信源等级
媒体与个人,这一级的门槛是 76 分
预筛
通过:引用Anthropic红队评测AI模型网络攻击能力
同一件事

评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。

来源:Simon Willison · simonwillison.net