Simon Willison·· 17 小时前
Anthropic 红队:GLM-5.3 在 4% 试验中实现完整控制流劫持
Quoting Anthropic Frontier Red Team
AI 导读
Anthropic Frontier Red Team 在内部 Binary Exploitation 基准的 100 个随机任务上评测多个模型,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。报告称此前模型如 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功,认为一个有意义的能力阈值已被跨过。
入选记录
门槛 76媒体与个人第一次 62第二次 68
未入选两次之和 130 < 门槛的两倍 152
- 信源等级
- 媒体与个人,这一级的门槛是 76 分
- 预筛
- 通过:引用Anthropic红队评测AI模型网络攻击能力
- 同一件事
评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。
来源:Simon Willison · simonwillison.net