跳到正文

Anthropic称智谱GLM-5.3漏洞利用能力接近Claude

先了解这件事

AI 综述

2026年9月30日,Anthropic发布评估称,智谱的开放权重模型GLM-5.3在漏洞利用开发能力上接近其Claude Mythos Preview。同日,Anthropic Frontier Red Team披露了评测细节:在内部Binary Exploitation基准的100个随机任务上,GLM-5.3在4%的试验中实现完整控制流劫持,Claude Mythos Preview为6%;报告称此前模型如Claude Opus 4.6和GLM-5.2在这些任务中均未成功,认为一个有意义的能力阈值已被跨过。早先报道仅称GLM-5.3能力接近Claude Mythos Preview,未公布评估方法、具体分数或对比细节;后续报道则给出了4%与6%的具体数据及基准说明。智谱方面暂未见回应。

AI 根据报道生成 · 1 天前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. The Decoder精选
    Anthropic 称智谱开放权重 GLM-5.3 在漏洞利用能力上接近 Claude Mythos Preview

    Anthropic 发布评估称,智谱开放权重模型 GLM-5.3 在漏洞利用开发上接近其 Claude Mythos Preview。

  2. Simon Willison
    Anthropic 红队:GLM-5.3 在 4% 试验中实现完整控制流劫持

    Anthropic Frontier Red Team 在内部 Binary Exploitation 基准的 100 个随机任务上评测多个模型,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。报告称此前模型如 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功,认为一个有意义的能力阈值已被跨过。

本事件热度走势

当前热度 8·可比范围峰值 15(9月30日 23:00)·近 24 小时可比范围变化 –

051015209月30日23:0010月1日07:0010月1日14:0010月1日22:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。