跳到正文

Anthropic称智谱GLM-5.3漏洞利用能力接近Claude

先了解这件事

AI 综述

2026年9月30日,Anthropic发布评估称,智谱的开放权重模型GLM-5.3在漏洞利用开发能力上接近其Claude Mythos Preview。同日,Anthropic Frontier Red Team披露了评测细节:在内部Binary Exploitation基准的100个随机任务上,GLM-5.3在4%的试验中实现完整控制流劫持,Claude Mythos Preview为6%;报告称此前模型如Claude Opus 4.6和GLM-5.2在这些任务中均未成功,认为一个有意义的能力阈值已被跨过。早先报道仅称GLM-5.3能力接近Claude Mythos Preview,未公布评估方法、具体分数或对比细节;后续报道则给出了4%与6%的具体数据及基准说明。智谱方面暂未见回应。

AI 根据报道生成 · 38 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. The Decoder精选
    Anthropic 称智谱开放权重 GLM-5.3 在漏洞利用能力上接近 Claude Mythos Preview

    Anthropic 发布评估称,智谱开放权重模型 GLM-5.3 在漏洞利用开发上接近其 Claude Mythos Preview。

  2. Simon Willison
    Anthropic 红队:GLM-5.3 在 4% 试验中实现完整控制流劫持

    Anthropic Frontier Red Team 在内部 Binary Exploitation 基准的 100 个随机任务上评测多个模型,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。报告称此前模型如 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功,认为一个有意义的能力阈值已被跨过。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。