本文へ移動
原文
The Decoder· Maximilian Schreiner·· 1 日前

Anthropic、Zhipu の公開ウェイト GLM-5.3 がエクスプロイト開発で Claude Mythos Preview に近いと評価

Anthropic says Zhipu's open-weight GLM-5.3 nearly matches Claude Mythos Preview at building exploits

AI による要約

Anthropic は、Zhipu の公開ウェイトモデル GLM-5.3 がエクスプロイト開発で同社の Claude Mythos Preview に近い能力を持つとする評価を公開した。

入選の記録

入選二回の合計 156 ≥ 基準の 2 倍 152

情報源の区分
メディアと個人、この区分の基準は 76 点
予備審査
通過:正文详述GLM-5.3模型漏洞利用能力评测
推薦理由
Anthropic は二つのベンチマークと1回の実際の脆弱性探索で GLM-5.3 と Claude Mythos Preview を比較し、公開ウェイトのガードレールを除去する具体的なコストも示した。
同じ出来事

採点はモデルが同じ基準で独立に二回行い、満点は 100。二回の合計が基準の 2 倍に届いたものだけが入選します。基準は情報源の区分ごとに決めています。

情報源:The Decoder · the-decoder.com