The Decoder· Maximilian Schreiner·· 1 日前
Anthropic、Zhipu の公開ウェイト GLM-5.3 がエクスプロイト開発で Claude Mythos Preview に近いと評価
Anthropic says Zhipu's open-weight GLM-5.3 nearly matches Claude Mythos Preview at building exploits
AI による要約
Anthropic は、Zhipu の公開ウェイトモデル GLM-5.3 がエクスプロイト開発で同社の Claude Mythos Preview に近い能力を持つとする評価を公開した。
入選の記録
基準 76メディアと個人1 回目 782 回目 78
入選二回の合計 156 ≥ 基準の 2 倍 152
- 情報源の区分
- メディアと個人、この区分の基準は 76 点
- 予備審査
- 通過:正文详述GLM-5.3模型漏洞利用能力评测
- 推薦理由
- Anthropic は二つのベンチマークと1回の実際の脆弱性探索で GLM-5.3 と Claude Mythos Preview を比較し、公開ウェイトのガードレールを除去する具体的なコストも示した。
- 同じ出来事
採点はモデルが同じ基準で独立に二回行い、満点は 100。二回の合計が基準の 2 倍に届いたものだけが入選します。基準は情報源の区分ごとに決めています。
情報源:The Decoder · the-decoder.com