本文へ移動

Anthropic、智譜GLM-5.3の脆弱性悪用能力はClaudeに近いと評価

まずはこの出来事を

AI によるまとめ

2026年9月30日、Anthropicは智譜のオープンウェイトモデルGLM-5.3が脆弱性悪用コードの開発能力でClaude Mythos Previewに近いとの評価を公表した。同日、Anthropic Frontier Red Teamは評価の詳細も明らかにした。内部のBinary Exploitationベンチマークの無作為に選んだ100課題で、GLM-5.3は試行の4%で完全な制御フローの乗っ取りに成功し、Claude Mythos Previewは6%だった。Claude Opus 4.6やGLM-5.2などの従来モデルはいずれも成功せず、意味のある能力の閾値を超えたと報告した。初期の報道は能力が近いとの説明にとどまり、方法、具体的な点数、比較の詳細を示さなかったが、後続報道は4%と6%の数値およびベンチマークの説明を提示した。智譜の回答は現時点で確認されていない。

報道をもとに AI が作成 · 23 時間前に更新

報道の時系列

報道をたどり、出来事のさまざまな面を知る。

9月30日
  1. The Decoder精選
    Anthropic、Zhipu の公開ウェイト GLM-5.3 がエクスプロイト開発で Claude Mythos Preview に近いと評価

    Anthropic は、Zhipu の公開ウェイトモデル GLM-5.3 がエクスプロイト開発で同社の Claude Mythos Preview に近い能力を持つとする評価を公開した。

  2. Simon Willison
    Anthropicレッドチーム:GLM-5.3が試行の4%で完全な制御フロー乗っ取りに成功

    Anthropic Frontier Red Teamは内部のBinary Exploitationベンチマークの無作為に選んだ100課題で複数モデルを評価した。完全な制御フロー乗っ取りの成功率はGLM-5.3が4%、Claude Mythos Previewが6%だった。Claude Opus 4.6やGLM-5.2などの従来モデルはこれらの課題に成功しておらず、意味のある能力の閾値を超えたと報告した。

この出来事の注目度の推移

現在の注目度 8·比較範囲のピーク 15(9月30日 23:00)·過去 24 時間の比較範囲での変化 –

051015209月30日23:0010月1日07:0010月1日14:0010月1日22:00

推移は、途切れずに観測できた同じ主体どうしだけで比べるため、現在の注目度の集計より範囲が狭いことがあります。ポインタを動かすかグラフをクリックすると 1 時間ごとの注目度が見られます。キーボードでは左右の矢印キーで切り替えられます。