本文へ移動
原文
The Decoder· Matthias Bastian·· 3 日前

AnthropicがClaude Sonnet 5.5を公開、Opus 5.5に近い成績でタスク単価は最大30%低下

Anthropic's Claude Sonnet 5.5 nearly matches Opus 5.5 on benchmarks while costing up to 30 percent less per task

AI による要約

AnthropicはClaude 5.5ファミリーの2番目のモデルClaude Sonnet 5.5を公開した。出力生成速度は30%超向上し、タスク単価は最大30%低下した。複数のベンチマークでOpus 5.5に近い成績を示す。

入選の記録

入選二回の合計 166 ≥ 基準の 2 倍 152

情報源の区分
メディアと個人、この区分の基準は 76 点
予備審査
通過:Anthropic发布Claude新模型及基准评测
推薦理由
Sonnet 5.5とOpus 5.5、Sonnet 5のコーディング・知識業務ベンチマークの差とタスク単価の変化を比較し、中価格帯モデルの費用対効果を判断できる。
同じ出来事

採点はモデルが同じ基準で独立に二回行い、満点は 100。二回の合計が基準の 2 倍に届いたものだけが入選します。基準は情報源の区分ごとに決めています。

情報源:The Decoder · the-decoder.com