The Decoder· Matthias Bastian·· 3 日前
AnthropicがClaude Sonnet 5.5を公開、Opus 5.5に近い成績でタスク単価は最大30%低下
Anthropic's Claude Sonnet 5.5 nearly matches Opus 5.5 on benchmarks while costing up to 30 percent less per task
AI による要約
AnthropicはClaude 5.5ファミリーの2番目のモデルClaude Sonnet 5.5を公開した。出力生成速度は30%超向上し、タスク単価は最大30%低下した。複数のベンチマークでOpus 5.5に近い成績を示す。
入選の記録
基準 76メディアと個人1 回目 842 回目 82
入選二回の合計 166 ≥ 基準の 2 倍 152
- 情報源の区分
- メディアと個人、この区分の基準は 76 点
- 予備審査
- 通過:Anthropic发布Claude新模型及基准评测
- 推薦理由
- Sonnet 5.5とOpus 5.5、Sonnet 5のコーディング・知識業務ベンチマークの差とタスク単価の変化を比較し、中価格帯モデルの費用対効果を判断できる。
- 同じ出来事
採点はモデルが同じ基準で独立に二回行い、満点は 100。二回の合計が基準の 2 倍に届いたものだけが入選します。基準は情報源の区分ごとに決めています。
情報源:The Decoder · the-decoder.com