跳到正文
原文
The Decoder· Matthias Bastian·· 2 天前

Anthropic 发布 Claude Sonnet 5.5,基准接近 Opus 5.5 且每任务成本最多低 30%

Anthropic's Claude Sonnet 5.5 nearly matches Opus 5.5 on benchmarks while costing up to 30 percent less per task

AI 导读

Anthropic 发布 Claude 5.5 家族第二款模型 Claude Sonnet 5.5,输出生成速度提升超过 30%,每任务成本最多降低 30%,在多项基准上接近 Opus 5.5。

入选记录

入选两次之和 166 ≥ 门槛的两倍 152

信源等级
媒体与个人,这一级的门槛是 76 分
预筛
通过:Anthropic发布Claude新模型及基准评测
推荐理由
对比了 Sonnet 5.5 与 Opus 5.5、Sonnet 5 在编码和知识工作基准上的差距,并给出每任务成本变化,便于判断中端模型的性价比位置。
同一件事

评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。

来源:The Decoder · the-decoder.com