· 1 分钟阅读
Anthropic发布Claude Sonnet 5.5,单价与上一代相同
Anthropic表示,这款新中端模型的速度提升了30%以上,每项任务的成本最高可比Sonnet 5低30%。在多项测试中,它的表现几乎与价格更高的Opus 5.5持平。
Oossa · 关于 Oossa
Anthropic发布了Claude Sonnet 5.5,这款模型面向日常工作,例如修复漏洞、撰写文档、制作演示文稿和创建电子表格。目前,用户可通过Anthropic及Amazon Web Services、Google Cloud和Microsoft Azure等主要云平台使用该模型。
Anthropic表示,Sonnet 5.5生成答案的速度比上一代快30%以上,而且使用的token更少——token是AI模型处理文本的单位——因此每项任务的成本最高可降低30%。其公布的每百万token价格与Sonnet 5相同:输入为2美元,输出为10美元。Anthropic所称的成本节省目前只是估算,尚未经过独立测试验证。
表现与Opus有多接近?
在GDPval-AA测试中,Sonnet 5.5得分为1,844分。该测试涵盖44种职业的职场任务。Opus 5.5得分为1,846分,上一代Sonnet 5则为1,449分。在基于编程会话的CursorBench测试中,Sonnet 5.5得分为55.5%,比Opus 5.5低2个百分点。
在部分指标上,Sonnet 5.5的编程表现较Sonnet 5大幅提升。在Terminal-Bench 4.0测试中,Sonnet 5.5得分为70.6%,上一代则为10.3%。不过也有一处值得注意:在FrontierCode测试中,Sonnet 5.5使用最高强度设置“Max”时的得分,低于使用“Xhigh”时的成绩。Anthropic表示,代码审查流程有时会导致超时,或引发超出指定任务范围的改动。
提供额外安全防护
Anthropic表示,Sonnet 5.5处理网络安全任务的能力强于Sonnet 5。高风险请求会转交给Sonnet 5处理;符合条件的专业人士则可通过扩展后的验证计划申请使用风险更高的功能。该模型还加入了安全措施,旨在阻止他人复制其输出内容来训练其他系统。
Sonnet定位低于Anthropic面向复杂任务的Opus模型。Anthropic还公布了面向大规模、高频使用场景的低成本模型Haiku 5.5,但表示该模型将在未来几周内推出。
为什么重要
对于使用Claude编程或处理办公任务的人来说,Sonnet 5.5的表现可能接近Anthropic的旗舰模型,同时无需承担其更高的标价。Anthropic所称的成本节省取决于每项任务使用的token数量更少,因此实际费用会有所不同,仍有待独立验证。
来源与参考
| # | 来源 | 发布方 | 日期 | 要点 |
|---|---|---|---|---|
| 1 | Anthropic's Claude Sonnet 5.5 nearly matches Opus 5.5 on benchmarks while costing up to 30 percent less per task ↗ | The Decoder | 2026年9月28日 | Anthropic has released Claude Sonnet 5.5, the second model in its Claude 5.5 family. |
1 个来源
最后更新:
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。