Anthropic发布Claude Sonnet 5.5:编程性能反超旗舰Opus

9月29日消息,Anthropic发布了最新的Claude Sonnet 5.5。Sonnet属于Anthropic的中端主力模型,新版本的重点不是单纯把参数和能力继续往上堆,而是两个更实际的指标:更快、更省。

Anthropic将Sonnet 5.5定位为适合处理日常工作的AI助手,包括编程、制作办公文档等任务。

上一代Sonnet 5大约在三个月前发布。当时它最大的卖点就是适合大规模部署AI智能体,能够以低于部分竞争对手的成本,让智能体持续执行任务。

到了Sonnet 5.5,Anthropic把重点进一步转向速度。

公司称,新模型相比上一代速度提升约30%,同时Token消耗速度明显降低。这意味着在处理相同或类似任务时,Sonnet 5.5有望以更短时间、更低推理成本完成工作,对于大量调用AI的企业和智能体应用来说尤其重要。

在Anthropic自己的模型产品线里,Sonnet的绝对能力仍低于最高端的Opus,但这并不意味着实际任务中一定是Opus表现更好。

Anthropic公布的测试数据显示,在智能体编程任务上,Sonnet 5.5甚至超过了Opus 5.5。

截屏2026-09-29 10.35.59.png

其中一个可能原因是Sonnet更轻、更便宜,可以在成本限制范围内同时启动多个AI智能体协作完成任务。也就是说,在需要多智能体并行工作的场景中,一个更灵活、更低成本的模型,反而可能比单个更强但更昂贵的模型效果更好。

Sonnet 5.5的网络安全能力也有明显提升。

Anthropic表示,它的网络安全能力已经与上一代旗舰Opus 5大致相当。也正因为能力进一步增强,Sonnet 5.5成为首款需要执行与Fable和Opus相同网络安全防护措施的Sonnet模型。

这也反映出一个新的问题:当中端模型都开始具备较强的网络安全能力后,相关风险不再只属于最顶级的旗舰模型。

Anthropic还透露,将在未来几周发布新版Haiku。Haiku是公司产品线中体量最小、成本最低的一档模型,不过具体发布时间尚未公布。

过去一年,头部AI公司的模型发布速度明显加快。

就在上周,OpenAI连续发布了多个新模型,其中包括中端模型Sol和低成本模型Luna的增强版本。Meta也发布了一款新模型,并表示它将为即将推出的智能眼镜功能提供支持。

AI模型竞争正在从过去单纯比“谁的旗舰模型最强”,逐渐变成多条战线同时竞争:旗舰模型拼能力,中端模型拼速度和性价比,小模型拼部署成本,而智能体场景则越来越强调多模型、多智能体协同效率。

本文来自大风号,仅代表大风号自媒体观点。