Claude Sonnet 5.5 正式发布。此前发布的 Claude Opus 5.5 虽然性能最强,但价格昂贵且额度消耗极快,用户急需一款性价比更高的替代方案。
Sonnet 5.5 的价格是 Opus 5.5 的一半,也是目前 Claude 5 系最便宜的模型。官方还透露更便宜的 Haiku 将在几周内发布。与上一代 Sonnet 5 相比,价格不变,但完成同样任务可节省 30% Token,生成速度提升 30%。
从定价来看,Sonnet 5.5 直接对标 GPT-6 Sol,两者价格完全相同。

根据第三方 Artificial Analysis 数据,Sonnet 5.5 在各个推理级别均超越 GPT-6 Sol,同时也优于 Kimi K3、Opus 5 和 Claude Fable 5.1。

在 Max 档位下,Sonnet 5.5 优势明显。其他档位对比中,只有 Medium 档两者接近,因此使用 Sonnet 5.5 建议至少从 High 档起步。
性能接近旗舰 Opus 5.5
官方基准测试数据显示,Sonnet 5.5 在关键指标上已接近 Opus 5.5,部分项目甚至超越。

Terminal-Bench 4.0测试命令行多步骤任务,Sonnet 5.5 表现甚至超过 Opus 5.5(官方注明 Opus 用的是 Xhigh 档最高成绩)。
CursorBench 4.0测真实编码任务,Sonnet 5.5 拿到 55.5%,接近 Opus 5.5 的 57.8%。这是它能接手 Claude Code 日常工作的主要依据。
GDPval-AA 知识工作评估涵盖 44 个职业和 9 个行业,Sonnet 5.5 仅比 Opus 5.5 低 2 分,而 GPT-6 Sol 落后近 20%。
电脑操控能力提升 40%,已与 Opus 5.5 持平,在这方面同样表现出色。
第三方 Artificial Analysis 智能指数显示,Sonnet 5.5 的 Max 档已超过 GPT-6 Astra,High 档接近 GPT-6 Sol 的 Max 档。

值得注意的是,不同档位之间的性能差异明显。从 Medium 到 High、再到 X High,每升一档的提升幅度比 Opus 5.5 更大——Opus 5.5 到了 High 档之后后续档位变化不大。不过这里对比的是 GPT-5.6 而非 GPT-6 Sol。

在知识工作方面,Sonnet 5.5 的 Medium 档已达到 GPT-6 Sol 的天花板级别,综合性价比使其成为"打工人的新旗舰"。

总体来看,Claude Sonnet 5.5 以 Opus 5.5 一半的价格提供了接近旗舰的性能表现。对于需要大量调用 AI 的日常编码和知识工作场景,Sonnet 5.5 的性价比优势非常明显。如果 Opus 5.5 太贵,Sonnet 5.5 是目前最务实的选择。