大数跨境

Claude Sonnet 5.5 突袭发布:性能直逼 Opus,价格只要一半!

Claude Sonnet 5.5 突袭发布:性能直逼 Opus,价格只要一半! AI信息Gap
2026-09-29
9
导读:Claude Sonnet 5.5 突袭发布,GPT-6 Sol 被斩杀了?

Claude Sonnet 5.5 发布:编程能力反超 Opus,全面对标 GPT-6 Sol

继 Anthropic 于 6 天前发布 Claude Opus 5.5 后,今日正式推出 Claude Sonnet 5.5。此次发布时机颇具战略意味,正值 OpenAI DevDay 前夕,意在直接对标即将亮相的 GPT-6 Sol。

值得注意的是,在多项核心基准测试中,“中杯” Sonnet 5.5 的表现甚至超越了“大杯” Opus 5.5,展现出极强的竞争力。

编程与综合性能全面跃升

在衡量命令行复杂代码任务能力的 Terminal-Bench 4.0 测试中,Claude Sonnet 5.5 准确率达到 70.6%,高于开启最强推理等级(xhigh)的 Claude Opus 5.5(66.4%),更是远超上一代 Sonnet 5 的 10.3%。

根据 Anthropic 官方数据及第三方机构 Artificial Analysis 的评估,Sonnet 5.5 在多维指标上已超越上周发布的 GPT-6 Sol。在 AA Intelligence Index 智能指数排行榜中,Sonnet 5.5 以 56 分位列全球第二,仅比 Opus 5.5 低 2 分。

在实际工作任务评测 GDPval-AA(覆盖 44 个职业和 9 大行业)中,Sonnet 5.5 得分 1844,与 Opus 5.5(1846)几乎持平,显著高于 GPT-6 Sol 的 1487 分。

价格减半,效率显著提升

Claude Sonnet 5.5 的定价策略极具攻击性,其每百万 Token 的输入输出价格均为 Claude Opus 5.5 的一半,且与 GPT-6 Sol 完全一致。

每百万 token
Claude Sonnet 5.5 Claude Opus 5.5 GPT-6 Sol
缓存读取
0.20 美元
0.20 美元
0.20 美元
缓存写入
2.50 美元
5 美元
2.50 美元
输入
2 美元
4 美元
2 美元
输出
10 美元
20 美元
10 美元

Anthropic 表示,Sonnet 5.5 完成相同任务消耗的 Token 更少,实测单次任务成本较上一代降低 30%,输出速度提升 30%,是目前 Sonnet 系列中最快的模型。

Claude Sonnet 5 还在疯狂写代码,Claude Sonnet 5.5 早已完成等着了。

高得分背后的 Token 消耗争议

尽管性能优异,Artificial Analysis 指出,Claude Sonnet 5.5 在最高推理等级下,每个任务平均消耗约 19.3 万输出 Token,是此前测试模型中最高的,约为 GPT-6 Astra 的 7 倍。

这意味着其高分部分得益于更长的思考过程和输出长度。用户需在“节省 Token”与“追求高分”之间做出权衡。目前,Claude Code 和网页版默认推理等级为 medium,API 默认为 high,支持用户自行调节。

此外,为防止模型蒸馏,Anthropic 对 Sonnet 5.5 实施了与 Opus 5.5 相同的保护措施。

产品定位与上线情况

针对 Sonnet 5.5 与 Opus 5.5 性能接近的疑问,Anthropic 解释称,Opus 5.5 在处理复杂、开放及需长时间持续判断的任务上仍具明显优势,基准测试无法完全量化这一差距。

预计未来几周内,轻量级模型 Claude Haiku 5.5 也将发布。

目前,Claude Sonnet 5.5 已在 Claude、Claude Code、AWS、谷歌云和微软 Azure 全平台上线,模型 ID 为 claude-sonnet-5-5。

【声明】内容源于网络
0
0
AI信息Gap
各类跨境出海行业相关资讯
内容 1106
粉丝 0
AI信息Gap 各类跨境出海行业相关资讯
总阅读134.0k
粉丝0
内容1.1k