大数跨境

刚刚,Claude Haiku 5.5发布!价格暴降90%

刚刚,Claude Haiku 5.5发布!价格暴降90% 新智元
2026-10-08
5

新智元报道

Anthropic 正式发布 Claude Haiku 5.5。该模型定价极具竞争力,单价仅为上一代 Haiku 4.5 的 1/10、Sonnet 5.5 的 1/20,与 OpenAI 的 GPT-6 Luna 持平。

在官方基准测试中,Haiku 5.5 在 Luna 参与评分的六项指标中全面胜出,部分关键指标甚至紧咬高端模型 Sonnet 5.5。

  • OSWorld(电脑操作):从 15.7% 跃升至 72.4%,与 Sonnet 5.5 仅差 11.5 个百分点
  • Terminal-Bench 4.0(终端编程):从 0 分突破至 39.2%
  • GDPval-AA(知识工作):得分 1620,较上一代翻倍
  • HLE(人类最后的考试,无工具):从 10.2% 提升至 45.9%

实际成本分析:效率提升显著

Haiku 5.5 的定价策略如下(提示长度在 10 万 Token 以内):

  • 输入:每百万 Token 0.10 美元
  • 输出:每百万 Token 0.50 美元

若超过 10 万 Token,输入价格为 0.50 美元/百万,输出为 2.50 美元/百万。缓存读取价格为 0.01 美元/百万,批处理可享五折优惠。

官方测算显示,完成相同任务平均比 Haiku 4.5 节省约 75% 的成本,同等预算下调用量可提升四倍。未能达到 90% 的降幅主要源于两点:一是长文本请求降价幅度较小,二是新分词器导致同等内容 Token 数增加约 30%。

与 GPT-6 Luna 相比,双方在 10 万 Token 以内的输入、输出及缓存价格完全一致。但在长上下文场景下,Luna 更具优势,其涨价阈值约为 27 万 Token,且涨价后价格仍低于 Haiku 5.5。

此外,Sonnet 5.5 的缓存读取价格同日减半,从 0.20 美元降至 0.10 美元/百万 Token,预计多数 Agent 任务成本可降低 20% 左右。

订阅福利方面,Max 和 Team 订阅用户本月起将获得 API 额度:Max 5x 赠送 100 美元,Max 20x 赠送 200 美元,Team 套餐最高赠送 500 美元(团队共用),适用于 Claude Platform 所有模型。

性能评测:超越 Luna,复杂编程仍逊于 Sonnet

Haiku 5.5 在多项基准测试中实现巨大飞跃,尤其在电脑操作和知识工作领域表现亮眼。

电脑操作能力:在 OSWorld 测试中,Haiku 5.5 得分为 72.4%,大幅领先同价位的 Luna(48.9%),差距达 23.5 个百分点。即使在中等算力档位下,其性价比也远超 Luna 满档表现。

知识工作能力:在 GDPval-AA 测试中,Haiku 5.5 得分 1620,优于 Luna 的 1437,但距离 Sonnet 5.5 的 1840 仍有差距。在长线项目测试 AA-Briefcase 中,Haiku 5.5 从 614 分提升至 1578 分,同样超过 Luna 的 1336 分。

推理与图表识别:在启用搜索和代码工具的 HLE 测试中,Haiku 5.5 得分为 57.4%,Sonnet 5.5 为 64.5%。在专业图表识别 Chartography 测试中,Haiku 5.5 从 6.4% 飙升至 46.4%,远超 Luna 的 29.1%,但不及 Sonnet 5.5 的 61.6%。

编程能力:这是 Haiku 5.5 与 Sonnet 差距最大的领域。在 Terminal-Bench 4.0 中,Haiku 5.5 得分 39.2%,虽是 Luna(16.4%)的两倍多,但远低于 Sonnet 5.5 的 70.6%。在 FrontierCode 测试中,Haiku 5.5 得分为 46.4%,略胜 Luna 的 42.4%,但与 Sonnet 5.5 的 52.1% 仍有近 6 个百分点的差距。官方建议复杂 Agent 编程任务仍由 Sonnet 5.5 或 Opus 5.5 处理。

应用场景:高频、低延迟任务的首选

官方定位:Haiku 5.5 专为高吞吐量、低延迟、低成本场景设计,适用于摘要生成、上下文压缩、数据库查询及分类任务。作为目前最快的 Claude 模型,其速度仅次于开启快速模式的 Opus,非常适合实时客服和浏览器自动化操作。

多家 AI 应用公司的内测反馈证实了其性能优势:

  • Asana:任务完成延迟降低 30% 以上
  • Box:延迟仅为 Haiku 4.5 的一半

作为子 Agent 协同工作:Haiku 5.5 常被用作 Opus 或 Sonnet 的子代理,由大模型负责拆解任务和决策,Haiku 负责执行具体步骤。例如,Cognition 的 Devin Fusion 采用 Opus 5.5 为主力、Haiku 5.5 为副手的架构,在保持 FrontierCode 66.2 分顶级水平的同时,显著降低了成本和延迟。

金融 AI 公司 Rogo 利用 Haiku 5.5 从 10-K 财报中提取分部营收数据以制作 PPT,展现了其在数据处理方面的效率。

在 Claude 开发者演示中,一项“设计鸡蛋保护架”的任务对比显示:Opus 5.5 单独运行耗时 3 分 37 秒,尝试 25 种方案,花费 0.47 美元;而搭配 10 个 Haiku 5.5 子 Agent 后,耗时缩短至 58 秒,尝试 86 种方案,花费仅 0.14 美元。

Haiku 5.5 使用指南与技术细节

Haiku 5.5 现已在 Claude 客户端、Claude Code 以及 AWS、谷歌云、微软 Azure、Cursor、OpenRouter 等平台上线。模型 ID 为 claude-haiku-5-5,支持 100 万 Token 上下文,单次最大输出 12.8 万 Token。

新功能与调整:

  • 思考档位:Haiku 系列首次引入思考强度调节,分为 Low 至 Max 五档,API 默认为 Medium。
  • SDK 更新:Python 和 TypeScript SDK 新增电脑操作和浏览器操作功能(Beta 版)。
  • 迁移注意:从 Haiku 4.5 迁移时,因分词器变化,同等文本 Token 数增加约 30%,需重新评估 max_tokens 和成本。
  • 参数变更:budget_tokens 替换为自适应思考加 Effort 档位;移除 temperature、top_p、top_k 参数;不再支持预填回复,格式要求改用结构化输出。
  • 工具集更新:电脑操作需切换至新工具集 computer_toolset_20260801,暂不支持 Priority Tier。

开发者可在 Claude Code 中运行以下命令自动迁移项目:

/claude-api migrate this project to claude-haiku-5-5

对于非开发者用户,可直接在 Claude 客户端中与 Haiku 5.5 对话。即使是 Low 档位,它也能准确、快速地回答简单问题,是替代搜索引擎的理想选择。

参考资料:
https://www.anthropic.com/claude-haiku-5-5

编辑:马可 摩西

【声明】内容源于网络
0
0
新智元
智能+中国主平台,致力于推动中国从互联网+迈向智能+新纪元。重点关注人工智能、机器人等前沿领域发展,关注人机融合、人工智能和机器人革命对人类社会与文明进化的影响,领航中国新智能时代。
内容 16601
粉丝 0
新智元 智能+中国主平台,致力于推动中国从互联网+迈向智能+新纪元。重点关注人工智能、机器人等前沿领域发展,关注人机融合、人工智能和机器人革命对人类社会与文明进化的影响,领航中国新智能时代。
总阅读440.6k
粉丝0
内容16.6k