大数跨境

Claude新Haiku发布!暴击GPT-6 Luna,比梁文谷还便宜,OpenAI只能送重置卡挽尊

Claude新Haiku发布!暴击GPT-6 Luna,比梁文谷还便宜,OpenAI只能送重置卡挽尊 量子位
2026-10-08
4
导读:小模型新守门员

Claude Haiku 5.5发布:性能超越竞品,定价对标GPT-6 Luna

Claude Haiku 5.5正式发布,标志着小模型领域的重大突破。在基准测试中,Haiku 5.5不仅超越了DeepSeek V4.1 Flash和GLM-5.3-Flash,成为新的小模型性能标杆,更在各项指标上全面优于GPT-6 Luna。

官方数据显示,Haiku 5.5旨在直接竞争GPT-6 Luna,并在多项测试中取得领先。随着传统测试趋于饱和,最新的“奔跑斑马”等前沿测试也验证了其强劲实力。

价格策略与成本控制

Haiku 5.5的定价策略极具竞争力,直接对标GPT-6 Luna。相较于一年前发布的Haiku 4.5,新版价格在特定条件下大幅降低。

具体优惠条件如下:

  • 提示词在10万token以内(覆盖约90%的请求场景):输入输出价格降低90%。
  • 超过10万token的部分:价格降低50%。

在此策略下,除缓存命中输入外,Haiku 5.5在处理100k以内提示词时的成本甚至低于DeepSeek-V4.1 Flash的谷时价格。测试显示,Haiku 5.5具备通过控制台脚本注入内容等高级计算机操作能力,而非简单的HTML编辑。

至此,Anthropic模型矩阵分工明确:Opus 5.5负责复杂推理,Sonnet 5.5负责通用执行,Haiku 5.5专注于高并发与速度。这种激烈的市场竞争态势,类似于英特尔与AMD在CPU领域的角逐。

Tokenizer变更带来Token消耗增加

Haiku 5.5是首款支持effort调节的Haiku模型,提供从Low到Max五档配置。其在计算机操作和编码能力上相比上一代有显著提升。

在OSWorld 2.1测试中(评估Agent在真实电脑环境中完成多步任务的能力):

  • Haiku 5.5 Low档:准确率42.0%,单次成本$0.07。
  • Haiku 5.5 Max档:准确率72.4%,单次成本$0.61。
  • Haiku 4.5 Max档:准确率仅15.7%,单次成本$1.45。

数据显示,Haiku 5.5的Low档不仅在准确率上远超4.5的Max档,成本还降低了一半。

在GDPval-AA v2.1测试中(涵盖44种职业的真实专业工作),Haiku 5.5同样表现优异:Low档Elo得分1125(成本$0.01),Max档Elo得分1620(成本$0.87),而4.5 Max档仅为735(成本$0.24)。

需要注意的是,Haiku 5.5采用了与Sonnet 5.5、Opus 5.5相同的Tokenizer。虽然API单价降低,但同等任务消耗的Token数量增加,尤其是代码、表格及非英语内容,Token膨胀现象较为明显。因此,实际节省的成本可能低于名义上的折扣,完成任务的平均成本并未达到理想区间。

定位明确:无法替代Sonnet,需注意迁移兼容性问题

尽管Haiku 5.5性能提升显著,但在复杂任务上仍无法替代Sonnet 5.5。在Terminal-Bench 4.0测试中,Haiku 5.5得分为39.2%,而Sonnet 5.5高达70.6%。在复杂多步编码、跨文件重构及长周期自主规划等方面,两者差距明显。Anthropic建议,复杂Agent编码任务应优先使用Sonnet 5.5或Opus 5.5。

Haiku 5.5的核心价值在于执行层,适用于任务已拆解、验收标准明确且可并行处理的场景。例如,Cognition的Devin项目采用Opus 5.5作为主模型,Haiku 5.5作为子智能体,组合效果优于单一模型。

迁移至Haiku 5.5的五项关键变动

从Haiku 4.5迁移至5.5并非简单替换模型名称,开发者需注意以下五大变动,否则可能导致请求报错或返回异常:

  1. 思考配置变更:手动设置budget_tokens将直接报错,需改为自适应思考配合effort参数。
  2. 采样参数锁定:temperature、top_p、top_k均锁定为默认值,依赖这些参数进行创意控制的应用需调整逻辑。
  3. 取消预填充:Assistant消息预填充功能被移除,此前依靠预填充强制JSON开头的写法需改用工具调用或结构化输出接口。
  4. 计算机工具更新:工具版本从computer_20250124升级为computer_toolset_20260801,接口格式及返回结构均有变化。
  5. 自适应思考默认开启:响应的第一个内容块可能是思考块而非正文,解析逻辑需根据type字段进行过滤。

Anthropic已提供详细迁移指南,建议在切换前仔细核对。

其他福利与行业动态

除了Haiku 5.5,Anthropic还推出了两项利好措施:

  • Sonnet 5.5缓存降价:缓存读取价格从$0.20/M降至$0.10/M,预计大多数Agent任务成本可降低约20%。
  • 订阅用户API额度:Max和Team订阅用户可领取API额度用于实验。Max 5x用户每月$100,Max 20x用户每月$200,Team用户最多每月$500(团队共享)。所有模型通用。

与此同时,竞争对手OpenAI也采取了应对措施,为用户提供了重置卡福利。

【声明】内容源于网络
0
0
量子位
各类跨境出海行业相关资讯
内容 16506
粉丝 1
量子位 各类跨境出海行业相关资讯
总阅读470.6k
粉丝1
内容16.5k