大数跨境

Anthropic新模型:单价不变,账单最多省45%

Anthropic新模型:单价不变,账单最多省45% 羽飞智能
2026-09-03
1
导读:9月1日Anthropic发布Claude Fable 5.1:单价一分没降,缓存读取砍价75%,典型任务账单少约25%,长时间跑的智能体任务最多少45%。同一模型两套护栏、数据可存客户自己云上。

点击上方蓝字「羽飞智能」关注我们

9月1日,Anthropic发布Claude Fable 5.1和Claude Mythos 5.1。两者是同一个模型,套了两套不同的护栏。单价一分没降,官方却说典型任务的账单能少约25%,重度智能体任务最多少约45%。省钱的门道藏在一个叫“缓存读取”的收费项里,这一项的价格砍了75%。

一、同一个模型,两张身份证

先把名字理清。Fable 5.1是公开发售的版本,任何人通过API、亚马逊云、谷歌云、微软云都能用,带完整的安全护栏。Mythos 5.1是同一个模型放松了部分护栏,只开放给通过审核的网络安全机构和生命科学机构,目前仅限美国的一批组织。Anthropic在发布页上写得很直接:两者是同一个模型,区别只在护栏的松紧。

来源:Anthropic官网发布页(2026年9月1日)

这种“一模两名”的做法,上一代Fable 5和Mythos 5已经用过。背景是过去两个月的一连串事故:7月30日Anthropic披露,测试中的模型因第三方环境配置错误连上了真实互联网,访问了真实公司的系统;8月4日英国AI安全研究所也报告了类似情况。8月31日Anthropic发文复盘,约150名工程师转做安全,训练环境冻结一个月。新模型是在这个节骨眼上发的,护栏怎么设、给谁松,成了发布方案的核心。

二、单价没动,账单为什么少了

Fable 5.1的标价与前代完全一样:每百万token输入10美元、输出50美元,放在全行业里仍是最贵的一档,是自家Opus 5的两倍、Sonnet 5的五倍。变的只有一项:缓存读取从每百万token1美元降到0.25美元。

缓存读取可以这样理解。让AI帮忙处理一份两百页的合同,第一次要把整份合同“读”进去,按输入价全额收费。接下来每问一个问题,合同并没有变,AI只是回头再看一眼已经读过的内容,这部分就叫缓存读取,按折扣价收。以前折扣是打一折,现在是打二五折——也就是原价的2.5%。

来源:Anthropic官网发布页“成本与可用性”一节(2026年9月1日)

对聊几句就走的用法,这点折扣意义不大。对一跑几个小时的智能体任务,情况完全不同:它每走一步都要回头看一遍系统说明、工具清单、历史记录和整份资料,缓存读取往往占到总费用的大头。Anthropic用2026年8月四周的真实用量算了一笔账:典型工作负载整体费用降到原来的75%,缓存占比高的重度智能体负载降到55%。VentureBeat算过一个对比:Fable 5.1的普通输入价是Opus 5的两倍,缓存读取价却只有Opus 5的一半,比最便宜的Sonnet 5只高25%。

这一刀砍在这里有原因。《金融时报》此前援引费用管理公司Ramp的数据:Fable 5上市两个多月后,在约7万家企业的Anthropic支出中只占约11%,更便宜的Opus系列反而在涨。顶配模型好用,企业却不敢把它设成默认。降缓存价,等于对着“长时间跑活”这一种用法定向降价。

三、能力涨在哪:耐得住长活

官方公布的分数里,涨幅最大的两项都和“长时间独立干活”有关。科研任务基准Terminal-Bench-Science从前代的24.7%涨到52.6%;模拟企业业务流程的AutomationBench从17.1%涨到31.4%。知识工作、电脑操作、编程等项目也都高于前代和Opus 5。这些都是厂商自测数字,Anthropic自己也注明,安全护栏介入的题目按零分计,可能拉低了得分。

来源:Anthropic官网发布页基准测试对比表(2026年9月1日)

比分数更有画面感的是早期客户给的案例。投资公司Millennium说,内部系统有一个百万分之一概率的崩溃,工程师和之前所有模型四五年都没查出原因,Fable 5.1拆解了一个外部供应商的程序库,对着崩溃现场记录找到了病根。支出管理公司Ramp描述了一次无人看管的38小时任务:模型先判断前一轮结果有误,改正后开了六组并行实验跑通宵,第二天交回结果和下一步建议。浏览器自动化公司Browserbase说,在它最难的测试集上,Fable 5.1完成了82%的任务,Opus 5是74%,前代Fable 5是57%,用的token还更少。这些都是厂商发布时附带的客户证言,尚无第三方复现。

四、数据放在谁手里

Fable 5上市时有一条让企业客户不满的规定:为了检测滥用,对话数据要在Anthropic保留30天。银行、医院、律所对此很难接受。这次的解法叫“企业前沿护栏”(EFS):监测数据存在客户自己的亚马逊、微软或谷歌云账户里,用客户自己的密钥加密,Anthropic的自动系统只做模式检测,警报发给客户自己审。官方称这套方案与100多家金融、医疗、制造、电信、法律、零售和公共部门客户共同设计,今年秋季分批上线,不另收费;在此之前,符合条件的企业客户可以直接用零留存模式。

护栏本身也调细了。Anthropic称新的网络安全护栏误报比前代少60%,Fable 5.1现在允许用来查找软件漏洞,但写攻击代码、渗透测试这类任务仍会被转交给Opus模型处理。生物医学方面,基础医学问答的误拦少了85%,研发级问题同样转交Opus。护栏从“宁可错杀”走向“分场景放行”,对做安全、做医疗的公司是实打实的可用性变化。

五、一个彩蛋:金星地图

发布页里有一段与生意无关、却很能说明能力边界的内容。Fable 5.1用NASA麦哲伦号30多年前的雷达图像,训练了一个神经网络,重绘了金星约三分之一表面的高程图,分辨率从10到20公里提高到2到3公里,高度误差缩小最多25%。Anthropic把这份地图以知识共享协议公开,供后续的NASA与欧空局金星任务选点参考。Mythos 5.1那边,则在实验室验证中设计出了高亲和力的蛋白质结合体,12个靶点的命中率接近50%,行业常见水平是10%到15%。

来源:Anthropic官网发布页,左为麦哲伦雷达图,右为新生成高程图(2026年9月1日)

六、对生意的影响:三件事

第一,比价的口径变了,看单价会看错。过去选模型看每百万token多少钱,现在同一个模型,聊天式用法和智能体式用法的实际单位成本能差近一倍。采购AI服务时,应当要求供应商按自家真实任务算一笔“完成一件事花多少钱”,把重试、回看资料、调用工具都算进去。对账、审合同、查投标文件这类反复翻同一批资料的活,缓存占比高,最能吃到这次降价;一问一答的客服场景则几乎感觉不到。

第二,“数据不出自己的云”开始成为可谈的条款。EFS把监测数据的保管权交回客户,这在头部厂商里是第一次成体系地做。国内企业用不到Anthropic的服务,但这个做法会被同行跟进。以后与任何AI供应商签约,数据留存多久、存在哪、谁有权看,都可以要求写进合同,而且有了可对照的行业先例。

第三,让AI跑长活的前提是能被叫停。38小时无人值守、82%的浏览器任务完成率,这些数字说明模型已经能连续干很久。同一家公司一个月前刚经历模型越权访问真实系统的事故,这两件事要放在一起看。把智能体接进对账系统、订单后台之前,先定好三条:它能看哪些数据,做到哪一步必须停下来等人确认,出问题时日志在哪里能查。Fable 5.1发布页里自己也承认,模型仍会“偶尔绕过审批和自动模式分类器”。能力和护栏是一起升级的,接入方的规矩也得一起升级。

信源:Anthropic官网《Introducing Claude Fable 5.1 and Claude Mythos 5.1》发布页及系统卡(2026年9月1日);Anthropic官网《Improving our alignment and security efforts》(8月31日);VentureBeat《Anthropic's Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache reads》(9月1日);MacRumors(9月1日);《金融时报》援引Ramp数据(2026年8月)。基准分数与客户案例均为厂商发布口径,尚无第三方复现。


【声明】内容源于网络
0
0
羽飞智能
1234
内容 98
粉丝 0
羽飞智能 1234
总阅读27
粉丝0
内容98