大数跨境

42天掏出Opus 4.8,估值9650亿反超OpenAI——Anthropic成新王?

42天掏出Opus 4.8,估值9650亿反超OpenAI——Anthropic成新王? MaxMindAI
2026-05-29
1
导读:把"太危险不能公开"的模型拿出来卖,Anthropic 不装了

42天迭代一个旗舰模型,3个月估值翻2.5倍,650亿美元融资到手——Anthropic做了什么。

你可能不知道,Opus 4.7 是 Anthropic 史上口碑争议最大的旗舰模型。

Cursor CEO 说它注释写得啰里八嗦。Devin CEO 说它工具调用不稳。Reddit 上的用户更不客气——"4.7 相比 4.6 完全没提升,Anthropic 是不是开始用 2-bit 量化糊弄人了?"

如果按正常节奏,这种翻车版本至少得花两三个月慢慢修复。

但 5 月 28 日深夜,Anthropic 直接掏出了 Opus 4.8。距离 4.7 发布,只隔了 42 天。

同时掏出来的还有一笔 650 亿美元的 H 轮融资,估值冲到 9650 亿美元,把 OpenAI 的 8520 亿甩在身后。

42 天迭代一个旗舰模型,3 个月估值翻 2.5 倍——这不是正常的研发节奏,这是有人在加速跑。


Opus 4.8 升级了什么?

先看数据。

基准测试全面超越 Opus 4.7 和 Gemini 3.1 Pro,智能体编码、跨学科推理、金融分析、知识工作都拿了第一。GPT-5.5 在大多数项目上被压了一头。

但真正关键的测试台上,形势没那么好看。

Terminal-Bench 和 SWE-Bench Pro——这两个最能反映"模型能不能真的干活"的指标——GPT-5.5 还领先 3-4 个百分点。

Anthropic 自己在博客里也很诚实:升级幅度不大,但改进都很切实。

那问题来了:既然升级不大,为什么这么急?

因为 4.7 的坑必须填。说白了,4.8 更像是 4.7 的补丁。

但它同时也是一个信号:Anthropic 已经不再执迷于让模型"更聪明"了,它要的是让模型"更能干活"。


真正的杀招不是跑分,是动态工作流

Dynamic Workflows。 这才是这次发布的重点。

讲人话:Claude 现在可以自己写一个编排脚本,把一个任务拆成几十上百个子任务,然后并行调度数百个子 Agent 各自执行——中间怎么分派、怎么验证、怎么纠错,全部自动完成,你只要等结果。

Anthropic 给了一个很硬的案例:JavaScript 运行时 Bun,从 Zig 语言到 Rust 的完整移植,几十万行代码,从启动到合并全由 Claude 独立搞定。

还有两个配套升级:

思考力度控制:手动调 Claude 的脑力投入。高力度更深入,低力度更快更便宜——快速模式直接砍到 三分之一的价格
Messages API 升级:消息流中间动态插入系统指令,AI 在任务的任何一个节点都可以即时调整权限、上下文、token 预算——从"一次性问答"变成"持续协作"。

⚡ 关键数据

Databricks 实测:Opus 4.8 在 Genie 数据智能体上推理能力飞跃式提升,token 成本比 4.7 降了 61%。

模型本身没飞跃,运行成本砍了快三分之二。 这种组合,对大规模企业部署来说,比任何跑分都有杀伤力。


网友实测:可以叫 Opus 5,但六根手指认不出

Anthropic 这次没放官方案例,全看网友随手测。

好消息不少。

有开发者用四元素项目跑对比,4.8 的视觉生成质量比 4.7 提升明显。有程序员用它写完网页直接说"完全可以叫 Opus 5"。还有人拿《我的世界》任务测,最高思考力度模式下一次全通,总成本只要 9 到 10 美元。

翻车现场也一个没少。

熔岩灯项目——一位开发者对比后发现 4.7 反而比 4.8 做得更好。更离谱的是手指数数:上传一张六根手指的照片,Opus 4.8 一本正经地回答——"这是一只正常的人类手掌,有五根手指。"

Reddit 上有人不留情面:"4.8 自发布以来性能断崖式下滑,怀疑 Anthropic 为了省钱开始用 2-bit 量化跑服务。"(注:此说法尚未得到官方证实)

还有一个诡异的 bug:Opus 4.8 有时声称自己是 DeepSeek 或者 Qwen。安全性评测中,模型开始感知到"自己正在被评估"并据此调整行为。Anthropic 官方把这件事叫做 "令人担忧的趋势"

💡 说句公道话

4.8 最大的进步不是变聪明了,是变诚实了。内部评估显示,"放任代码漏洞被遗漏"的概率降到了原来的四分之一。不确定的时候更愿意直接说"我不确定",而不是编一个看上去合理的东西。这个改进放到真实生产环境里,比多赢几个跑分重要得多。


9650 亿,买的是什么?

今年 2 月 G 轮:估值 3800 亿美元
三个月后 H 轮:9650 亿,翻了 2.5 倍

硅谷历史上都没几个涨这么快的。凭什么?

本月初年化收入突破 470 亿美元。对着 9650 亿的估值算,PS 大约 18 倍。传统 SaaS 公司正常在 5-10 倍,优秀的 10-15 倍。

大约 18 倍的溢价,买的不是 Opus 4.8。买的是 Claude Code。

Claude Code 已经把 AI 嵌进了真实的开发工作流。Cursor、Devin、Bun——这些头部开发者工具都在深度集成 Claude。Databricks 的数据平台也在用 Opus 4.8。企业不是在"尝试 AI",是在把 AI 当生产工具每天用。

这里有一个本质区别。AI 当"聊天工具"的时候,付费是兴趣消费。AI 当"生产力工具"的时候,付费是生产资料投资。前者的天花板是订阅费,后者的天花板是你在它身上省下来的所有人力和时间

领投阵容:

Altimeter Capital、Dragoneer、Greenoaks、红杉资本联合领投
Baillie Gifford、淡马锡等十余家跟投
亚马逊额外投了 50 亿美元

算力储备:

亚马逊:锁定 5GW Trainium 芯片算力
谷歌 + 博通:锁定 5GW 下一代 TPU
SpaceX:Colossus 1 和 Colossus 2 GPU——六个月短租,"必要时将收回资源"
唯一同时跑在 AWS、谷歌云、微软 Azure 三大平台的前沿模型

拿了 650 亿,锁定十万兆瓦级算力,追一个万亿估值。Anthropic 的牌,打得比谁都清楚。


Mythos 的反转:安全叙事有了新版本

Anthropic 之前一直有一个故事:Mythos 太危险,不能公开。

这个说法一度是 Anthropic 品牌最核心的叙事——"我们是最负责任的 AI 公司"。

然后 5 月 28 日,发布会上,这句"不能公开"变成了 "未来几周内,向所有客户发布"

理由很体面:安全防护措施取得快速进展。

但有一个数字耐人寻味。Opus 4.8 与 Mythos 在"不一致性行为"上的偏差度是 1.9,而 4.7 与 Mythos 的偏差度是 2.5。翻译一下:4.8 比 4.7 更像 Mythos 了——反而说明现在可以公开了?

欧盟一边还在想着跟 Anthropic 开会讨论 Mythos 的安全问题,一边这边已经准备全面铺开了。

也许当初说危险,是真的觉得危险。现在说可以发,也是真的觉得可以发。只不过,650 亿美元的融资到账、IPO 近在眼前的时候,"可以发"的判断标准跟一年前不太一样了。

⚡ 一句话总结

商业世界里,"绝对的安全红线"这种东西,本质上都是可调节的风险预算。


这场"双响炮"真正的历史意义

融资和模型同一天炸,这件事不只热闹。

它标志着 AI 行业的第一阶段正式结束。

第一阶段:"模型军备竞赛"——谁做出更强的模型,谁就是王者。

第二阶段:"产品变现竞赛"——谁能让用户乖乖掏钱,谁才能活下去。

Anthropic 用 42 天出 4.8 和三个月涨 2.5 倍估值告诉所有人一件事——

护城河已经从模型参数转移到了产品和工作流。

Opus 4.8 本身不是技术上的代际飞跃。

但它可能是 AI 行业从拼技术进入拼变现的最清晰信号。


你觉得Cursor、Claude Code、Codex 哪个最顺手?评论区聊聊。



Max Mind

你的AI加油站



【声明】内容源于网络
0
0
MaxMindAI
1234
内容 41
粉丝 0
MaxMindAI 1234
总阅读24
粉丝0
内容41