Hi~新朋友,记得关注我们哟
在推出 Claude Fable 5 之后,Anthropic 曾经的旗舰 Opus 系列一度前景不明。如今,该系列强势回归,升级为一款兼具强大能力与日常实用性主力模型。
最新消息:Claude Opus 5 正式发布
●核心参数:Anthropic 发布了视觉 - 语言模型 Claude Opus 5。相比 Claude Fable 5,其运行成本更低,且在多项任务中表现更优。
✴ 输入/输出:支持文本和图片输入(最大 100 万 token),文本输出(最大 12.8 万 token,速度 52.8 token/秒)。
✴ 知识截止:2026 年 5 月。
✴ 主要特性:提供五档推理等级(low 至 max,默认 high);支持工具调用及提示缓存(512 token 起);新增快速模式(速度约为标准版 2.5 倍,仅限 API);承诺无数据保留。
✴ 性能表现:在 Artificial Analysis Intelligence Index 中以 61 分位居榜首;在衡量智能体陌生环境学习效率的 ARC-AGI-3 测试中大幅领先。
✴ 可用性/定价:作为 Claude Max 订阅者($100-$200/月)的默认模型,也是 Claude Pro($20/月)可用的最强模型。API 价格:标准模式输入/缓存/输出为$5/$0.50/$25 per 1M tokens;快速模式为$10/$1/$50 per 1M tokens。
✴ 未披露信息:参数量、具体架构、训练数据及方法。
运作方式与安全机制
Anthropic 仅披露了少量构建细节,主要集中在训练数据来源与模型控制策略:
✴ 训练数据:结合公共网络数据、专有数据及其他模型生成数据进行训练,并依据公司宪章定义的人类价值观进行微调。网络安全任务被有意排除在训练之外。
✴ 智能体行为:模型更善于自主委派子任务及自我检查。开发者需调整早期模型的验证指令,避免导致 Opus 5 过度验证。
✴ 安全回退机制:涉及网络安全风险的交互将回退至 Claude Opus 4.8,但触发频率低于 Fable 5。系统通过探针实时读取内部激活状态,由第二模型判断输入输出安全性(涵盖记忆、文件、搜索结果等)。日常防御性工作(如代码漏洞扫描)被允许,但进攻性请求(如生成漏洞利用)会触发回退。此外,生物、化学及生命科学类问题不再像 Fable 5 那样频繁回退,因评估认为 Opus 5 在此类领域风险较低。
性能基准测试
Claude Opus 5 在多项基准测试中领跑,单次任务成本低于 Fable 5,但在陌生环境中的学习能力优势最为显著。
✴ 综合能力与成本:在 Artificial Analysis Intelligence Index(9 项经济实用任务)中,Opus 5(max 模式)得分为 61 分,略高于 Fable 5(60 分)及 GPT-5.6 Sol(59 分)。成本方面,Opus 5 平均每项任务$2.03,介于 Fable 5($2.75)与 GPT-5.6 Sol($1.54)之间。在 Coding Agent Index 上,Opus 5(xhigh 模式)与 GPT-5.6 Sol(max 模式)并列第一(67 分)。此外,在 GPTval-AA v2、AA-Briefcase 及 MMMU-Pro 等多模态与智能体任务中也全面优于竞品。
✴ 陌生环境学习:在 ARC-AGI-3 测试中,Opus 5(high 模式)得分 30.2%(成本$2.07 万),是次优模型 GPT-5.6 Sol(7.8%,成本$2.51 万)的近四倍。
✴ 工作流自动化:在 Terminal-Bench 3.0(业务工作流)中完成率达 43.5%;在 Zapier AutomationBench(计算机自动化任务)中成功率为 26.2%,均居首位。
✴ 编程能力:在 CursorBench 3.2 中,Opus 5 得分 70%(单项成本$8.23),仅次于 Fable 5 的 70.5%(单项成本$17.32),性价比显著提升。
新闻背景与行业影响
此前,美国白宫科学顾问迈克尔·克拉齐奥斯指控 Moonshot AI 通过蒸馏 Claude Fable 5 打造了开源模型 Kimi K3,财政部长斯科特·贝森特甚至威胁实施制裁。然而,Laude Institute 研究员 Braden Hancock 指出,Fable 5 公开时间极短,技术上不足以完成数据蒸馏、训练及发布全流程,该指控缺乏事实依据。
重要原因:解决用户痛点
Claude Opus 5 的推出直击长期用户对 Fable 5 的核心担忧:包括对良性科学问题的过度拒答、订阅门槛高、价格昂贵以及严苛的 30 天数据保留政策。尽管 Fable 5 在事实回忆和抗幻觉方面仍具优势,且部分基准测试尚未完全体现两者差异,但 Opus 5 凭借更高的性价比和更友好的策略,已成为大多数开发者的首选更新。
行业观察:逆向而行的战略
尽管 Opus 5 较前代更便宜,但其绝对成本依然高昂。在其他实验室竞相追求“更快、更省”之际,Anthropic 选择了相反路径:打造更大、更慢、知识更密集且昂贵的模型。这表明该公司押注于网络安全、软件工程及文档生成等高价值领域,坚信客户愿为高质量推理支付溢价,甚至在需要极速响应时接受双倍费用。

