Claude Fable 5.1 连夜发布:性能翻倍,仍是"token 刺客”
北京时间凌晨 2 点,Anthropic 正式发布新一代模型 Claude Fable 5.1。该模型与仅限特定机构使用的 Claude Mythos 5.1 同属一个底层架构,主要区别在于安全护栏的严格程度。Fable 5.1 面向所有用户开放,而 Mythos 5.1 仅对通过审核的网络安全及生命科学机构开放。
目前登录 Claude 即可看到更新弹窗。此次快速迭代旨在解决三个月前 Claude Fable 5 因安全分类器过度敏感引发的争议。此前版本常将正常编程任务误判并降级至旧版 Opus 模型,导致开发者体验断裂。市场数据也显示,Fable 5 发布两个多月仅贡献 Anthropic 总收入的 11%,而性价比更高的 Claude Opus 4.8 份额则从 15% 升至 50%。
基准测试:生产环境下的绝对王者
Anthropic 此次公布了包含生产环境安全护栏在内的实测成绩,被拦截任务直接计为零分。结果显示,Claude Fable 5.1 在多项关键指标上大幅领先竞品 GPT-5.6 Sol。
在由全球专家构建的 Terminal-Bench-Science 0.1 测试中,涵盖生命科学、物理、数学等复杂科研流程,Claude Fable 5.1 准确率达 52.6%,不仅是上一代 Fable 5(24.7%)的两倍有余,也显著优于 Claude Opus 5(29.0%)和 GPT-5.6 Sol(22.4%)。
编程能力方面,Terminal-Bench 4.0 测试中 Fable 5.1 得分 55.8%,远超 GPT-5.6 Sol 的 37.3%。若移除安全护栏,Mythos 5.1 得分可达 60.9%,差值即为被拦截部分。在企业级办公自动化测试 AutomationBench 中,Fable 5.1 得分 31.4%,同样实现了对前代产品的翻倍超越。
定价策略:缓存降价难掩高昂成本
Claude Fable 5.1 依然是市面上最昂贵的模型之一,仅次于 OpenAI 的 GPT-5.5 Pro。其 API 基础定价与前代持平:输入 10 美元、输出 50 美元/百万 tokens。唯一调整是将缓存读取价格从 1 美元大幅下调至 0.25 美元/百万 tokens,降幅达 75%。
对于智能体(Agent)场景,由于上下文长、工具调用频繁,缓存成本占比较高。据 Anthropic 测算,新版本综合成本较 Fable 5 降低约 25%,最高可达 45%。然而,对于纯 API 调用或非重度缓存场景,Fable 5.1 依旧是"token 刺客”。此外,订阅用户权益未变:Pro 用户仍无法使用 Fable 系列,Max 用户的 Fable 额度上限仍为周额度的 50%。
安全机制:误判减少但依然敏感
官方数据显示,Fable 5.1 在网络安全方向的误判率降低了 60%,触发降级至 Opus 的次数减少了 55%。新版本已支持在源代码中查找安全漏洞,但渗透测试和漏洞利用尝试仍会被强制回退。
实际测试表明,其敏感度依然较高。即便进行常规资料搜索,仍可能触发安全分类器标记并自动降级。社区反馈指出,模型存在“双重标准”现象:生成代码时允许 unsafe 操作,但在审查同一代码时却触发安全回退,导致工作流中断。
反蒸馏策略:新增三重限制
为防止模型思维链被蒸馏提取,Anthropic 对 Fable 5.1 实施了三项严格限制:一是强制工具调用直接返回 400 错误;二是推理过程单向传递,新模型可读旧模型数据,反之不可;三是编辑历史消息会导致后续请求报错(该限制目前仅针对 8 月 31 日后注册的新账号)。
值得注意的是,Anthropic 官方公告明确标注"Made with Claude Fable 5.1",意味着新模型参与了自身宣发内容的撰写。
继 Astra 实测泄露后,Claude Fable 5.1 的突袭发布标志着 AI 大模型竞争进入新阶段。

