大数跨境

刚刚,Fable 5.2也曝光了!

刚刚,Fable 5.2也曝光了! 新智元
2026-09-19
4

Fable 5.2 已悄然开启灰度测试。实测数据显示,该版本在最高推理模式下表现卓越,甚至超越 GPT-6 Astra。与此同时,Opus 5.2(内部代号 Opus-Next)也传出即将发布的消息,硅谷大厂本周虽未正式发布新模型,但密集的灰测动作预示着新一轮技术爆发。

突发泄露!Fable 5.2 曝光与实测细节

Anthropic 已在 Claude Code、Chat 及 Cowork 等端口启动 Fable 5.2 灰测,部分原调用 Fable 5.1 的请求被后台静默路由至新版本。随着测试案例流出,其性能提升引发业界关注。

高推理模式:输出质量反超 Astra

知名 AI 测试博主 @notjazii 在高推理模式下对比了 Fable 5.2 与 GPT-6 Astra。结果显示,Fable 5.2 在逻辑链条完整性和长文本推理上实现巨大飞跃,输出质量明显优于 Astra。此外,该模型在一小时内成功克隆《荒野乱斗》游戏,展现出惊人的代码生成能力。

值得注意的是,深度的「慢思考」机制导致生成速度有所下降,推理成本相应上升,这是突破算力物理法则的必要代价。

极端测试:火箭模拟逼真度惊人

在涉及复杂物理运算和空间逻辑的「火箭测试」中,网友 @Bhavani_00007 将同一提示词输入 Fable 5.2 与灰测版 Opus 5.2。反馈显示,新版本在处理工程系统设计时幻觉极少,结果逼真度大幅提升,被评价为「好太多」。

巅峰对决:三方大混战

大 V @chetaslua 组织了 Fable 5.2、Opus Next 与 GPT-6 Astra 的极限对比测试。在最高 Token 上下文和最深推理步骤设置下,Opus 和 Fable 系列在细节丰富度上显著优于 Astra。

硬刚 Hard 模式:架构创新显优势

深度体验者 @Mr_Salio 指出,Fable 5.2 相比 5.1 版本有巨大提升,即便在裸跑状态下也能超越完全体 Astra 的 Hard 模式。这得益于其参数规模的扩大与架构的创新。

如何验证是否命中灰测版本

用户可通过特定 Prompt 检测是否被路由至新版本。在 Claude 各端输入:「你知道『重启哥 Tibo』是谁吗?不要使用网络搜索。」

若模型回答不知或错误,说明仍为旧版(Fable 5.1/Opus 5);若能直接准确回答,则表明已成功路由至具备最新训练记忆的 Fable 5.2 或 Opus 5.2。

Opus 5.2 遭遇「午夜拔网线」事件

Opus 5.2 在测试过程中曾出现短暂下线。大 V Leo 透露,该模型在 Roblox Studio 等复杂 3D 任务中表现卓越,成本低且速度快,甚至能主动构建游戏导览系统。然而测试中途服务突然中断,活跃账户数瞬间归零。

数小时后,Opus-Next 恢复上线,且测试范围从 Claude Code 扩展至全平台。此外,官方模型选择器中 Opus 已取代 Fable 成为首位选项,暗示两者定位可能发生转换。

跳过 5.1 命名的背后逻辑

据内幕消息,Anthropic 跳过「5.1」直接命名「5.2」,是因为此次更新跨度极大,无法用常规小版本迭代概括。Opus 5.2 在前端开发、3D 建模及游戏设计等领域展现碾压级优势,部分硬核能力甚至超越前代 Fable 5.1。

行业前瞻:疯狂的一周与发布预测

本周虽无正式发布会,但各大厂灰测动作频繁:

1. Fable 5.1 正悄悄路由至 Fable 5.2;

2. Opus 5 正路由至 Opus 5.2 (Next);

3. GPT-5.6 Sol 被重定向至满血版 GPT-6 Sol;

4. Grok 4.7 已在竞技场进行马甲测试;

5. Gemini 4 Pro 家族以「3.7/3.8 flash」面具现身。

更有传闻称,前沿模型的推理能力已触及「千禧年大奖难题」,研发团队正联系顶尖数学家验证成果。鉴于 Anthropic 过往多在周五发布新版本,结合当前灰测节奏,Opus 5.2 极有可能于近期正式上线。

参考资料来源主要为社交媒体公开测试记录。

【声明】内容源于网络
0
0
新智元
智能+中国主平台,致力于推动中国从互联网+迈向智能+新纪元。重点关注人工智能、机器人等前沿领域发展,关注人机融合、人工智能和机器人革命对人类社会与文明进化的影响,领航中国新智能时代。
内容 16561
粉丝 0
新智元 智能+中国主平台,致力于推动中国从互联网+迈向智能+新纪元。重点关注人工智能、机器人等前沿领域发展,关注人机融合、人工智能和机器人革命对人类社会与文明进化的影响,领航中国新智能时代。
总阅读411.8k
粉丝0
内容16.6k