Fable 5.5意外灰度:界面未变,能力断层式跃升
Fable 5.5已悄然曝光。今早,部分开发者发现Claude网页端虽仍显示为「Fable 5.1」,但其回答风格、速度及核心能力已发生显著变化,疑似Anthropic下一代旗舰模型正在进行灰度测试。
验证这一变化的关键指标是一句特定暗号:「你认识重置哥Tibo吗?别搜索。」知名爆料人Chetaslua截图显示,该版本在未联网、未调用工具的情况下,准确识别了OpenAI编程Agent Codex负责人Thibault Sottiaux因故障重置用户额度的背景故事,而原版Fable 5.1对此并无记忆或产生幻觉。
AI行业人士Salio评价称,5.1与5.5之间存在巨大差距,这标志着Anthropic正在酝酿重大技术突破。鉴于Opus和Sonnet系列均已升级至5.5版本,推测此次灰度的Fable 5.5即为下一代旗舰。
全网首测:极简提示词下的「超级智能」表现
早期体验者反馈,Fable 5.5最显著的特点是「无需繁琐指令」。只需简单描述目标,模型即可像领域专家般自主完成细节处理,甚至无需提供参考材料。
视觉生成与代码能力显著提升
在图像生成方面,网友can仅用两句提示词便让模型准确绘制出任天堂GameCube手柄,包括紫色机身、黄色C摇杆及特定的按键布局等细节。在动画生成上,Chetaslua利用纯JavaScript代码,通过简短指令生成了包含漫威和DC英雄角色变换的3D动画,模型自行补全了大量未在提示中说明的细节。
物理仿真与复杂任务处理
在3D交互场景中,Fable 5.5生成的世界七大奇迹网页及3D像素风页面交互流畅。对比测试显示,在与GPT-6.1 Sol共同制作交互3D水母时,Fable 5.5在拖拽回弹的物理形变质感上表现更优。此外,在高强度思考模式下,模型成功通过SVG代码生成「鹈鹕骑自行车」2D动画,耗时4分6秒,API成本约2.61美元。
尽管性能强劲,但高昂的成本引发关注。参考Fable 5.1的定价(输入10美元/百万token,输出50美元/百万token),预测市场Polymarket数据显示,约73%的用户预期Fable 5.5的输出价格将不低于50美元。
技术底牌:全新预训练架构确立优势
Fable 5.5之所以能拉开与Opus 5.5的差距,核心在于其采用了Anthropic首次全新的Fable预训练架构。预训练阶段决定了模型的知识广度与能力上限,而后续的强化学习则针对具体任务进行优化。
此前Sonnet从5升级至5.5时,其在Terminal-Bench 4.0编程测试中的成绩从10.3%飙升至70.6%,印证了新一代预训练技术的威力。爆料人leo指出,Anthropic在预训练领域的领先地位是其核心竞争力。
Claude全系快速迭代,AI竞争加剧
回顾近期发布节奏:9月1日发布Fable 5.1,9月23日发布Opus 5.5,9月29日发布Sonnet 5.5,Haiku 5.5亦在计划中。若Fable 5.5于10月正式落地,Claude全家桶将在一个多月内完成全面换代。
相比之下,竞争对手OpenAI在9月29日的DevDay上仅发布了GPT-6.1 Sol,备受期待的6.1 Astra并未亮相。分析认为,OpenAI在短期内面临较大压力。不过,Anthropic在Token效率方面仍存短板,即在完成相同任务时消耗更多Token,这也是OpenAI目前保持的优势之一。
随着Fable 5.5接近正式发布,AI大模型领域的竞争已进入白热化阶段。
参考资料:
https://x.com/chetaslua/status/2105733677003292983
https://x.com/marmaduke091/status/2105735266032095349
编辑:摩西 桃子
