OpenAI 史上最快的模型 GPT-5.3-Codex-Spark 即将迎来终点。Codex 负责人 Tibo 宣布,该模型将于下周正式退役。从发布到下线,这款曾号称每秒生成 1200 个 Token、首个脱离英伟达生态的模型,生命周期仅维持了 7 个月。
Tibo 给出的理由直白而残酷:用量持续下滑,且团队已拥有性能更优的替代方案。「是时候给未来腾地方了。」他随后补充道,对曾发布过名字如此冗长的模型感到不可思议。
告别式上的冷遇:用户只关心「备用额度」
Spark 的退场显得安静甚至尴尬。尽管 Hugging Face 的 Vaibhav Srivastav 试图在评论区缅怀其作为「最快小子」的历史地位,但更多开发者的反馈直指其实际效用。
感谢服役,你很特别。但在退役前,大家更想问:它到底是用来做什么的?
开发者 argofowl 的评价尤为犀利:「Spark 是个好玩的模型,但极度糟糕、根本无法投入生产使用。」另有开发者指出,在处理理解项目上下文或分析日志等基础任务时,Spark 极易填满上下文窗口,迫使开启新对话,效率低下。
事实上,真正令部分用户感到惋惜的并非模型本身,而是其附带的独立配额。在 Astra 额度紧张的背景下,许多开发者将 Spark 视为主额度耗尽后的「备用油箱」。知名开发者 Chubby 直言,希望能有一个具备独立套餐的新模型来填补这一空缺。
成也速度败也智能:蒸馏模型的先天缺陷
回溯今年 2 月 12 日,Spark 上线时声势浩大。作为 OpenAI 首个专为实时编程设计的模型,它拥有 128k 上下文,官方宣称客户端与服务端往返开销降低 80%,首字延迟减半。代码整块倾泻而出的体验,曾让 Ryan Vogel 等早期用户将其纳入核心工作流,甚至让 Instructor 作者 Jason Liu 高呼「RAG 已死」。
更重要的是,Spark 承载着 OpenAI 摆脱英伟达依赖的战略野心。它是首个运行在 Cerebras 晶圆级芯片 WSE-3 上的生产模型,标志着双方 750 兆瓦算力大单的首次交付。
然而,热度消退极快。Spark 的致命伤在于其本质:为了适配单块晶圆,它是一个牺牲智能换取速度的「蒸馏版小模型」。
数据显示,在 Terminal-Bench 2.0 评测中,Spark 准确率仅为 58.4%,远低于完整版 GPT-5.3-Codex 的 77.3%。SWE-Bench Pro 曲线同样显示,虽然 Spark 能将任务压缩至 1-2 分钟,但准确率停滞在 47%-51% 区间;而完整版模型虽耗时稍长,准确率却能稳步提升至 57%。
此外,宣传中的「15 倍提速」也被证实存在误导。开发者 Nicholas Van Landschoot 指出,该对比是基于最高推理强度的旧模型。在同等准确率下,Spark 的实际提速仅为 1.37 倍。在实际编码中,其捏造 API、JSON 格式不稳定等缺陷被无限放大。正如 Turing College 所总结:「没有智能的速度,只是更快地失败。」
旗舰本尊下场:Ultrafast 模式终结 Spark 使命
真正宣判 Spark 死刑的,是 8 月 13 日 Cerebras 发布的 Ultrafast 模式。这一次,运行在晶圆上的不再是缩水版 Spark,而是旗舰模型 GPT-5.6 Sol 本尊。
通过将旗舰模型按层切分并铺设在多台 CS-3 节点形成流水线,Ultrafast 模式在保证与标准版同等智能的前提下,实现了每秒 750 个 Token 的惊人速度。Cerebras CEO Andrew Feldman 表示:「速度与智能,不再互斥。」
实测数据显示,在 GDP-Val 任务中,标准版 Sol 平均耗时 7.7 分钟,而 Ultrafast 仅需 83 秒,端到端提速 5.6 倍,且回答质量几乎没有差别。这意味着,曾经 Spark「拿智能换速度」的生存逻辑已被彻底证伪。当同一批晶圆既能跑满血旗舰又能提供极速体验时,缩减版模型的存在意义自然荡然无存。
行业新规则:速度成为付费档位而非独立模型
Spark 的退役仅是 OpenAI 模型库激进「大换血」的缩影。过去三个月,GPT-5.2、GPT-5.4 等多个旧版本相继离场,Codex 系列也开启了以 Sol、Terra、Luna、Astra 命名的新纪元。那种带有冗长版本号的名字,已成为过去式的遗迹。
更深层次的变革在于,「快」已从独立模型演变为旗舰模型的标配「付费档位」。如同推理强度分为 Light 到 Max,现在的速度也划分为 Standard、Priority 和 Ultrafast。速度与算力深度挂钩,按档付费的商业模式已然跑通。
回顾历史,Spark 完美完成了其过渡期探路者的使命:验证了 Cerebras 晶圆承载生产级流量的能力,证明了推理任务可脱离英伟达生态。但随着大部队入驻,探路者功成身退。
「拿智能换速度」的歧途已被封死。下一轮军备竞赛的规则彻底改写:竞争焦点不再是谁能做出最快的阉割版模型,而是谁能将最强的旗舰模型,跑出最极限的速度。

