OpenAI立下“军令状”:28天每日更新,失败即赔付额度

新智元报道

OpenAI近期发布了一项极具挑战性的承诺:在未来28天内,Codex团队必须每天交付一项对大多数用户有明显价值的改进。若未能达成目标,则对所有受影响用户进行全额额度重置。
Codex负责人Tibo在社交媒体X上正式宣布了这一计划,将此次行动定义为“改进之旅”。这一举措被外界解读为OpenAI在面临巨大竞争压力下的紧急应对策略。

在发布该“军令状”前数小时,Tibo曾发文明确团队接下来的四大核心方向:简化产品、提升效率以增加用量、开发突破性功能以及推出新模型。他承认,用户反馈强烈呼吁产品需变得更加简单易用。
这一高调宣言随即引发了同行间的微妙互动。Grok Bot团队成员Lauren Tan调侃道:“期待很快再见,来自The Ship Company的更多发布。”面对调侃,Tibo直接引用自己的28天承诺向对方发起挑战,而Lauren仅回复一句:“只有你能赢得这场战斗。”


由于Tibo过去多次负责宣布Codex额度重置,被用户戏称为“重置哥”。此次承诺中,“交不出作业就赔额度”的机制,被视为其熟悉领域的延伸,也侧面反映了OpenAI对用户满意度焦虑的提升。
额度消耗不透明引发用户焦虑

你的额度到底花到哪去了?
用户对额度的高度敏感,源于Codex使用中存在的“黑盒”现象。在Agent模式下,一个简单的指令可能触发复杂的后台流水线,包括代码生成、上下文读取、记忆维护及子Agent调度等,均会消耗大量Token。极端情况下,单个任务可能耗尽用户一周70%的额度。
近期技术故障加剧了这一矛盾。9月29日DevDay发布GPT-6.1 Sol后,因服务端负载过高导致速度骤降。Tibo于10月2日道歉并宣布次日对所有付费ChatGPT账号进行全局重置,随后仍在处理部分Pro档位用户未享受到重置的问题。

这一系列事件反映出OpenAI亟需解决的核心痛点:用户付费后不仅感到额度不足,更无法清晰追踪资源去向。
竞品压力迫使OpenAI加速迭代
除了内部体验问题,外部竞争是促使OpenAI做出激进承诺的主要原因。
9月22日,Anthropic发布Opus 5.5,约90分钟后OpenAI迅速跟进发布GPT-6 Sol。一周后的DevDay上,OpenAI又推出GPT-6.1 Sol,试图通过降低至竞争对手五分之一价格来提升性价比。
然而,市场反馈并不完全乐观。尽管GPT-6.1 Sol缩小了差距,但在最高推理等级下,Opus 5.5仍保持性能优势。更关键的是,许多用户反映Claude在同等任务下效率更高、额度更耐用。这种“既智能又省钱”的竞品体验,导致部分用户产生迁移意向。

在Tibo的帖子下,已有用户直言:“我不在乎功能微调,我只想要一个能打败Opus 5.5的模型。”甚至有用户表示准备转向Claude或Grok。
相比之下,竞争对手正通过实质性产品进展巩固地位。Lauren Tan所在团队上月提交了2500个PR,并通过直播展示从零搭建公司的能力。网友Token Gremlin指出,如果28天的改进中不包含能超越Opus 5.5的模型升级,对核心用户而言意义有限。

舆论甚至开始调侃可能的“改进”内容,如放大按钮、更换字体或UI颜色等表面优化,反映出用户对深层能力提升的迫切期待。
28天后的关键考验

28天之后,用户会记住什么?
目前,Tibo并未明确定义何为“对大多数用户有明显帮助”。界面微调、用量面板优化或特定档位的重置是否算作达标,尚存模糊空间。
对于OpenAI而言,这一策略的最坏结果仅是再次执行额度重置,这是团队已具备的操作能力。然而,额度补偿无法弥补核心技术能力的短板。
28天后,决定用户去留的关键,在于OpenAI能否拿出一款在性能上真正具备竞争力、值得用户留下的模型。这不仅是对其执行力的考验,更是对其技术护城河的一次严峻验证。
参考资料:
https://x.com/thsottiaux/status/2106845241357824205
https://x.com/TokenGremlin/status/2106848269678575933
https://x.com/mark_k/status/2106854194116518315
https://x.com/ChrisGPT/status/2106850961612530171
https://wap.cj.sina.cn/pc/7x24/5125414
编辑:所罗门




