OpenAI 刚把自己逼到了一个很尴尬的位置。
DevDay 才结束几天,20 多项新东西刚端上桌,产品负责人已经开始公开催自己交作业了。
10 月 5 日凌晨,OpenAI 核心产品负责人 Tibo 在 X 上立了个 Flag:
接下来 28 天,每天都要给 Codex / Work 用户交出一项“明显有用”的改进。当天没东西可交,就来一次完整重置。
翻译成人话:
今天有更新,你拿更新。
今天没更新,你拿额度。
怎么都不能空手回去。
这已经有点像 AI 圈版的“迟到赔券”了。
只不过外卖赔的是 5 块红包,Tibo 赔的是 Codex 额度。
●OpenAI 突然开始做减法了
其实在这条“28 天军令状”之前,Tibo 已经提前定了调。
接下来团队只盯四件事:
产品简化、提高效率让用户能用得更多、突破性功能、新模型。
他还专门补了一句:
用户反馈已经很清楚,大家希望东西变简单。
这句话放在 DevDay 后面看,很有意思。
9 月 29 日,OpenAI 官方自己统计,这届 DevDay 一口气发了 20 多项重大更新。
GPT-6.1 Sol、Dots、Space、Agents API、各种新能力、新套餐……
发布会看下来,感觉 OpenAI 恨不得把一整年的 PPT 一晚上放完。
问题也跟着来了:
东西越来越多,用户每天真正打交道的体验,反而开始有点乱。
模型选哪个,推理等级开多少,额度怎么算,Work 和 Codex 分别吃多少,用到一半还能不能继续跑……
如果你经常拿 Codex 跑长任务,这种感觉会很明显。
聊天时代,一问一答,大概还能估算自己用了多少。
Agent 跑起来以后,一句话需求背后可能连续读取上下文、调用工具、改文件、检查结果、压缩上下文。
你看到的是一句 Prompt,后台跑的是一条流水线。
于是额度条掉起来,有时候很难靠直觉判断。
●更麻烦的是,前几天它真的跑慢了
GPT-6.1 Sol 上线后,Tibo 自己也承认,前两天遭遇了巨大的负载峰值,模型速度受到影响。
10 月 2 日,他随后宣布给所有付费 ChatGPT 账号安排一次全局额度重置,并表示 GPT-6.1 Sol 已经恢复到预期速度。
这就让“效率”两个字变得很具体了。
用户当然想要更聪明的模型。
但一个模型能力涨了 10%,任务时间多一倍,额度再掉得飞快,实际用起来照样容易血压上升。
OpenAI 最近对 Pro 套餐的调整,也让这个问题更敏感。
官方帮助文档目前明确写着:新订阅的 Pro 200 仍然是每月 200 美元,但包含的使用额度比此前更低。 同时又增加了更贵的 Pro 500。
所以很多重度用户现在盯着的,已经不只是 Benchmark。
今天能干多少活,开始比跑分更有存在感。
●这时候,隔壁还过来拱火
更热闹的是,Tibo 发完 28 天承诺后,直接在 X 上向 Grok Bot 团队的 Lauren Tan 喊话:
“I challenge you to do the same.”
来,你也连续 28 天试试。
随后他还在回复里对 @poteto 来了一句:
“that was a really quick fold.”
产品负责人亲自下场开团,气氛一下就从 Roadmap 会议变成了擂台赛。
但我觉得,这场嘴仗反倒把 OpenAI 现在最现实的问题暴露得很清楚。
DevDay 已经证明它还有很多东西可以发。
接下来要证明的,是这些东西能不能让用户每天都感觉更好用一点。
启动快一点。
额度耐用一点。
产品少绕几个弯。
模型别刚上线就堵车。
这些改动听起来没有“全新 Agent”那么性感,可每天真正干活的人,对这种变化最敏感。
●接下来 28 天,才是这场发布会的下半场
所以我反而挺想看这 28 天。
因为这次 Tibo 自己把标准说得很狠:
要对“大多数 Codex / Work 用户”产生明显改善。
按钮换个颜色,显然很难糊弄过去。
当然还有一个漏洞——到底什么叫“明显改善”,以及当天触发完整重置后具体覆盖哪些用户和套餐,原帖暂时都没有进一步说明。
这也给网友留下了巨大的发挥空间。
要是实在没活了,按钮放大两个像素、Dots 换套新皮肤、再给设置页挪个位置……
理论上也能叫“今天又进步了”。
但 OpenAI 最好别真这么玩。
毕竟这 28 天最理想的结局,其实是:
Tibo 这个“重置哥”的存在感越来越低。
未来他最热衷的那个 Reset 按钮,会不会天天见,让我们拭目以待。

