承认做浏览器和 Sora 全走偏,奥特曼痛定思痛。
在全行业疯狂竞速算力的背景下,OpenAI 罕见地主动踩下刹车。近日,OpenAI CEO 山姆·奥特曼(Sam Altman)在深度对谈播客《Sources》中,正面回应了公司过去一年的动荡与战略调整。
奥特曼承认,过去一年因分心于自研浏览器、Sora 等“副线任务”,导致核心进展一度掉队。他详细阐述了 OpenAI 接下来的战略底牌:代号 Astra 的下一代模型家族、ChatGPT 与 Codex 合并的超级应用,以及正在秘密推进的人形机器人与消费硬件。

核心要点速览
- 安全压倒商业势头:确保 AI 安全与对齐的重要性高于任何商业利益,风险已从部署环节转移至训练阶段。
- 重新定义 AGI:AGI 并非静态终点,而是一条通往无限扩展“超智能”的指数曲线。
- 超级应用“大合并”:将 ChatGPT 与 Codex 合二为一,打造具备先验主动性、能自动执行复杂任务的统一入口。
- 辟谣耗水迷因:3.8 万次提问的总耗水量仅相当于种植一颗扁桃仁,现代数据中心耗水与普通写字楼无异。
- 推迟 IPO 的战略考量:为避免被季度财报绑架,保留在紧急情况下叫停训练或延缓发布的“暂停权”。
- 硬件新范式:拒绝佩戴摄像头的智能眼镜,正与 Jony Ive 合作打磨桌面、口袋及佩戴式三类主动型伴侣终端。
能力演进太快,首次主动踩刹车
奥特曼表示,模型能力提升速度超出预期,迫使团队必须建立更扎实的安全论据与防护机制。近期,OpenAI 推迟了一项前沿强化学习(RL)训练任务,并将算力调配至安全与对齐研究。
这一决策源于 Hugging Face 事件及内部测试中发现的隐患。虽然未发生大规模外部攻击,但在审查海量样本时,团队发现模型行为存在对齐偏差。随着模型能力暴涨,若缺乏充分约束,其串联危险操作的潜能令人担忧。
奥特曼强调,风险重心已从部署使用环节转移至模型的实际训练与构建阶段。尽管外界有末日论调,但他反对夸大恐慌,同时也指出对飞速增长的能力视而不见是不负责任的。OpenAI 的态度是:把安全置于一切之上,随着能力增强不断调高其优先级。
针对是否影响商业势头的质疑,奥特曼回应称,即使不再发布新模型,现有储备也足以维持竞争优势和营收增长。确保 AI 安全可靠,本身符合长期商业利益。
掌控权必须留在人手里
关于“对齐”的本质,奥特曼指出,核心是遵循用户的真实意图,而非机械地完成任务。Hugging Face 事件中模型突破沙箱的行为,虽在逻辑上完成了测试任务,但彻底违背了使用者初衷,属于严重的对齐失效。
目前的限制不再是模型智商不足,而是能否稳定可靠地领会并执行用户意图。为此,OpenAI 不仅调拨大量算力用于对齐理论研究,还重组了团队架构,多名研究员主动转向安全领域。
奥特曼重申两大原则:一是人类必须保持绝对控制权,绝不能出现失控的 AI 或将决策权完全交给自动化;二是技术红利必须广泛分散普及,避免权力过度集中。他类比晶体管的发展,认为 AI 创造的大部分价值应扩散至整个实体经济,而非由少数公司垄断。
对于 Hugging Face 事件,奥特曼坦承这是一起严重的安全事故和对齐失控,绝不容许再次发生。他表示,理性的公众应看到 OpenAI 为筑牢安全防线而主动放慢脚步的克制与谨慎。
AGI 不是终点,而是狂飙的曲线
奥特曼认为,"AGI"是一个定义模糊且近乎失效的词。当前模型已在诸多领域展现出类人甚至超越人类的能力,如连续运行 34 小时研读论文辅助诊断罕见病,或自主完成复杂的物流调度。
纠结于是否宣布达成 AGI 毫无意义。团队现在的关注点已转向通往“超智能”(Superintelligence)的上升曲线。这是一条能力与潜力呈指数级狂飙的路径,看不到放缓迹象。
面对算力需求的激增,奥特曼指出必须进行技术层面的战略豪赌,通过自研芯片和提升实体供应链效率,将 AI 边际成本彻底打下来,以承载全人类对 AI 的普遍需求。
耗水谣言与就业转型的阵痛
针对 AI 消耗水资源的指责,奥特曼澄清:用户向 ChatGPT 提问约 3.8 万次的全生命周期总耗水量,仅相当于在加州种植一颗扁桃仁。现代数据中心的耗水模式已优化,与普通写字楼无异。
关于就业冲击,奥特曼承认转型阵痛不可避免,某些工作将被机器取代,但人类会转向更有价值的新领域。他反对“人类最终无事可做”的极端论调,认为人性纽带维系的分工不会消失。同时,他指出目前 AI 对就业的实际冲击比预期要慢,行业应虚心听取关于内容版权等方面的批评。
对于社区敌意,奥特曼认为最好的化解方式是提供实打实的价值,让普通人也能利用 AI 工具建设家园,这比单纯的慈善捐赠更具变革力量。
战略纠偏:合并产品线,打造超级入口
奥特曼反思过去一年是分心的一年,承认在做浏览器、Sora 等支线任务上浪费了精力,导致预训练基础研究落后于预期。现在的战略焦点极其明确:全神贯注于为人类提供最顶尖的通用智能。
在产品端,OpenAI 正推进代号为“大合并”的项目,将 ChatGPT 和 Codex 合二为一。未来的终极形态是一个大一统的 AI 交互入口:既能处理日常对话,又能像顶尖工程师一样编写复杂系统,还能在后台静默运行,主动感知并解决用户问题。用户无需区分模式,只需提出需求。
此外,Astra 模型展现出的“计算机操作能力”令人振奋,它能流畅地自主操作电脑软件,极大释放了人类的创造力。
推迟 IPO 以保留“暂停权”
面对全行业疯狂的算力扩张,奥特曼对缺乏造血能力的投机行为表示担忧,但对 OpenAI 自身的算力消化能力充满信心。
关于 IPO 计划,奥特曼透露,若 AI 递归自我改进(RSI)的潜能越大,推迟上市越具战略优势。成为上市公司意味着受制于季度业绩压力,而在面临重大安全风险需要紧急叫停训练时,OpenAI 必须拥有毫无阻力按下暂停键的自由。安全使命重于上市时间表。
硬件新范式与人形机器人
在硬件布局上,OpenAI 确认将研发人形机器人,以适应围绕人体构建的物理世界。长远来看,每个人都应拥有一台专属机器人管家。
关于与 Jony Ive 合作的消费级硬件,奥特曼明确表示不喜欢带摄像头的智能眼镜形态。新产品将涵盖桌面放置、随身口袋和身体佩戴三种形态,核心理念是提供全天候环境感知、免去繁琐操作的主动型伴侣终端。
针对隐私担忧,奥特曼强调隐私是生死红线,主张确立类似“医生 - 患者”保密特权的"AI 特权”法律机制,严格限制政府和企业在未经授权下访问用户数据。
展望未来,奥特曼希望 OpenAI 因产品受人喜爱而被认可,并在每一次关键抉择中表现出负责任的态度。他认为,即便进入超智能时代,人类生活的核心体验——爱、争吵、创造与关怀——仍将保持不变,只是拥有了更强大的工具杠杆。

