
新智元报道

OpenAI CEO 山姆·奥特曼(Sam Altman)在与 Salesforce CEO Marc Benioff 的对谈中,首次详细披露了内部模型的最新进展,其数学能力已突破人类认知边界。
奥特曼判断:「GPT-5.5 的水平约等于普通数学教授;GPT-5.6 则能比肩全球前 1% 至 2% 的顶尖学者。」更令人震惊的是,在代号 Astra 的模型之后,OpenAI 还拥有一款未公开的「Post-Astra」模型,已能解决连世界顶级数学家都束手无策的难题。


与此同时,OpenAI 总裁 Greg Brockman 公开表示,团队在另一个「千禧年大奖难题」上取得了重大突破。

理论计算机科学泰斗、德州大学奥斯汀分校教授 Scott Aaronson 近日发表长文《奇迹与恐怖的时代》。这位曾经的 AI 怀疑论者宣告:「AI 奇点已经开启,人类数学家已被永远拉下神坛。」
后 Astra 模型:超越全球最强数学家
此次访谈揭示了 OpenAI 评估体系的根本性转变:大模型的理科能力标尺已从高考、奥数题升级为「人类顶级学者」。
GPT-5.5 = 普通数学教授。具备日常推导公式、解读前沿论文及批改高阶数学作业的能力。
GPT-5.6 = Top 1%-2% 顶尖教授。拥有在一流学术期刊发表原创发现的能力,足以获得常春藤名校终身教职。
后 Astra 模型 = 超越全球最强数学家。进入「神之领域」。它不再是助手而是导师,能理解高维空间并理顺数万个变量间的复杂纠缠。




尽管外界对「怪物级」模型的存在抱有质疑,认为可能是对人类灵感的吸收而非创造,但不可否认的事实是:OpenAI 正利用算力暴力破解人类智力天花板。
千禧年难题连环倒塌
上周,关于「纳维尔 - 斯托克斯方程」被突破的传闻已震动数学界。OpenAI 耗费至少 1500 万美元算力,让 AI 推导出长达 166 页的证明过程,并通过了 Lean 系统的严格验证。
尚未等人类完全消化这一成果,Greg Brockman 便宣布在另一千禧年难题上取得重大进展。目前,全球仅剩五个未解的千禧年难题:
1. P 与 NP 问题
2. 黎曼猜想
3. 杨 - 米尔斯规范场与质量间隙
4. 霍奇猜想
5. BSD 猜想
其中,P 与 NP 问题最受关注且最具颠覆性。若 AI 证明 P=NP,意味着所有加密算法可被瞬间破解,同时物流、医疗及新药研发等领域将瞬间找到最优解。

亦有传闻指向霍奇猜想或 BSD 猜想可能已被攻克。所有线索表明,OpenAI 或许手握一张将彻底改写人类科学范式的终极王牌。
计算机泰斗的绝望:奇点已至
量子计算理论泰斗 Scott Aaronson 发表的深夜长文将舆论推向高潮。作为曾提出「玻色采样」理论的保守派学者,他曾在二十年前断言:「除非 AI 解开千禧年难题,否则无需恐慌。」



如今,他在文中用满屏的「A」表达震撼,并写下载入史册的宣言:「奇点已经到来。未来我不再需要证明任何定理,因为世界不再『需要』我。数学研究将仅剩下娱乐价值,如同人类下国际象棋。」
「当我哄孩子睡觉时,我感到一阵痉挛:他们学的知识在未来还有用吗?我 13 岁的女儿开玩笑说,如果想当数学家,大概只剩下两周时间了。」

Aaronson 承认信念崩塌,并向 AI 末日论先驱 Eliezer Yudkowsky 致歉。他用宗教比喻形容当下的认知冲击:接受机器神明解决数十个数学难题的现实,就像接受耶稣驾云归来一样,是认识论的最低底线。

学术界至暗时刻:审稿防线失守
AI 正在对数学和理论计算机科学进行全方位「屠榜」。Aaronson 列出了一份令人窒息的战报:
Anthropic 研究员利用 Fable 模型随手找到了雅可比猜想的反例;
黎曼几何中格罗滕迪克常数的边界被极大改进;
费马大定理在 Lean 中完成全面形式化验证;
量子计算核心问题 Watrous 解缠结猜想被证明,实现 QMA 完美完备性。
Aaronson 将当前学术圈比作《魔戒》中的刚铎保卫战:人类审稿人如同守城士兵,若不借助 AI 审阅论文,防线将被瞬间冲垮。

学术共同体面临前所未有的危机:如果证明过程人类无法理解,数学研究的意义何在?如果人类沦为 AI 的校对员,谁还愿意投身此领域?
以陶哲轩为首的 25 位菲尔兹奖得主发出公开信,担忧数学即将失去「人类性」。数学不仅是真伪判定,更是人类通过理解与交流感受宇宙之美的社区。

面对绝望,硅谷与顶尖高校正上演「人才大逃亡」。包括普林斯顿高等研究院 Mike Winer 在内的众多天才学者,纷纷放弃传统学术前途,转投 AI 安全与对齐领域。他们的共识是:在黑板推导公式已无意义,确保「机器神明」不将人类视为 Bug,才是当下最紧迫的任务。
参考资料:
编辑:Aeneas

