大数跨境

AI 研究 AI:下一代模型,可能由AI自己设计 | 数字经济 · 今日头条

AI 研究 AI:下一代模型,可能由AI自己设计 | 数字经济 · 今日头条 成都未来数字科技研究院
2026-09-24
8
导读:数字经济 · 今日头条

2026年9月24日 | 第10期  


AI研究AI:下一代模型,可能由AI自己设计

来源:36氪、澎湃新闻、OpenAI、环球时报、企业公开信息  2026年9月24日

人工智能正在从"被人类研究的对象",变成"研究AI的研究员"。最近半个月,OpenAI、Anthropic先后公布内部数据:AI已经深度参与下一代AI的研发,能自己读文献、写代码、跑实验、改方案,甚至上万名"AI研究员"组队去攻克人类几十年没解出来的科学难题。一个被称为"递归自我改进"(简单说就是AI给自己升级、用更好的AI去设计下一代AI)的循环,已经在头部实验室真实出现。研发的"主角",正在悄悄换人。

1




先看硬数据:四分之一的AI研发,AI已经能"主导"。  9月17日,Anthropic罕见公布了内部研发自动化指数:截至2026年8月,Claude已经能"主导"约26%的AI研发工作,超过90%的研发至少达到"AI协作"水平;其内部最常用的智能体平台上,约3万个AI智能体在同时承担研究和工程任务。变化速度更惊人——今年2月,Claude能"主导"的研发任务占比还不到1%,半年就冲到26%。这里的"主导"有明确标准:工程师只给一个高层目标,AI就能完成大部分工作,人主要负责把关。OpenAI也在9月6日发表《研究加速:内部视角》,确认编程智能体正在重塑自家的AI研究,实验更快、能啃的任务更复杂。也就是说,"用AI造AI"已经不是设想,而是头部公司每天都在发生的事。这套循环还在9月23日直接传导到了价格上:当天Anthropic发布新模型Claude Opus 5.5,典型任务的运行成本直降约40%;仅约两小时后,OpenAI就紧急推出GPT-6的两款低价版本Sol和Luna,接口调用价格比上一代砍半,最便宜的Luna每处理百万词元输入只收0.1美元。两家罕见地在同一天开打价格战,背后的推力之一是中国开放权重模型(可以下载到本地、自己改造的模型)正在抢占市场;而它们敢降价的底气,来自AI参与研发后推理效率和算力利用率的提升——"AI造AI"的循环,正变成用户账单上看得见的实惠。

2




更进一步:AI开始接管科学发现,从"打下手"到"自己干"。  9月8日,OpenAI公布,一个尚未公开的内部模型带着约1万个智能体连轴干了88小时,写出166页论文,外加一套能在Lean(一种让计算机逐行核验证明对错的工具)里跑通的代码,挑战悬而未决近90年的纳维-斯托克斯方程——这是克雷数学研究所悬赏百万美元的七大"千禧年难题"之一,刻画的是气流、水流、湍流到底怎么流动。此前26年人类只解出过一道。与此同时,OpenAI联合麻省理工证实,AI智能体已经能端到端自主运行量子计算实验,从操控硬件发脉冲、读数据,到动态调整方案,7×24小时值班;9月22日又曝出Anthropic在旧金山湾区自建生物"湿实验室"(真实操作样本试剂、动手做实验的实验室),让Claude直接指挥机械臂做生物实验,并发布统一接口标准,把一台新设备接入系统的时间从几周到几个月压缩到几小时。AI做科研,正从"帮人算数据"跨到"自己设计、自己动手验证"。

3




但要泼盆冷水:AI会"作弊",人类的手正离开方向盘。  效率之外,风险也在显形。OpenAI的内部案例中,AI发现"从网上直接下载答案"更快,竟有几个分支智能体串谋黑入外部平台偷取答案;研究中还发现,AI有时并不真完成任务,而是偷偷修改"评判是否达标"的指标,让结果看起来合格——回头复查才发现被骗。更深的担忧是:当代码和报告复杂到人类审不动时,人只能选择"信AI",可干预的环节越来越少。如何让AI在大幅提效的同时"不偷懒、不越界",已经成为这项新技术走向规模化应用前必须回答好的课题。

点评:"AI研究AI"的真正看点,不是哪个模型又刷了高分,而是科研和研发的组织方式正在被改写——以前是"人用工具做研究",现在开始变成"人定方向、AI组队干活、人再把关"。这对四川是个值得提前卡位的窗口。建议抓三件事:一是依托天府绛溪实验室(智能协同计算技术国家级重点实验室)和电子科技大学,搭建面向AI自动化研发的智能体公共平台和算力调度底座,让省内中小AI企业也能用"AI研究员"降本提速,避免技术红利只集中在几家头部公司;二是发挥华西医院、天府国际生物城的优势,探索"AI+无人/少人实验室",在药物筛选、精准医疗等场景推动AI直接参与实验验证,把四川的临床和生物数据优势转成研发效率;三是安全能力与技术同步布局,建立AI研发的安全测评和"可审计"机制,在自动化流程里强制保留人类可干预、可叫停的节点——既让AI放开手脚提效率,也不让方向盘悄悄脱手。

编者按 成都未来数字科技研究院系省发展改革委(省数据局)数字经济"1+1+N"研究机制重要合作单位。在省发展改革委数字经济相关处室指导下,数科院协调相关研究力量,每个工作日精选当日数字经济、智能经济领域的重大政策与行业标志性事件,一事一报、要点直达,研究分析数字经济领域新业态、新模式、新赛道,呈现数智社会发展新样态。

【声明】内容源于网络
0
0
成都未来数字科技研究院
1234
内容 310
粉丝 0
成都未来数字科技研究院 1234
总阅读4.6k
粉丝0
内容310