"better than at least 90% of humans at writing software"
马斯克:在编写软件方面,AI 已经超过至少 90% 的专业软件工程师。
这一论断出自一场关于就业替代速度的深度访谈。面对主持人的追问,马斯克将工作划分为“物理世界”与“数字世界”两类:前者受限于机器人硬件(手和脚)的成熟度,后者因完全数字化而将率先受到冲击。
软件工程首当其冲。马斯克判断,AI 在代码编写能力上已超越 90% 的专业工程师,且这一比例终将升至 99%。他认为,人类程序员若仅比拼实现速度,已无胜算。
尽管马斯克未透露该数据的具体测试模型与任务背景,但其背后的行业变革信号值得深究:AI 将优先接管哪些编程任务?开发者如何构建新优势?团队又该如何验收比人更高效的 Agent?
以下为访谈内容的翻译与整理。
马斯克划定程序员的“非竞争区”
针对 Anthropic 联合创始人 Dario Amodei 对初级白领岗位的警告,马斯克明确指出:数字化岗位将最先感知变化。凡是依赖电脑和手机完成的工作,均易被 AI 接手。
马斯克:软件工程已走在前列,因为代码、文档、测试及运行日志本就存在于数字环境中。
马斯克将 AI 编程能力的终极形态定义为"Stockfish 时刻”。
"Stockfish level"
马斯克:达到 Stockfish 时刻。
注:Stockfish 是一款顶级国际象棋引擎,能在普通设备上轻松击败人类顶尖棋手。人类并未因此停止下棋,职业赛事依然存在,但在“计算深度与速度”的维度上,人类已无悬念。
马斯克借国际象棋引擎比喻 AI 未来的编程地位。当前 Agent 已能将在数小时内完成的编码任务压缩至几分钟。然而,代码生成不等于软件上线。不同于规则固定的棋局,软件开发涉及需求理解、系统稳定性及事故责任归属,这些仍需工程师把控。
"90%"论断背后的未解之谜
“超越 90% 工程师”的说法虽具冲击力,但缺乏具体的测算依据。让 AI 补全函数与负责真实项目存在本质难度差异。
在明确错误指向和测试范围时,AI 表现优异;但在涉及多服务、数据库及旧版本的复杂场景中,即便代码通过测试,上线后仍可能引发用户问题。评估这一数据前,需厘清以下关键问题:
-
AI 处理的是独立编程题,还是运行多年的真实项目? -
代码通过测试后,用户端的实际问题是否真正解决? -
AI 是否具备查看日志、执行命令及使用部署工具的能力? -
修改失败后,谁负责发现问题、回滚代码并承担损失?
由于访谈未披露上述细节,"90%"目前仅代表马斯克的个人判断,而非公开测试结论。但变化已然发生:依赖升级、接口替换、测试补充及重复代码修改等工作,正逐步移交 Agent。
开发团队的核心挑战已转向:如何审查 Agent 交付的代码、发现遗漏问题并确保安全上线。
五年内 AI 智能或超人类总和,程序员首当其冲
在描绘 2036 年的世界时,马斯克给出了比就业预测更激进的时间表:
"AI may exceed the sum of human intelligence"
马斯克:AI 的智能可能在五年后超过全人类智能的总和。
他预测,再过十年,除“成为人类”本身外,AI 将在绝大多数任务上超越人类。尽管未来路径未必平稳,但马斯克对“数字 AI"与“物理 AI"的区分,解释了程序员为何站在变革第一排。
数字 AI 仅需处理信息,而物理 AI 需等待硬件成熟。软件开发已完全数字化,模型可读取输入、生成改动,并从编译器、测试和日志中获取反馈。更重要的是,代码天然具备机器可读的验收信号:编译失败、类型错误、单元测试及性能回归等,均可驱动 Agent 进入下一轮修复循环。
因此,软件开发有望率先形成“接收任务 - 修改代码 - 运行验证 - 读取失败 - 继续修复”的完整闭环。AI 将优先接管执行清晰、结果易查的部分,而模糊需求、边界冲突及生产责任仍由团队承担。岗位不会消失,但工作内容将被重新切分。
将“可验收性”写入基础设施
随着 AI 编码速度提升,测试与可观测性不再仅是质量保障,更决定了 Agent 的独立作业半径。
仅有 README 和零散单元测试的仓库,即便模型再强也需频繁人工确认;而明确了启动命令、测试入口、代码规范及服务边界的项目,则更易让 Agent 稳定推进。开发团队应完善四类基础设施:
1. 可执行的验收条件:避免“优化查询”等模糊指令,应明确为"P95 延迟低于 200 毫秒,结果与旧接口一致,数据库连接数不增加”,为 Agent 设定清晰终点。
2. 权限边界:读仓库、改代码、跑测试与访问生产数据库应使用不同权限。删除、付款、发布及密钥操作必须人工确认。
3. 完整记录:记录 Agent 调用的工具、修改的文件及方案选择逻辑,确保出问题时可重放过程。
4. 回滚路径:代码通过测试仍可能影响线上数据,需在 Agent 行动前准备好灰度发布、版本锁定及一键回退机制。
程序员的优势将从“写得比模型快”转向“能让模型在可控范围内完成任务”。
“工作可选”尚远,当下重在人机协作
马斯克推测,当数字 AI 与机器人双双成熟,工作或将像园艺一样成为个人兴趣选择。但这属于 2036 年的议题。
对当下的开发者而言,工作并未取消,而是面临重构:同样人数需承担更多需求,以往因预算不足搁置的小工具也将进入排期。代码成本降低将激发更多自动化设想,维护范围随之扩大。马斯克承认,这一过程将伴随颠簸,且速度快于历次技术革命。
开发团队当前亟需解决的是:哪些任务可移交 Agent?哪些改动必须人工审核?如何核算模型成本?事故发生后由谁接管?
结语
开发者无需与 Agent 比拼代码生成量,而应聚焦于将模糊需求转化为可执行任务,将测试与日志接入 Agent 循环,并为高风险动作保留人工确认环节。
建议从一项维护任务起步:选定范围清晰、失败成本低的任务,明确允许修改的目录与禁止触碰的接口,将测试命令、性能指标及完成条件交付 Agent,要求其提交计划、Diff、测试结果及风险说明,经人工检查后再进行灰度发布。流程跑通后,再逐步扩大 Agent 的权限与任务长度。
正如 Stockfish 出现后人类未停止下棋,但职业棋手不再与机器比拼计算深度;AI 进入软件开发后,程序员也需切换赛道。代码生成可交由模型,但定义问题、建立约束、验收结果及承担上线责任,依然是软件工程的核心。

