一、事件概述:一次"标志性"的延期
彭博社于7月16日报道,谷歌最强大的旗舰AI模型Gemini 3.5 Pro的发布时间已较原计划推迟数月,核心原因是模型的编程能力未达到内部预期。
Gemini 3.5 Pro最初于2026年5月在Google I/O大会上宣布,时任CEO桑达尔·皮查伊表示该模型已在内部使用,预计6月向更广泛用户开放。然而两个月过去,模型仍未面向公众发布。报道援引10位现任及前员工的说法称,此次延期已在谷歌内部引发广泛挫败感。
市场反应迅速且剧烈。Alphabet股价周四盘中一度跳水逾5%,最终收跌约4.44%,市值蒸发数百亿美元。截至7月16日,Alphabet股价约356美元,较5月52周高点402.62美元已下跌约11.6%。
二、延期原因深度剖析
1. 直接原因:编程能力"不及格"
报道明确指出,Gemini 3.5 Pro在代码生成方面的表现低于内部预期。具体而言:
训练数据更新失败:谷歌上月底更新了训练Gemini所用的数据以提升编程能力,但结果令人失望。
内部基准全面落后:内部基准测试显示,Gemini在编程任务上落后于Anthropic和OpenAI的模型。在谷歌自家发布的Android Bench基准测试中,Gemini 3.1 Pro仅排名第五,落后于GPT-5.4、Claude Sonnet 5和Claude Fable 5;Gemini 3.5 Flash虽定位为"更廉价、更快速"的替代方案,但在安卓开发场景下延迟更高、任务成功率低了9个百分点,且单次基准测试花费高达147.1美元,是Gemini 3.1 Pro Preview的三倍。
重新预训练:据报道,Gemini 3.5 Pro已连续错过三个发布截止日期,谷歌甚至放弃了原始基础模型并从头开始重新预训练。预训练是构建前沿AI模型最昂贵的阶段——耗时数月、消耗海量数据,决定了模型的能力天花板。选择重新预训练而非继续微调,等于承认原始模型的能力天花板本身就"放错了位置"。
2. 深层原因:谷歌的"结构性顽疾"
彭博报道揭示的问题远不止技术层面:
内部组织碎片化。Google Cloud、DeepMind和Android团队都在独立开发面向开发者的AI编程工具,消费产品团队也参与其中,形成内部竞争而非协同,拖慢了整体进度。
"大船难掉头"的整合难题。谷歌需要将AI融入搜索、地图、YouTube等庞杂的产品矩阵,多层利益相关方参与审批,复杂决策流程导致发布速度远慢于初创公司。一位前员工形容,让各业务部门朝同一方向推进,就像 "把整个海洋之水烧开一样困难" 。
内部文化矛盾。部分工程师持保守观点,认为重要代码仍应由人工编写以符合谷歌标准。AI工具推出初期,员工甚至曾被限制使用Gemini编写代码,担心专有代码泄露至训练数据。这些规定虽已放宽,但早期限制了工程师尝试AI开发的机会。
人才持续流失。Transformer论文合著者Noam Shazeer(谷歌曾 reportedly 花费27亿美元将其从Character.AI召回)于6月离职加入OpenAI;诺贝尔奖得主John Jumper在同一周加入Anthropic。报道指出,对谷歌竞争地位的挫败感是人才外流的核心驱动因素。
三、竞争格局:差距在扩大,而非缩小
Gemini 3.5 Pro延期的背景是竞争对手正在加速前进:
|
|
|
|---|---|
| OpenAI |
|
| Anthropic |
|
| Meta |
|
在Android Bench最新排名中,Anthropic的Claude Fable 5以84.5%的准确率位居榜首,OpenAI的GPT-5.5以80.2%紧随其后,而Gemini 3.1 Pro仅位列第五。这一差距在编程这一"大语言模型最重要的企业应用场景"中尤为致命。
四、深度分析
1. 市场反应的逻辑:不仅是"一个模型延期"
股价下跌4%-5%看似反应过度,实则反映了更深层的担忧:
AI货币化时间表被打上问号。Alphabet当前前瞻市盈率约22倍,低于微软的30倍。市场给予的"折扣"本身就反映了对其AI变现能力的怀疑。Gemini延期进一步强化了这一叙事——微软已将GPT-5集成至Azure、GitHub Copilot和Microsoft 365并产生可衡量收入,而谷歌的关键模型仍在"重新预训练"。
超过800亿美元AI投资的回报不确定性。Alphabet已在AI领域承诺超过800亿美元投资,包括与伯克希尔·哈撒韦的 landmark 交易。旗舰模型的延期直接威胁到这些投资的回报周期。
"结构性落后"而非"暂时性挫折" 。报道揭示的内部组织碎片化、文化保守主义和人才流失,是深层次的结构性问题,而非简单的时间问题。一名技术分析师指出: "这次延期关乎代理工作,而非聊天机器人的打磨——企业买家现在用编程、工具使用和长周期任务来测试模型,而谷歌的内部评估发现原始模型无法通过这些门槛"。
2. 短期风险
无明确发布时间表:谷歌尚未公布Gemini 3.5 Pro的修订发布时间。
Q2财报临近:Alphabet将于近期发布Q2财报,Gemini延期将成为分析师质询的焦点。
政府监管压力:谷歌正与美国政府就AI模型测试和监管框架进行沟通,这可能进一步延后发布节奏。
3. 中长期观察点
正面因素:
谷歌表示目前约75%的代码由AI生成并通过人工审核后投入生产——说明内部AI coding能力并非为零。
DeepMind CEO Demis Hassabis称谷歌拥有 "迄今为止所有实验室中最大、最广泛的研究团队"。
公司正采取措施整合碎片化的编程工具,新任首席AI架构师Koray Kavukcuoglu正在统一内部AI编程工具,DeepMind内部已成立专门团队。
风险因素:
"打补丁"式发布的风险:谷歌DeepMind已注册了Gemini 3.6 Flash和Gemini 3.5 Flash Light等模型名称,暗示可能以"打补丁"方式推出中间版本——这可能进一步稀释品牌信心。
竞争对手的定价优势:OpenAI的GPT-5.6已以低至每百万输入Token 1美元的价格全面可用,谷歌在追赶性能的同时还需应对价格竞争。
人才流失的恶性循环:顶尖人才的持续流失将进一步削弱谷歌的AI竞争力,形成"落后→人才流失→更落后"的负循环。
五、总结和展望
彭博对Gemini 3.5 Pro延期的报道,其意义远不止"一个产品跳票"那么简单。它是谷歌AI战略结构性困境的一次集中暴露——组织碎片化、内部文化矛盾、人才持续流失,叠加技术上的编程能力短板,共同构成了谷歌在AI竞赛中"起大早赶晚集"的深层原因。
对于投资者而言,这一事件传递的信号是:
AI竞赛的胜负手已从"参数规模"转向"工程化能力" ——谁能最快将前沿模型转化为可规模化的企业级产品,谁就能赢得市场。谷歌目前在这一维度上落后于OpenAI和Anthropic。
Alphabet的"AI折价"(相对于微软30倍PE的22倍PE)有其合理基础——市场正在用估值表达对其AI货币化时间表的不确定性。
Q2财报季将是关键验证窗口——若管理层无法给出令人信服的Gemini路线图和AI变现时间表,股价可能面临进一步压力。
长期来看,谷歌的研发实力和生态规模仍是不可忽视的资产,但"结构性顽疾"的修复需要时间——而且是在竞争对手不会停步等待的时间窗口内。
正如一位前员工所言,谷歌面临的问题不是"能不能做出好模型",而是 "让各业务部门朝同一方向推进,就像把整个海洋之水烧开一样困难" 。在AI这场需要速度、专注和执行的竞赛中,"烧开海洋"的难度正在被市场重新定价。


