大数跨境

谷歌大跌4.4%!彭博:Gemini旗舰模型再次“跳票”!编程能力不及内部预期!巴菲特“带货”也不灵了?(深度)

谷歌大跌4.4%!彭博:Gemini旗舰模型再次“跳票”!编程能力不及内部预期!巴菲特“带货”也不灵了?(深度) Ai&芯片那点事儿
2026-07-17
1
导读:谷歌在AI竞速中正面临日益严峻的内部压力。
谷歌在AI竞速中正面临日益严峻的内部压力。彭博报道谷歌旗舰最强模型Gemini 3.5 Pro的发布已较原定计划推迟数月,主因在于谷歌正试图提升模型的编程能力,但进展不如预期。许多工程师和管理层担忧谷歌正在失去市场先机。部分研究人员的挫败感已演变为离职潮,Anthropic等成为主要去向。竞争对手在编程能力上接连超越,令谷歌的市场地位愈加被动。消息落地,谷歌股价当日重挫4.44%。

图片

一、事件概述:一次"标志性"的延期

彭博社于7月16日报道,谷歌最强大的旗舰AI模型Gemini 3.5 Pro的发布时间已较原计划推迟数月,核心原因是模型的编程能力未达到内部预期

Gemini 3.5 Pro最初于2026年5月在Google I/O大会上宣布,时任CEO桑达尔·皮查伊表示该模型已在内部使用,预计6月向更广泛用户开放。然而两个月过去,模型仍未面向公众发布。报道援引10位现任及前员工的说法称,此次延期已在谷歌内部引发广泛挫败感

市场反应迅速且剧烈。Alphabet股价周四盘中一度跳水逾5%,最终收跌约4.44%,市值蒸发数百亿美元。截至7月16日,Alphabet股价约356美元,较5月52周高点402.62美元已下跌约11.6%

二、延期原因深度剖析

1. 直接原因:编程能力"不及格"

报道明确指出,Gemini 3.5 Pro在代码生成方面的表现低于内部预期。具体而言:

  • 训练数据更新失败:谷歌上月底更新了训练Gemini所用的数据以提升编程能力,但结果令人失望

  • 内部基准全面落后:内部基准测试显示,Gemini在编程任务上落后于Anthropic和OpenAI的模型。在谷歌自家发布的Android Bench基准测试中,Gemini 3.1 Pro仅排名第五,落后于GPT-5.4、Claude Sonnet 5和Claude Fable 5;Gemini 3.5 Flash虽定位为"更廉价、更快速"的替代方案,但在安卓开发场景下延迟更高、任务成功率低了9个百分点,且单次基准测试花费高达147.1美元,是Gemini 3.1 Pro Preview的三倍

  • 重新预训练:据报道,Gemini 3.5 Pro已连续错过三个发布截止日期,谷歌甚至放弃了原始基础模型并从头开始重新预训练。预训练是构建前沿AI模型最昂贵的阶段——耗时数月、消耗海量数据,决定了模型的能力天花板。选择重新预训练而非继续微调,等于承认原始模型的能力天花板本身就"放错了位置"

2. 深层原因:谷歌的"结构性顽疾"

彭博报道揭示的问题远不止技术层面:

内部组织碎片化。Google Cloud、DeepMind和Android团队都在独立开发面向开发者的AI编程工具,消费产品团队也参与其中,形成内部竞争而非协同,拖慢了整体进度

"大船难掉头"的整合难题。谷歌需要将AI融入搜索、地图、YouTube等庞杂的产品矩阵,多层利益相关方参与审批,复杂决策流程导致发布速度远慢于初创公司。一位前员工形容,让各业务部门朝同一方向推进,就像 "把整个海洋之水烧开一样困难" 。

内部文化矛盾。部分工程师持保守观点,认为重要代码仍应由人工编写以符合谷歌标准。AI工具推出初期,员工甚至曾被限制使用Gemini编写代码,担心专有代码泄露至训练数据。这些规定虽已放宽,但早期限制了工程师尝试AI开发的机会。

人才持续流失。Transformer论文合著者Noam Shazeer(谷歌曾 reportedly 花费27亿美元将其从Character.AI召回)于6月离职加入OpenAI;诺贝尔奖得主John Jumper在同一周加入Anthropic。报道指出,对谷歌竞争地位的挫败感是人才外流的核心驱动因素

三、竞争格局:差距在扩大,而非缩小

Gemini 3.5 Pro延期的背景是竞争对手正在加速前进:

竞争对手
近期动态
OpenAI
7月9日发布GPT-5.6 Sol,CEO Sam Altman称其在代理编程任务上Token效率提升54%
Anthropic
Claude Fable 5在Android Bench以84.5%准确率登顶;此前因国家安全担忧被限制的Mythos 5和Fable 5已在6月底恢复
Meta
上周发布Muse Spark 1.1,被AI负责人称为"最强的代理和编程模型"

Android Bench最新排名中,Anthropic的Claude Fable 5以84.5%的准确率位居榜首,OpenAI的GPT-5.5以80.2%紧随其后,而Gemini 3.1 Pro仅位列第五。这一差距在编程这一"大语言模型最重要的企业应用场景"中尤为致命

四、深度分析

1. 市场反应的逻辑:不仅是"一个模型延期"

股价下跌4%-5%看似反应过度,实则反映了更深层的担忧:

AI货币化时间表被打上问号。Alphabet当前前瞻市盈率约22倍,低于微软的30倍。市场给予的"折扣"本身就反映了对其AI变现能力的怀疑。Gemini延期进一步强化了这一叙事——微软已将GPT-5集成至Azure、GitHub Copilot和Microsoft 365并产生可衡量收入,而谷歌的关键模型仍在"重新预训练"

超过800亿美元AI投资的回报不确定性。Alphabet已在AI领域承诺超过800亿美元投资,包括与伯克希尔·哈撒韦的 landmark 交易。旗舰模型的延期直接威胁到这些投资的回报周期

"结构性落后"而非"暂时性挫折" 。报道揭示的内部组织碎片化、文化保守主义和人才流失,是深层次的结构性问题,而非简单的时间问题。一名技术分析师指出: "这次延期关乎代理工作,而非聊天机器人的打磨——企业买家现在用编程、工具使用和长周期任务来测试模型,而谷歌的内部评估发现原始模型无法通过这些门槛"

2. 短期风险

  • 无明确发布时间表:谷歌尚未公布Gemini 3.5 Pro的修订发布时间

  • Q2财报临近:Alphabet将于近期发布Q2财报,Gemini延期将成为分析师质询的焦点。

  • 政府监管压力:谷歌正与美国政府就AI模型测试和监管框架进行沟通,这可能进一步延后发布节奏

3. 中长期观察点

正面因素

  • 谷歌表示目前约75%的代码由AI生成并通过人工审核后投入生产——说明内部AI coding能力并非为零。

  • DeepMind CEO Demis Hassabis称谷歌拥有 "迄今为止所有实验室中最大、最广泛的研究团队"

  • 公司正采取措施整合碎片化的编程工具,新任首席AI架构师Koray Kavukcuoglu正在统一内部AI编程工具,DeepMind内部已成立专门团队

风险因素

  • "打补丁"式发布的风险:谷歌DeepMind已注册了Gemini 3.6 Flash和Gemini 3.5 Flash Light等模型名称,暗示可能以"打补丁"方式推出中间版本——这可能进一步稀释品牌信心。

  • 竞争对手的定价优势:OpenAI的GPT-5.6已以低至每百万输入Token 1美元的价格全面可用,谷歌在追赶性能的同时还需应对价格竞争。

  • 人才流失的恶性循环:顶尖人才的持续流失将进一步削弱谷歌的AI竞争力,形成"落后→人才流失→更落后"的负循环。

五、总结和展望

彭博对Gemini 3.5 Pro延期的报道,其意义远不止"一个产品跳票"那么简单。它是谷歌AI战略结构性困境的一次集中暴露——组织碎片化、内部文化矛盾、人才持续流失,叠加技术上的编程能力短板,共同构成了谷歌在AI竞赛中"起大早赶晚集"的深层原因。

对于投资者而言,这一事件传递的信号是:

  1. AI竞赛的胜负手已从"参数规模"转向"工程化能力" ——谁能最快将前沿模型转化为可规模化的企业级产品,谁就能赢得市场。谷歌目前在这一维度上落后于OpenAI和Anthropic。

  2. Alphabet的"AI折价"(相对于微软30倍PE的22倍PE)有其合理基础——市场正在用估值表达对其AI货币化时间表的不确定性。

  3. Q2财报季将是关键验证窗口——若管理层无法给出令人信服的Gemini路线图和AI变现时间表,股价可能面临进一步压力。

  4. 长期来看,谷歌的研发实力和生态规模仍是不可忽视的资产,但"结构性顽疾"的修复需要时间——而且是在竞争对手不会停步等待的时间窗口内。

正如一位前员工所言,谷歌面临的问题不是"能不能做出好模型",而是 "让各业务部门朝同一方向推进,就像把整个海洋之水烧开一样困难" 在AI这场需要速度、专注和执行的竞赛中,"烧开海洋"的难度正在被市场重新定价。


【声明】内容源于网络
0
0
Ai&芯片那点事儿
探索半导体及AI世界的的新鲜事
内容 1493
粉丝 2
Ai&芯片那点事儿 探索半导体及AI世界的的新鲜事
总阅读27.2k
粉丝2
内容1.5k