在 Alphabet 发布财报前夕,谷歌集中推出了三款全新的 Gemini Flash 系列模型。此次更新的核心策略明确:牺牲部分峰值性能,优先换取运行效率与成本优势,旨在优化复杂智能体(Agentic)工作流并降低 Token 消耗。
面对 xAI Grok 4.5、OpenAI GPT-5.6 以及 Anthropic Fable 5 等竞品的强势围剿,谷歌选择以“高性价比”作为破局点,试图在激烈的模型大战中确立差异化定位。
牺牲峰值性能,换取效率和更低价格
全新 Flash 系列包含三款模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 以及面向安全场景的 Gemini 3.5 Flash Cyber。该系列旨在通过更高的性价比,推动 AI 智能体的规模化开发。
Gemini 3.6 Flash:平衡质量与效率的主力
作为旗舰款,Gemini 3.6 Flash 主打质量与效率的最佳平衡。其知识截止时间更新至 2026 年 3 月,在编程、知识型任务及多模态推理能力上均有提升,平均输出 Token 消耗较前代降低 17%,特定场景下降幅可达 65%。通过减少中间推理步骤,该模型显著压缩了多步骤工作流的运行成本。
基准测试显示,该模型在代码修改、机器学习研究、文档解析等任务中表现优异。Heavia 和 Harvey 等企业客户反馈,其在视觉处理与数据提取等多模态任务中增强明显。
成本方面,输入价格为每百万 Token 1.50 美元,输出价格从 9 美元降至 7.5 美元。然而,在绝对性能上,Gemini 3.6 Flash 在多数关键基准测试中仍落后于 Claude Sonnet 5 和 GPT-5.6,在智能体编程任务上亦不及 Grok 4.5。鉴于其定价与竞品持平,如何在性能不占优的情况下突围,仍是谷歌面临的挑战。
Gemini 3.5 Flash-Lite:极致性价比的快速模型
定位为“最快、最具性价比”的模型,Flash-Lite 专为高吞吐搜索和大规模文档处理设计,每秒可生成 350 个 Token。其在 SWE-Bench Pro 和 OSWorld-Verified 等基准测试中击败旧款模型,终端工作台评分从 31% 大幅提升至 54%。
价格方面,输入仅需 0.30 美元/百万 Token,输出为 2.50 美元/百万 Token,为高负载企业应用提供了极具竞争力的解决方案。谷歌 CEO Sundar Pichai 指出,组合使用 Flash 系列模型,每年可为企业节省超 10 亿美元 Token 预算。目前,这两款模型已向企业及应用用户开放,Flash-Lite 即将接入 Google 搜索。
对标 Mythos 的平价替代,但设严格限制
针对网络安全领域,谷歌推出了 Gemini 3.5 Flash Cyber。该模型基于 3.5 Flash 优化,专门用于发现和修复软件漏洞,并集成至 DeepMind 的代码安全智能体 CodeMender 中。
谷歌将其定位为高端安全模型的“高性价比替代”。在 CyberGym 基准测试中,Flash Cyber 得分 83.2%,仅比 OpenAI 的 GPT-5.5-Cyber(85.6%)低 2 个百分点,但成本大幅降低。在实际测试中,该模型在两小时内即发现公开 API 的远程代码执行漏洞;在扫描 V8 引擎时,发现了 55 个独立问题,其中 10 个为其他模型未能识别的漏洞,表现优于标准 Flash 模型及 Claude Opus 4.6。
尽管性能强劲,鉴于其具备“攻防一体”的特性,谷歌对访问权限实施了严格控制。目前,Flash Cyber 仅通过 CodeMender 在试点计划中向政府机构及可信合作伙伴开放。相比之下,其潜在对手 Anthropic Mythos 的定价高达输入 10 美元、输出 50 美元/百万 Token。
关键模型缺席,曝 Gemini 4 开启预训练
此次发布中,更引人关注的是“未发布的内容”。谷歌原定于 6 月推出的旗舰模型 Gemini 3.5 Pro 至今仍在测试阶段,导致其在公开榜单前十中暂时缺位。据报道,延期主因是模型在编程能力等关键指标上未达内部预期,即便更新训练数据后改善有限。受此消息影响,Alphabet 股价曾单日下跌约 4.4%。
多位知情人士表示,随着竞品能力提升,谷歌内部对失去市场优势的担忧加剧。复杂的内部协调机制及将 AI 融入搜索、YouTube 等庞大产品线的难度,也拖慢了发布进度。
对此,谷歌回应称已启动“最雄心勃勃”的预训练,目标直指 Gemini 4。这表明 Gemini 3.6 系列更多是在大版本到来前的过渡性展示,意在以“便宜 + 快速”策略占领中端市场,同时为旗舰模型争取时间。此外,谷歌也在研发自研芯片以进一步降低运行成本。
这场赌局的成败,将取决于 Gemini 3.5 Pro 能否尽快落地,以及 Gemini 4 是否能兑现其技术承诺。
参考链接:
https://ai.google.dev/gemini-api/docs/latest-model
https://www.reuters.com/business/google-updates-lightweight-gemini-models-flagship-still-delayed-2026-07-21/
https://www.bloomberg.com/news/articles/2026-07-16/google-gemini-launch-delayed-as-tech-falls-short-of-internal-goals
声明:本文为 AI 前线整理,不代表平台观点,也不构成投资建议,未经许可禁止转载。

