点击上方蓝字关注我们
不是发布会,是一次赛道重置的信号。
北京时间5月20日凌晨,Google I/O 2026在加州山景城开幕。CEO皮查伊上台第一张幻灯片不是产品,而是几个数字:Gemini月活用户突破9亿,一年翻了一倍;谷歌每月处理的AI token达到3200万亿,是去年的7倍;两年前这个数字只有9.7万亿。
然后他扔出了Gemini 3.5 Flash。
这不是一次常规的模型更新。整个发布会13项核心发布,指向同一个方向——AI正在从"你问我答"变成"我替你干"。Google这次不是来追赶OpenAI的,而是来定义下一条赛道。
01 "Flash"这个小词,把行业格局撕开了一道口子
先看硬数据。
Gemini 3.5 Flash,输出速度289 tokens/秒。GPT-5.5和Claude Opus 4.7在同等条件下大约每秒输出60-70 tokens。4倍。 这不是"快一点",是你在等GPT吐完一段回答的时间,Flash已经吐完四段了。
更值得关注的是性能表现。在Terminal-Bench编码测试上,Gemini 3.5 Flash拿了76.2%,而上一代旗舰Gemini 3.1 Pro只拿了70.3%。在MCP Atlas智能体基准测试上,Flash比3.1 Pro高出整整21.6分。
一个"轻量快速版"模型,在多项核心基准上反杀了自家上一代旗舰。这在AI行业里并不常见。
过去两年的行业默认逻辑是:大模型=强但贵且慢,小模型=快但笨且便宜。这是一个三角妥协。Gemini 3.5 Flash把这个三角形打碎了——它又快又强,而且对普通用户免费。
Google官方的定位是:"迄今为止能力最强的智能体与编程模型。"注意,没有"之一",没有"Flash级别中最强"的限定。这背后藏着一个判断——AI模型的核心指标正在从"智商分"变成"工作效率"。
⚡ 核心观点
一个基准测试得分95但输出慢如蜗牛的模型,和一个得分90但快到飞起的模型,在真实工作场景中,后者能做的事多得多。你让一个超级聪明的人一个小时只能写三句话,不如让一个聪明程度90分的人一小时写一千字。
02 Spark——AI不再等你问,而是替你干
如果Gemini 3.5 Flash是发动机,那Gemini Spark就是配上方向盘和四个轮子的整车。
Spark是一个全天候在线的AI个人代理。它运行在Google Cloud虚拟机上,7×24小时不眠不休。你关掉电脑、合上手机,Spark还在后台替你干活。
Google在发布会上的演示场景很接地气:用户正在组织社区派对,Spark自动汇总邮件回复、统计每个人带什么菜、追踪谁没确认、生成提醒邮件、同步到Google Sheets。全程用户不需要打开任何一个App。
这不是"我问一句你答一句"的ChatGPT模式。这是"我给你一个目标,你替我跑完全程"的Agent模式。
这个动作最核心的优势在于——它深度整合了Gmail、Docs、日历、Sheets这一整套Google Workspace。全球有超过30亿Google活跃用户,其中企业用户数以亿计。当Spark在你的邮箱里自动分类邮件、在日历上帮你安排会议、在Docs里帮你起草文档——它不是在和你"聊天",它是在你每天真实工作的场景里干活。
这跟OpenAI的策略有本质区别。OpenAI的方向是"做一个超级聪明的通用模型,然后通过各种API让开发者接入"。Google的方向是"把超级快的模型塞进十几亿人每天都在用的产品里,你甚至不需要知道背后是什么模型"。
这是两套底层逻辑。在所有产品都Agent化之后,入口比模型更重要。Google有搜索、邮箱、浏览器、手机操作系统、地图、YouTube。如果每一个入口都变成一个智能代理,那这就是一个AI操作系统。而OpenAI没有操作系统——它只有一个App,ChatGPT。
💡 关键区别
Google卖的是"在你看不到的地方,AI已经帮你把事情做好了";OpenAI卖的是"你想做什么,来问我"。
03 Omni和搜索升级:Google在下一盘什么棋
除了Flash和Spark,Google还发布了Gemini Omni——一个"从任何输入生成任何输出"的全模态世界模型。文字、图片、音频、视频,进什么出什么,不用切换模型。
不过这东西目前看还很早期。Omni Flash已经上线,Omni Pro在路线图上,真正好用的视频创作能力还在等。Omni不是这场发布会的核心。
真正被低估的,是搜索的25年来最大改版。
Google的搜索框不再只是一个文本输入框。你可以扔图片、扔文件、扔视频、扔Chrome标签页进去。搜索背后的引擎已经全面升级为Gemini 3.5 Flash——每次搜索跑的,是一个接近旗舰水平的AI模型,而且完全免费。
Search AI Mode的月活已经超过10亿,查询数每季度翻倍。一个用了25年的产品形态被AI彻底重构了。当你每天用Google搜索的时候,你在免费使用一个价值百亿美元的AI基础设施。
这就是Google最锋利的刀。它不需要你订阅$20或者$200一个月的AI服务。你已经在用了,你已经在付费了——通过广告。Google把AI成本摊进了它最成熟的商业模式里,然后对你说"免费"。
OpenAI和Anthropic没有这种商业模式。它们必须直接向用户收钱。
04 免费意味着什么——AI付费模式的微妙时刻
这是这场发布会最深层的信号。
Gemini 3.5 Flash,消费者端免费。API端定价:输入$1.50/百万tokens,输出$9.00/百万tokens——比Claude Sonnet 4.6的输出便宜将近一半。Google还发了个$100/月的新订阅AI Ultra,把Spark全天候代理功能塞进去,正好卡在ChatGPT Pro($200)和Claude Max之间的价格空档。
AI的价格天花板,被Google一次性拉低了一大截。上层有$100订阅的专业代理服务,下层有完全免费的Flash模型,中间有庞大的广告收入补贴。
过去两年,ChatGPT靠先发优势和GPT-5系列的智能优势建立了品牌溢价。但当市面上出现一个免费、4倍快、智能程度差距不大的替代品时,品牌溢价的护城河就裂开了。
而且Google还有一个OpenAI没有的武器——全场景入口。你的邮件在Gmail里,日程在Google Calendar里,文件在Google Drive里,搜索用Google,手机用Android,视频看YouTube。当AI代理渗透进所有这些入口,切换成本会高到离谱。
未来12-18个月,AI行业的商业模式可能走向几种方向:
不管哪种,有一点是确定的:卖AI订阅这件事,正在从暴利时代进入微利时代。 如果你是一家靠API调用差价赚钱的AI创业公司,Google的定价牌值得认真看一眼。
05 但也不是全无隐忧
说几句客观的。
第一,Gemini 3.5 Flash在长上下文场景下的表现还有短板。有技术评测显示,在128K窗口上的检索准确率只有77.3%,不如3.1 Pro的84.9%。这意味着处理超长文档、法律合同、大型代码库时,Flash不一定是最优选。
第二,Omni的视频生成能力目前主要集成在YouTube Shorts里,对专业创作者的可用性还需要时间验证。Google把"视频创作"这个旗帜举得很高,但脚还没完全落地。
第三,Spark虽然概念很炸,但全自动代理在现实中遇到的权限问题、数据安全问题、用户信任问题,都不是一个发布会能解决的。你在多大程度上愿意让一个AI自动读你的邮件、替你回复、帮你花钱?这需要时间来建立信任。
⚠️ 注意
Flash很强,但不是万能。长文档处理、专业视频创作、全自动代理的信任问题,这些短板目前还没有被解决。
给普通人的三个信号
如果你没时间看完全文,这三句话是核心判断:
第一,如果你还没开始用Gemini,现在是最好的入坑时机。 免费、4倍快、智商接近旗舰——在这个价格面前,没有任何理由不去试。
第二,如果你在付费订阅ChatGPT或Claude,但大部分使用场景是日常问答、写作辅助、代码助手——可以考虑降级或取消。 对80%的普通用户来说,Gemini 3.5 Flash的免费版已经够用了。省下的$20/月,一年$240,够买一张回家的机票。
第三,2026年下半年,AI行业的关键词不是"参数",是"代理"。 谁能让AI真正替你干活——不只是回答你的问题——谁就能拿下下一阶段的船票。Google这场发布会最大的意义,不是发了一个模型,而是画了一条新的起跑线。
你觉得免费AI会终结付费订阅时代吗?你愿意让一个AI 全天候代理你的工作吗?评论区聊聊。
欢迎加入交流群
不定期弹送福利

