大数跨境

Google 的 Gemini 4 来了,先小范围开放

Google 的 Gemini 4 来了,先小范围开放 石臻说AI
2026-10-02
9
导读:Gemini 4 Argon 把输出上限拉到百万 token,先面向可信网络防御者开放。价格公布了,公众入口与完整计费细节仍待落地。

⭐ 设为星标 · 第一时间收到推送

石臻说AI编辑:石臻
导读: Google 公布了 Gemini 4 Argon:单次输出上限拉到 100 万 token,还准备向可信网络防御者提供不设网络安全护栏的版本。但截至北京时间 10 月 1 日,普通用户还用不上。

100 万 token,给长任务更多空间

先认清这个数字:1M 是输出上限。Google 这次强调的是从此前的 64K 提升到 1M,让模型在一条轨迹里持续推理、生成更长内容。公告没有给出完整 API 参数,也没有解释最终产品里推理 token、工具调用和输出预算如何分别计算。

官方主视觉给出了模型名称;它目前仍处于有限开放阶段。

Google 官方 Gemini 4 Argon 主视觉
Google 官方 Gemini 4 Argon 主视觉

对普通聊天,答案越来越长未必有用。对代码迁移、跨文件修改、多轮实验,模型过早停止就会把工作留给下一轮接续。更高的上限能减少这一类中断,但能持续生成,不等于能持续做对。

Google 把 Argon 的重点放在长时程软件工程、法律与金融等企业知识工作,以及网络安全防御。公告给出的 DeepSWE v1.1 成绩是 77.9%;在衡量端到端业务执行的 AutomationBench 上是 51.3%。两个分数测的任务不同,不能换算成“能接手多少人的工作”。

下面是 Google 发布的评测汇总,读的时候要连同任务类型一起看。

Google 官方评测汇总
Google 官方评测汇总

内部案例比一个总分更容易理解。Google 称,Argon agent 已帮助数据中心释放超过 300 TiB 内存;另一些 agent 正把 C/C++ 代码迁往 Rust,项目规模涉及 Fuchsia Zircon 内核的 80 万行以上代码。

这里有个不能略过的细节:大规模改写仍要经过自动与人工审计、仿真测试和审核,才进入生产环境。公告说的是迁移工作正在进行,不能写成整个内核已经迁完。

另一个案例是 libgav1 视频解码器。Google 称,agent 替换了现有 Rust 移植版中的 3.2 万行 SIMD 代码,通过反复实验让编译器自动向量化,最终速度达到该 Rust 移植版的 2.7 倍。比较对象是原 Rust 版本;官方表述是更接近优化过的 C++,并未说超过 C++。

这些是 Google 披露的内部部署结果。即使评测由外部机构设计,公告展示的成绩也不自动构成公开独立复现。普通用户尚无广泛访问入口,目前还不能据此判断自己仓库里的表现。

网络安全护栏,先对限定对象放开

Argon 能做的防御工作包括自动发现、验证和修补严重漏洞。发现与验证漏洞所需的能力,也可能被用于攻击,这正是这次开放范围需要单独看的原因。

Google 的原话限定了对象:可信防御者,以及 Google 内部团队,将获得不设网络安全护栏的 Argon,以使用完整的前沿网络防御能力。这不能扩写为所有安全规则都被取消,也不能推断未来公众版本会采用相同配置。

官方给出的漏洞修复评测 CWE-bench v1 成绩是 68%,并列第一。图表衡量的是特定任务中的修复表现,不能代表所有真实系统的防御成功率。

Google 官方 CWE-bench v1 评测
Google 官方 CWE-bench v1 评测

Google 还称,Wiz 已通过免费保护关键公共基础设施的 Scan for Good 项目使用 Argon;早期发现包括医院使用的医疗软件中、可能暴露敏感个人信息的严重漏洞。公告没有披露足够细节让外部完整核验,也不能把发现漏洞写成已经完成全部修复。

当前入口是 Fairwind Program 的首批网络防御者和可信测试者。Google 表示将收集反馈、迭代护栏,并参与美国政府自愿性质的发布前模型访问流程,再逐步扩大开放。

公告列出的安全工作也很具体:防止网络与 CBRN 类滥用、抵御间接提示注入、监控模型推理和行动中的越界行为,以及加强沙箱隔离。必要时,监控系统会停止执行。

这意味着,放开特定网络安全限制,需要配套考虑谁能访问、任务在哪里运行、过程如何监测。Google 正在把这些安排与模型发布一起推进。至于能否挡住真实滥用,仍需要后续证据。

价格已公布,开放日期还没定

Google 公布了准备推出时的 API 价格,按每百万 token 计算:



项目
优惠期
优惠期结束后
输入
2 美元
4 美元
输出
10 美元
20 美元

公告还说缓存输入比输入价便宜 95%,但没有说明优惠期什么时候结束。以上是已宣布的价格,不能当成现在就能购买调用的证明。

如果只按公布的输出单价计算,100 万输出 token 对应优惠期 10 美元、之后 20 美元,还没算输入和其他可能的费用。这是上限对应的简单算术,不代表每项任务都会用满,也不是完整账单预测。

长任务的真实成本要看它用了多少 token、重试几次、最终有没有成功。便宜的单价加上很长的失败轨迹,仍可能花得更多。具体计费细节还得等正式 API 文档。

Hacker News 的讨论里,有人对大规模 Rust 迁移感兴趣,也有人追问:模型既然公布了,为什么付费订阅者仍不能用?还有评论质疑任务成本,或问 1M 输出预算与 agent 工具循环是什么关系。这些问题值得追问。不过,匿名评论里的体验、价格比较,都不能拿来给 Argon 下性能结论。

Google 说,后续面向开发者、企业和消费者开放时,将从付费 API 客户和 Google AI Ultra 订阅者开始。公告没有给出明确开放日期,也没有给出可直接调用的模型 ID。“尽快开放”目前仍是一项计划。

Google 这次连同能力一起公布的,还有价格和访问安排。接下来值得等的是公众版本的实际护栏、完整计费文档,以及外部能复现的长任务结果。现在就为它调整工作流,依据还不够。

参考来源:

Google 官方公告:https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/

Google 官方线程:https://x.com/Google/status/2105388143902175529

Google DeepMind 官方线程:https://x.com/GoogleDeepMind/status/2105388084154056939

【声明】内容源于网络
0
0
石臻说AI
AI科技博主,10年+大厂互联网经验,专注: AI资讯|生产力工具|AI提效 | 科技数码 用AI提效,剩下的时间摸鱼 , 🛰:szzdzhp001
内容 237
粉丝 0
石臻说AI AI科技博主,10年+大厂互联网经验,专注: AI资讯|生产力工具|AI提效 | 科技数码 用AI提效,剩下的时间摸鱼 , 🛰:szzdzhp001
总阅读3.6k
粉丝0
内容237