大数跨境

谷歌深夜扔出"王炸":Gemini 3.8 性能翻倍,价格却一分没涨?

谷歌深夜扔出"王炸":Gemini 3.8 性能翻倍,价格却一分没涨? 觉醒AI科技
2026-09-03
5
导读:谷歌深夜放招:Gemini 3.8 来了,六周内第三款两个版本,一个通用,一个专打网络安全。
点击蓝字
关注我们

谷歌在深夜发布了 Gemini 3.8,距离上一款 Flash 系列模型问世仅六周时间


据官方介绍,Gemini 3.8 Flash 延续了前代的速度与成本优势,同时在推理能力和代码生成方面更进一步,特别针对软件工程、Agent 任务以及需要多步推理的复杂场景进行了强化。


此次发布的 Gemini 3.8 分为两个版本:


Gemini 3.8 Flash 作为主力工作模型,相比 3.7 Flash 在软件工程、Agent 任务以及专业领域的多步推理上均有明显进步。


定价方面与 3.7 Flash 保持一致:输入每百万 Token 0.75 美元,输出每百万 Token 3.75 美元。


另一个版本 Gemini 3.8 Flash Cyber 则专注于网络安全领域。


这是谷歌目前最强的网络安全专用模型之一,核心能力在于漏洞挖掘和自动补丁修复,仅通过 Fairwind Program 向获得认证的安全防御人员开放。


谷歌强调,两个版本虽部署场景不同,但共享同一底层能力,并通过长期 Agent 循环机制持续增强表现。


DeepMind 核心成员姚顺宇评价:模型层面只是一小步,但对 RSI(递归自我改进)而言却是重大跨越。



Aigora.ai CEO John Ennis 将其与 Anthropic 模型对比,认为 Gemini 3.8 Flash 拥有接近 Opus 5 的代码质量,成本却低得多,且响应速度极快。



01

Gemini 3.8 Flash:

专攻长周期代码与自主 Agent


相较 3.7 Flash,新版本提升显著,多项任务表现已逼近成本更高的旗舰模型。



在 DeepSWE v1.1 长周期软件工程测试中,Gemini 3.8 Flash 能独立完成复杂工程问题的端到端求解,性能超越多数参数量更大的前沿模型,而成本只是零头。


在需要深度分析与报告的专业领域,如金融定量分析和法律任务中,Gemini 3.8 Flash 在 Vals Finance Agent V2 和 Harvey 法律 Agent Benchmark 等测试里均优于 3.7 Flash 及其他前沿模型。



HLE-Verified 测试中拿到 54.9% 的成绩,说明它在横跨 STEM、人文及专业领域的多步骤复杂推理上具备相当实力。

图片



性能提升的关键在于:Gemini 3.8 Flash 愿意为任务投入更多算力。


面对复杂任务时,它会执行更深的推理链条,反复调用工具。尤其在较高推理强度设置下,Token 消耗可能明显增加。


若对计算效率有硬性要求,开发者可调低推理强度,或继续使用持续支持的 3.7 Flash,后者更适合效率优先的场景。


02

Gemini 3.8 Flash Cyber:

网络安全专家级能力


通过 Fairwind Program 向可信安全防御人员开放的 Gemini 3.8 Flash Cyber,在保持 Flash 系列速度与成本优势的同时,为日益严峻的网络安全形势提供了关键助力,让安全团队得以快速迭代。


漏洞自主发现在行业标准 CyberGym 基准测试中,Gemini 3.8 Flash Cyber 展现出前沿水平的自主漏洞挖掘能力。


不仅超越 3.5 Flash Cyber,也击败了参数量明显更大的旗舰模型。




为贴近真实防御场景——现实远不止 CyberGym 中的 C/C++ 代码库,谷歌还用覆盖 20 种编程语言、包含复杂代码库的内部基准进行了更全面评估。


结果显示,相比前代模型,Gemini 3.8 Flash Cyber 实现显著跃升,漏洞发现成功率突破 70%。



图片


自动化补丁修复研发之初,团队就着力赋予安全防御人员专家级能力,使其在攻防对抗中占据优势。


因此资源优先投向漏洞修复能力建设,而非漏洞利用等攻击侧能力。


Collinear 运营的 CWE-Bench 是评估补丁修复能力的高难度外部基准。


在该测试中,Gemini 3.8 Flash Cyber 处于性能与成本权衡的 Pareto 前沿:Pass@1 成功率 47.2%,与领先旗舰的 47.8% 相差无几,成本却显著更低。

03

守护 Google 代码安全


Google 已内部部署 Gemini 3.8 Flash Cyber 保护代码安全:


  • Chrome 安全团队发现,相比规模更大的商业模型,其为 Chrome 漏洞生成的正确修复补丁数量提升 2.6 倍。

  • Wiz 的内部渗透测试基准显示,相比其他前沿旗舰,漏洞发现召回率提升 7.5%~9.7%,成本降低 2.3~5.2 倍。

  • Google 云漏洞研究团队借助该模型,不到 2 小时便发现一处关键基础漏洞,而以往这类研究通常耗时数月。


目前,Gemini 3.8 Flash 已向开发者、企业和消费者全面开放。开发者可通过 Google AI Studio、Android Studio 等平台调用;企业用户经由 Gemini Enterprise 使用;Gemini AI Pro 和 Ultra 用户则可在 Gemini App、Google搜索 AI Mode 及 Google Sheets 中体验。


网络安全方面,Google 通过 Fairwind Program 向可信政府机构、关键基础设施运营商和软件维护人员优先开放 Gemini 3.8 Flash Cyber 的访问权限。

图片/素材来源于网络,版权归原作者所有,侵删



点击下方“阅读全文”学习更多

【声明】内容源于网络
0
0
觉醒AI科技
1234
内容 208
粉丝 0
觉醒AI科技 1234
总阅读11.2k
粉丝0
内容208