大数跨境

突发,OpenAI首颗「辣椒」芯片压倒英伟达!GPT-6干崩CUDA

突发,OpenAI首颗「辣椒」芯片压倒英伟达!GPT-6干崩CUDA 新智元
2026-08-26
4

新智元报道

OpenAI 首次自研芯片便展现出颠覆性实力。其首款芯片 Jalapeño(墨西哥辣椒)实测数据显示,在 AI 推理性能上全面超越英伟达 GB200 和 GB300 系列。

Jalapeño 实测速度表现惊人:每秒可生成 1459 个 Token,而英伟达 GB200 仅为 535 个;完成同一任务仅需 1.65 秒,GB300 则需近 6 秒,效率差距达 3.6 倍。即便在 GB300 极限解码速度下,Jalapeño 的吞吐量仍为其 104.3 倍。此外,Jalapeño 标称功耗仅 700W,仅为 GB300(1400W)的一半。

著名半导体分析师 Dylan Patel 评价称:“被超越的不仅是 Blackwell 架构,连英伟达下一代 Rubin 芯片也已被甩在身后。”OpenAI CEO 山姆·阿尔特曼对此回应:“我们造了一颗芯片,快得离谱。”

一颗「辣椒」,干翻英伟达旗舰

该结论并非 OpenAI 自卖自夸。权威机构 SemiAnalysis 通过实验室实测证实,Jalapeño 在多项指标上击败了包括英伟达、AMD 及谷歌在内的所有竞品芯片。

Jalapeño 将此前测试过的所有英伟达、AMD、谷歌芯片全线超越。

能效方面,英伟达最新 Vera Rubin 芯片的耗电量足以驱动近三颗 Jalapeño。测试覆盖 GPT-OSS 120B、670B 及 1T 参数模型,结果如下:

  • 每瓦特 AI 工作负载提升 1.5–1.9 倍
  • 端到端延迟降低 1.7–3.6 倍
  • 高交互式工作负载性能提升 2.1–4.1 倍

在 GPT-OSS 120B 模型上,Jalapeño 实现 1459 Token/s 的生成速度,Token 间隔仅 0.69 毫秒,远超人类朗读速度。在高交互场景下,随着出词速度要求提升,其领先优势从 1.7 倍扩大至 104.3 倍。这意味着在对手达到性能瓶颈时,Jalapeño 仍处于高效巡航状态。

若计入供电、散热及网络损耗,Jalapeño 单芯片功耗为 1.125 千瓦,远低于 GB200 的 1.87 千瓦和 Vera Rubin 的 3.3 千瓦。在每兆瓦算力产出上,Jalapeño 可达约 5300 万 Token/s,而 GB200 NVL72 仅约 1000 万。

成本方面,Jalapeño 每小时总拥有成本为 1.56 美元,与 H100 持平,而 Vera Rubin 高达 3.61 美元。值得注意的是,当前测试未开启投机解码等优化技术,SemiAnalysis 估算若启用该技术,每 Token 成本可再降三分之二以上。

九个月,GPT‑Astra 一路干到了流片室

从设计到流片,OpenAI 仅耗时九个月,远短于行业常规的 18-36 个月。其核心秘诀在于引入自家最强模型 GPT-Astra(传闻中的 GPT-6)辅助芯片研发。

协助开发 Jalapeño 的模型名为 GPT-Astra,即外界热议的 GPT-6。

GPT-Astra 深度参与了“设计 - 测量 - 验证”全流程,并优化了算术电路。数据显示,AI 辅助使 SIMD 单元面积减少 8%,矩阵引擎面积减少 10%,且在时序和功耗上表现更优。

Jalapeño 主计算 Die 面积约 840 平方毫米,已逼近 EUV 光刻机掩模版 858 平方毫米的物理极限。在能效比上,其每瓦 HBM 带宽为 22,是第二名 Rubin(11.1)的两倍;每瓦 FLOPs 为 19.1,与 Rubin(19.4)相当,但功耗仅为后者的三分之一。

目前测试基于 A0 步进版本,B0 版本已在晶圆厂生产中,预计每瓦性能再提升 25%。凭借 Codex 与 GPT-Astra 的组合,OpenAI 在两个月内将三个开源模型优化至高性能状态,其中 AI 生成的代码在关键模块上比人类专家快 1.5 至 1.8 倍。

“AI 设计芯片,芯片运行 AI,AI 再优化芯片”,这一飞轮效应已在 OpenAI 内部形成闭环。

CUDA 护城河,死了?

英伟达长期依赖 CUDA 软件生态构建护城河,但 SemiAnalysis 指出,这一壁垒可能正因速度劣势而瓦解。

尽管英伟达 Rubin 芯片比 Jalapeño 早一个月完成流片,但其软件栈迭代缓慢,缺乏第三方实测数据支持。相比之下,OpenAI 从零开始架构设计,无历史包袱,软件启动速度更快。

SemiAnalysis 评论道:“跑在英伟达 GPU 上的 GPT-5.6 Sol 等模型,正被用来设计一颗威胁 CUDA 护城河的芯片。英伟达的 GPU 正在实时催生自己的接班人。”

10 吉瓦,这才刚开场

Jalapeño 仅是 OpenAI 算力版图的第一枪。去年 10 月,OpenAI 与博通签署 10GW 定制加速器合作协议,规模相当于十座核电机组满负荷运转。

系统机柜命名颇具特色:CPU 托盘称"Katsu"(日式炸猪排),芯片柜称"Vindaloo"(印度咖喱),交换机称"Chana"(鹰嘴豆),体现其全球化视野与记忆点设计。

Jalapeño 为第一代产品,Gen2 已在深度开发,Gen3 正在成形。量产将于 2027 年逐步爬坡,下一里程碑为 100 兆瓦部署。

值得注意的是,OpenAI 数据中心负责人 Chris Malone(“星际之门”项目掌门人)近日离职。在 IPO 临近之际,核心高管变动引发外界对内部局势的关注。然而,即便面临人事震荡,OpenAI 的“模型 + 芯片 + 软件”飞轮仍在加速运转。

英伟达虽仍居王座,但挑战者已不再门外徘徊,而是直接进入机房。英伟达的对手,终于开始自己制造“英伟达”。

参考资料:
https://openai.com/index/jalapeno-first-results/
https://openai.com/index/the-full-stack-behind-abundant-intelligence/

编辑:摩西 桃子

【声明】内容源于网络
0
0
新智元
智能+中国主平台,致力于推动中国从互联网+迈向智能+新纪元。重点关注人工智能、机器人等前沿领域发展,关注人机融合、人工智能和机器人革命对人类社会与文明进化的影响,领航中国新智能时代。
内容 16491
粉丝 0
新智元 智能+中国主平台,致力于推动中国从互联网+迈向智能+新纪元。重点关注人工智能、机器人等前沿领域发展,关注人机融合、人工智能和机器人革命对人类社会与文明进化的影响,领航中国新智能时代。
总阅读357.4k
粉丝0
内容16.5k