01
PART
WAIC 2026 国产超节点全景
DOMESTIC SUPERPOD LANDSCAPE
最瞩目的无疑是Atlas 950 超节点,这款 1024 卡 NPU 集群以 1 EFLOPS FP8 算力荣获大会 SAIL 奖。基于灵衢互联协议,256TB 统一内存编址、3μs RTT 超低时延,首次实现了跨物理节点的统一内存编址。而前代 384 超节点已累计部署 750+ 套,覆盖互联网、金融、医疗等 20+ 行业,是国内唯一训练出 SOTA 模型的商用超节点。
02
PART
芯片新品:天垓 300 等集中发布
NEW CHIP LAUNCHES AT WAIC 2026
03
PART
从芯片到系统:三大竞争维度
BOARD → SYSTEM → ECOSYSTEM
维度一:互联协议竞技
WAIC 2026 现场,各家争相展示自研互联方案——华为灵衢协议(3μs RTT)、壁仞 BLink 2.0(在网计算+拥塞控制)、百度 XPU-Link(32–1024卡扩展)、摩尔线程自研互联协议…… 各家都在试图通过独有的通信协议定义超节点内的数据流动效率。互联已经成为算力集群的第一竞争力。
维度二:物理工程极限
一个超节点功耗可达 400KW,单台高密度机柜 48KW(三年前国内普通机柜仅 6KW)。供电、液冷散热、承重、布线——每一项都是工程级挑战。摩尔线程直言:超节点里坏一张卡,价值上亿的设备就可能停摆,可靠性解耦性成为关键。
维度三:下一代探索方向
大会释放了多个前沿信号——光互连(壁仞 NPO / 曦智 2000 卡全光交换)、面板级封装(燧原 CoPoS / 玻璃基板)、太空算力(上海「星枢计划」天地一体化 / 清微太空 AI 2026 年底入轨)。算力布局正从地面扩展到太空,从电互连走向光互连。
04
PART
系列对比
BLACKWELL BENCHMARK
关键洞察: Atlas 950 超节点在 1024 卡规模下实现了 1 EFLOPS FP8,性能赶超英伟达 GB300。简单换算:Atlas 950 用 14 倍卡数实现了相当的集群算力——这是单卡算力差距的真实写照。但另一方面,曙光 8000(登峰)以十万卡级全国产方案提供了约 10 EFLOPS 的系统级算力。从 WAIC 2025 到 WAIC 2026,国产算力最宝贵的不是缩小了单卡差距,而是 跨越了「从单卡到系统」的门槛。
05
PART
结论与展望
OUTLOOK
国产算力「超节点」能力已初步站稳
Atlas 384 超节点已部署 750+ 套并训练出多个 SOTA 模型,系统成熟度已获商用验证。十万亿级参数模型的训练场景, 950 超节点已具备交付能力。
生态仍是最大短板
CUDA 依然拥有压倒性优势。但大会透露了新趋势:产业界正推动「写一套代码,适配所有国产硬件」的统一工具链构想,以及 CANN / MindSpore 的全面开源开放。生态整合是国产算力走向独立的最后一道关口。
未来方向:Token 价值取代 TFLOPS 竞赛
燧原科技在大会提出:Token 正成为 AI 产业核心计价单位,行业关注重点从「算力规模」转向「Token 生成效率与交付质量」。当国产超节点集群初步建成,谁能以最低的 Token 成本提供最可靠的服务,谁就是真正的赢家。
CLOSING
从 WAIC 2025 的「单卡对标」到 WAIC 2026 的「超节点集群」,国产算力用一年时间跨出了最艰难的一步:系统化。单卡追赶仍在路上,但集群层面的算力供给已可支撑十万亿参数模型的训练与推理。下一年,当全国产十万卡集群和光互连全面铺开,也许我们会看到一个全然不同的算力版图。
如果你觉得今天这篇有收获,欢迎点赞、在看、转发三连

