大数跨境

业内首款超算+智算的大规模计算底座,在WAIC上我们找到了

业内首款超算+智算的大规模计算底座,在WAIC上我们找到了 量子位
2026-07-21
2
导读:一颗“不走寻常路”的新“芯”

近日,WAIC 2026 成为国产芯片与算力企业的核心展示舞台,108 款芯片、超 200 款智算产品齐聚上海。行业风向发生显著变化:竞争焦点已从单一的“单卡算力”转向“系统创新”与“高效协同”。大规模计算系统性能的较量正式开启。

在众多参展企业中,太初(杭州)集成电路有限公司(简称“太初元碁”)凭借“超智融合”计算系统及自研异构众核芯片引发关注。

先拼架构,再谈单卡

太初元碁 CEO 杨晋喆指出,随着模型参数突破万亿级,Agent 和 AI4S 对 CPU-GPU 协同要求日益提高,单纯堆砌算力的边际收益递减,降低单位算力成本成为核心命题。

这一判断与行业趋势一致。华为、沐曦、阿里平头哥等纷纷推出超节点产品。国盛证券研报认为,国产超节点迎来量产元年,算力竞争范式正从单点峰值性能转向系统级全栈效率比拼。

太初元碁提出 HCU 异构融合计算架构,将 CPU 和 AI 算力核置于同一条高速总线上,支持 M:N 可重构配比。CPU 负责 Agent 调度与数据预处理,XPA 算力阵列专注大模型推理,配合共享分级存储实现冷热数据动态调度。这种设计使算力分配能根据负载动态匹配,避免资源浪费。

为什么异构众核成了必选项?

Agentic AI 时代的到来改变了算力需求结构。传统集群多采用“单路 CPU 搭配多颗 GPU"的固定配置,CPU 仅作为宿主。而在智能体时代,CPU 在规划、决策及交互类通用计算中的权重显著提升。

AMD 及阿里云均指出,计算节点中 CPU 与 GPU 的数量比例正趋近一比一,甚至可能出现 CPU 多于 GPU 的情况。算力系统的优化重心已全面转向 CPU-GPU 的高效协同。太初元碁的 HCU 架构通过在芯片层面整合两者,降低了 I/O 损耗,提升了协同效率。

一颗芯片可打两份工

基于 HCU 架构,太初元碁发布新一代国产 AI 自研芯片 T2 Ultra,具备双模式设计:既可独立承担完整计算任务,也可作为加速卡配合主机协同工作。这种灵活性使其既能部署于边缘或中小规模场景,也能融入大型集群。

T2 Ultra 性能参数亮眼:HPC 算力(FP64)达 38 TFLOPS,满足科学计算需求;FP4 稀疏算力高达 4800 TFLOPS,FP16 稀疏算力为 1200 TFLOPS,原生支持 FP64 至 FP4 全精度覆盖。对客户而言,一套芯片体系即可覆盖多种部署需求,有效降低采购与运维成本。

不只是跑大模型

若 T2 Ultra 是“心脏”,元碁 HyperIntelliX 超智融合计算系统则是“身体”。该系统定位为面向 AI+AI4S 的全国产智算与超算融合平台。

HyperIntelliX 不仅支持大模型,更在 AI4S(AI for Science)领域展现价值,已落地全球气象预测可视化、TecoQSim 量子经典模拟器及大规模虚拟药物筛选等项目。相比多数仅停留在大模型推理阶段的国产芯片,该平台能同时支撑 AI 与 AI4S 双线任务。

AI4S 对高并发、大吞吐及双精度计算有硬性要求。太初元碁团队曾三次获得高性能计算领域“戈登·贝尔奖”,深厚的超算经验为其切入该领域提供了技术底气。

生态迁移:国产芯片真正的硬骨头

硬件可用只是第一步,生态易用才是关键。针对国产芯片迁移成本高的问题,太初元碁发布了两款生态产品。

人工智能开发者社区 2.0 已完成对 Megatron-LM、DeepSpeed、PyTorch、vLLM 等主流框架的适配,提供从模型分析到性能优化的全流程工具链。

新一代国产 AI4S 计算平台则针对科学计算特点进行专项优化。该平台兼容龙芯、申威、飞腾及 x86 等主流 CPU,深度适配 PyTorch、JAX、MindSpore 等框架,并配套 DevKit 开发套件,有效降低算子开发与调优门槛。

依托全栈能力,太初元碁已与清华大学、百度、湖南大学等高校及企业深度合作,在气象、量子、基因分析等领域打造解决方案。其路线倾向于兼容主流框架,通过多元化开发范式满足 80%-90% 的主流场景适配需求,大幅缩短迁移周期。

从累计适配超 40 款 AI 大模型,到联合百余所高校科研机构推动落地,太初元碁正持续加码生态建设。

聊完技术底层讲安全

WAIC 期间,由河南空港智算中心、瑞莱智慧、太初元碁等七家单位联合打造的“全域大模型安全系统”正式发布。

该系统构建于国产可信算力底座之上,涵盖大模型安全评测、数据合规、软件供应链安全等多个维度,并配套独立 AI 安全教育实训中心。在大模型加速进入政务、金融等敏感领域的背景下,安全已成为落地的硬门槛。

看似斗秀 实为国产算力的一次大考

WAIC 2026 不仅是展示舞台,更是国产算力的大考。当前,华为昇腾、寒武纪、沐曦、海光信息等头部企业均已取得显著进展。太初元碁的差异化在于,其定位并非单一芯片替代者,而是整套 AI 基础设施的构建者。

从底层 HCU 架构与 T2 Ultra 芯片,到中层开发者社区与 AI4S 平台,再到上层全域大模型安全体系,太初元碁构建了相互支撑的三层体系。

然而挑战依然存在。国产 AI 芯片市场正从政策驱动向市场驱动转型,行业洗牌窗口即将开启。能否在万卡集群中证明系统稳定性,能否持续降低生态迁移成本,将是决定企业从“可用”走向“好用”的关键。

国产算力竞争已进入新阶段:较量的不再是单点参数,而是体系化能力与生态协同效率。只有真正走完产业闭环落地,才能在未来立足。

【声明】内容源于网络
0
0
量子位
各类跨境出海行业相关资讯
内容 16308
粉丝 1
量子位 各类跨境出海行业相关资讯
总阅读342.1k
粉丝1
内容16.3k