2026年9月2日
科技

中国超算“灵晟”登顶TOP500:纯CPU架构突围美国芯片封锁

[SCNet 国家超算]TokenPlan 不建议买

一、时隔九年重返榜首,算力领先第二名超20%

2026年6月23日,德国汉堡,第67届全球超级计算机TOP500榜单在ISC 2026大会现场揭晓。一台此前从未上榜的中国系统——“灵晟”(LineShine),以2.198 Exaflop/s的持续双精度浮点性能首次入榜即登顶全球第一。

美国制裁下中国超算“灵晟”仍夺冠,国产架构成关键
美国制裁下中国超算“灵晟”仍夺冠,国产架构成关键

这一数字意味着什么?2.198 Exaflop/s,即每秒2.198×10¹⁸次浮点运算。参与TOP500项目的科学家给出的通俗解释是:“灵晟”工作1秒,相当于全球70亿人连续计算近10年。系统总设计师、国家超级计算深圳中心主任卢宇彤在受访时也使用了同一组比喻。

这是自2017年“神威·太湖之光”之后,中国超算时隔九年再次登顶TOP500。排名上,“灵晟”领先第二名——美国劳伦斯·利弗莫尔国家实验室的“埃尔卡皮坦”(El Capitan)超过20%。后者以1.809 Exaflop/s位居第二。第三名是美国橡树岭国家实验室的Frontier(1.353 Exaflop/s),第四名是阿贡国家实验室的Aurora(1.012 Exaflop/s),第五名是德国于利希超算中心的JUPITER Booster(1.000 Exaflop/s)。

至此,全球E级(每秒百亿亿次级别)超算系统从四台增至五台,首次在亚洲、北美和欧洲同时拥有E级算力部署。

二、不用一颗GPU:一条被“逼”出来的技术路线

“灵晟”登顶的真正看点,不在排名,而在架构。全球前十的超算中,绝大多数采用CPU+GPU的混合架构——CPU负责调度,GPU负责大规模并行计算。“埃尔卡皮坦”搭载AMD第四代EPYC处理器与Instinct MI300A加速器,Frontier同样基于AMD平台。“灵晟”走了一条截然不同的路:整机没有使用任何GPU。

据TOP500官方披露,“灵晟”部署于国家超级计算深圳中心,由深圳云计算中心建造,基于国产“灵坤”平台。核心计算单元是国产自研LX2处理器——基于ARMv9架构,每颗集成304个核心,主频1.55GHz,整机共约1379万颗CPU核心。系统搭载自研“灵启”高速互联网络与麒麟操作系统。整机功耗约42.2兆瓦,能效52.07 GFlops/瓦。

“灵晟”超算全球第一,日媒:中国向世界证明,即便在制裁下也能胜出
“灵晟”超算全球第一,日媒:中国向世界证明,即便在制裁下也能胜出

为什么选择纯CPU路线?这不是技术选型上的“偏好”,而是被外部条件框定后的“最优解”。自2022年起,美国逐步收紧对华先进AI半导体出口管制,英伟达A100、H100及专为中国市场调整的H800、H20等产品均被纳入管制范围。此后限制层层加码——2026年1月,美国商务部工业与安全局进一步调整审批流程,虽然H200、AMD MI325X等可通过个案审批出口,但门槛并未实质降低;6月,美方堵住了中资企业通过海外子公司购买先进AI芯片的漏洞。据路透社报道,“灵晟”不含任何先进AI芯片。

卢宇彤在专访中介绍,“灵晟”的核心思路,是把类似GPU的矩阵加速计算能力引入CPU内部,让CPU自带加速能力——团队称之为“Online Acceleration”的全CPU架构。LX2处理器内部集成了AI矩阵加速单元,原生支持FP64、FP32、BF16、FP16、INT8等多种精度格式。配合国产高带宽内存(HBM),内存带宽相比传统CPU提升10倍,再通过自研高速互联与全栈软件,把超算算力和智能算力在体系结构层面融合起来。

TOP500联合创始人、田纳西大学杰克·唐加拉(Jack Dongarra)对此评价:“百亿亿次计算正步入成熟期,同时面向AI的计算融合也在快速推进。”

三、“双料冠军”与AI短板

“灵晟”不仅拿下TOP500第一,还在衡量实际复杂问题求解能力的高性能共轭梯度(HPCG)基准测试中以22 PFlop/s的成绩登顶,成为“双料冠军”。这意味着它在追求峰值速度的同时,也在实际应用场景中保持了较高的计算效率。

但在AI赛道,“灵晟”的表现要温和得多。在衡量混合精度AI性能的HPL-MxP基准测试中,“灵晟”以7.92 Exaflop/s排名第四,落后于“埃尔卡皮坦”、Frontier和Aurora三台美国机器。从双精度到混合精度,LX2处理器的性能仅提升3.6倍——而集成专用低精度加速器的GPU方案,通常能实现数倍甚至十数倍的跃升。

这一差距并不令人意外。纯CPU架构在科学计算(双精度)领域优势明显,但在AI训练(低精度、大规模矩阵运算)场景下,GPU的专用硬件加速仍难以替代。“灵晟”的定位很清晰——它不是一台AI训练集群,而是一台面向传统科学计算与科学智能融合的E级超算。正如卢宇彤所说,超算提供高精度模拟和大规模数据生成能力,AI则在快速建模、预测分析等方面发挥作用,二者结合有望构建从假设提出到验证迭代的闭环科研流程。

四、制裁的反作用力:从“卡脖子”到全栈自主

“灵晟”的登顶,放在美国持续对华芯片封锁的背景下审视,意义更为复杂。

2019年,美国商务部将5家中国超算核心机构列入实体清单;2021年再次制裁7家中国超算实体。此后的几年里,中国超算一度从TOP500的公开申报中消失。加州大学全球冲突与合作研究所高级研究员吉米·古德里奇(Jimmy Goodrich)对此评价:“中国在试图让世界相信出口管制没用。”

“灵晟”超算全球第一,日媒:中国向世界证明,即便在制裁下也能胜出
“灵晟”超算全球第一,日媒:中国向世界证明,即便在制裁下也能胜出

从结果看,“灵晟”确实实现了对管制清单的“技术绕行”——不依赖任何受限的GPU或先进AI芯片,依靠国产CPU、国产互联、国产操作系统、国产HBM内存,打通了从芯片设计到整机集成的完整闭环。这既是一次技术突围,也是中国产业政策在超算领域的一次集中检验。

但“绕行”不等于“超越”。纯CPU架构在AI训练场景下的性能短板客观存在。美国超算在AI混合精度赛道仍占据前三,且AMD在TOP500前十中占据四席。正如《纽约时报》报道所指出的,“灵晟”的一大亮点是仅使用了标准微处理器,没有依赖大多数高端超级计算机用于繁重数值计算的图形处理器——这句话既肯定了技术路线的独特性,也暗含了其在AI算力维度上的局限。

另一个值得关注的指标是能效。“灵晟”在问鼎性能的同时,在衡量超算电耗效率的Green500榜单中位列第50名。相比之下,排名第二的“埃尔卡皮坦”能效为60.94 GFlops/瓦——领先“灵晟”约17%。在绿色计算日益成为行业共识的今天,能效将是下一代超算必须攻克的关卡。

五、算力格局的重塑:一个标志性节点

“灵晟”登顶的意义,超越了单一的技术指标。

从产业层面看,它验证了一条不依赖GPU的E级超算技术路线的可行性。据业内人士分析,这套全栈国产技术体系——LX2 CPU、灵启互联、麒麟OS、国产HBM——不仅服务于“灵晟”这一台机器,更构成了一个可复用的技术底座。2026年7月,中科曙光宣布中国首个全国产十万卡AI超集群“曙光8000(登峰)”正式落成并接入国家超算互联网。从超算到AI集群,国产算力正在从“点状突破”走向“系统化部署”。

从地缘技术竞争的角度看,“灵晟”标志着全球E级算力竞赛进入了一个新阶段。此前,E级超算仅分布在北美和欧洲;“灵晟”的入榜,使亚洲首次拥有了E级系统。TOP500榜单有时被视为衡量国家科技实力的标尺——在这个标尺上,格局正在发生变化。

卢宇彤在受访时说,中国超算“已经从跟跑、并跑,进入到超智融合架构创新阶段”。这句话或许是最好的注脚——“灵晟”不是终点,而是一个标志性节点。它证明在被制裁的条件下,仍有可能搭建起全球顶尖的计算资源。但接下来的问题同样棘手:如何在保持科学计算优势的同时,补齐AI算力的短板?如何在性能与能效之间找到更好的平衡?这些问题的答案,将决定下一轮算力竞赛的走向。

(本文数据来源:TOP500官网2026年6月榜单、国家超级计算深圳中心官方发布、公开信息专访)

本文由AI辅助生成

分享到: