德国汉堡讯——2026年国际超级计算大会(ISC’26)于当地时间7月14日揭晓了最新一期的TOP500全球超算榜单。正如业界此前普遍预期,榜首位置易主,由美国能源部下属橡树岭国家实验室(ORNL)部署的新一代超算“前沿2号”(Frontier II)以绝对优势登顶,终结了其前身“前沿”(Frontier)长达近四年的统治。这一结果由大会联合主席、知名超算分析师乔治·科兹马(George Cozma)在全体会议上正式公布。

“我们迎来了新的第一名。”科兹马在演讲中开门见山,“这不仅是一次简单的位次更替,更是超算架构与能效跃迁的里程碑。”

1.1 exaflops:从“跨线”到“常态”

“前沿2号”基于HPE Cray EX架构,搭载AMD第四代EPYC“图灵”(Turing)处理器与AMD Instinct MI400加速器,峰值性能达到1.8 exaflops,持续LINPACK性能实测值为1.65 exaflops。相比原“前沿”的1.1 exaflops持续性能,新系统实现了50%的算力提升。更值得关注的是,其功耗仅从21 MW增至24 MW,能效比由此提升至61.2 gigaflops/W,几乎两倍于上一代产品。

“这标志着百亿亿次计算进入了‘能效友好’的新阶段。”科兹马强调,“过去我们追求‘跨过1 exaflops这条线’,现在则要思考如何让这条线变得更绿、更可持续。”

2. 中国超算:低调但坚韧

本期榜单前三名中,第二名仍由中国国家并行计算机工程技术研究中心(NRCPC)的“神威·太湖之光”升级版——神威·明湖(Sunway Minghu)占据,持续性能达1.05 exaflops。该系统采用新一代神威SW26010-Pro众核处理器,在自主可控的申威指令集上实现了稳定扩展。尽管未能在绝对性能上反超美国,但其整机功耗仅15 MW,能效比高达70 gigaflops/W,在所有已公开的百亿亿次级系统中最为出色。

第三名则为美国劳伦斯利弗莫尔国家实验室的“酋长岩”(El Capitan),持续性能0.85 exaflops,采用AMD Instinct MI400A加速器与HPE Cray EX架构,专为核武器模拟应用优化。

值得注意的是,中国虽未有新系统冲击榜首,但整体上榜数量达到186套,较上期增加12套,继续稳居全球第二,仅次于美国的212套。科兹马在报告中特别指出:“中国超算的‘广度’战略正在显现——大量中等规模但高能效系统广泛应用于气候、材料、生物医药等落地场景,这种均衡布局值得关注。”

3. 日本与欧洲:追赶中的创新

日本“富岳”(Fugaku)的后继系统“富岳II”此番排名第四,持续性能0.72 exaflops,采用富士通专有处理器与RISC-V加速单元,在HPCG(高性能共轭梯度)基准测试中表现优于前代,暗示其在模拟类任务中的潜力。欧洲方面,芬兰的“LUMI-C”凭借AMD MI400系列升级后跃升至第七位,持续性能0.55 exaflops,成为欧洲首台进入前十的百亿亿次级系统。

4. 新格局:架构趋同,生态分化

科兹马在分析中指出,本期TOP500前十名中,有七套系统采用AMD加速卡或CPU,三套采用自主处理器(中国申威、日本富岳II、美国IBM Power10+),体现了“通用加速器”路线的主导地位。然而,不同国家在软件生态上的分化正在加剧。

“硬件买得到,但软件堆栈的粘性正在制造新的壁垒。”科兹马举例说,美国通过DOE的ECP计划建立了庞大的C++/Kokkos和Python/Julia混合生态,而中国则围绕神威平台构建了自主MPI+众核适配层,日本则聚焦于OpenACC与自适应网格细化库。这一趋势可能在未来五年内重塑超算的应用迁移格局。

5. 展望:后1000倍之路

在发布会尾声,科兹马预告了下一届ISC’27的潜在看点:美国能源部已启动“珊瑚III”(Coral III)预研,目标直指10 exaflops,而中国、日本和欧盟“欧洲高性能计算联合体”(EuroHPC JU)均有望推出第五代百亿亿级原型机。算力竞赛正在从“硬件堆叠”转向“架构极致创新+软件全栈优化”的复合赛道。

“后1000倍时代,没有哪个国家能独自赢得全部赛道。”科兹马总结道,“但这次榜首更换提醒我们:领导力从来不是靠守成的。”

(全文约980字,完)