本报北京讯(记者 李明) 我国人工智能基础设施领域迎来里程碑式突破。4月15日,国内首个全面采用国产化技术路线的十万卡级AI超大规模集群在长三角国家算力枢纽正式落成。令人瞩目的是,就在该集群落成典礼举行的同一天,第二套同等级别系统的研制与建设工作同步宣布启动。这标志着我国在国产化AI算力“规模化、自主化、体系化”发展道路上迈出了从“单点突破”到“批量复制”的关键一步。

十万卡级算力:从“可用”到“好用”的跨越

落成的首个全国产十万卡AI超集群,由中国电子信息产业集团联合国内多家头部芯片企业、系统集成商与科研机构共同打造。该集群搭载了超过10万颗自主研发的高性能AI加速芯片,单集群峰值算力达到EFLOPS量级,整体国产化率超过95%。在训练效率上,该集群在千亿参数大模型训练场景下,集群线性加速比达到90%以上,能耗比相较同类进口方案下降约15%,实现了“算得稳、算得快、省得下”的目标。

项目总工程师、中国电子首席科学家王志明向记者介绍:“这一集群不仅是规模的堆叠,更是自主架构、高速互联、智能调度‘三位一体’的集成创新。我们突破了国产芯片互联带宽瓶颈,自主研发了全栈分布式训练框架与高可靠容错机制,解决了大规模国产算力‘难调度、易断训’的痛点。”

据悉,该集群将主要面向国家重大科研任务、国际前沿AI大模型训练以及智慧城市、智能制造等关键行业应用提供算力服务。目前已有多家国家级实验室和头部科技企业签约入驻,首期算力资源使用率超过七成。

“当天落成、当天启动”:彰显体系化发展决心

在落成仪式的最后环节,工信部电子信息司相关负责人宣布,第二套十万卡级全国产AI超集群的研制与建设工作正式启动。新系统将在吸收首套经验基础上,进一步探索“存算一体”新型架构,并计划引入更先进的国产工艺芯片与液冷散热系统,预计于2026年中期建成投运。

这一“落成即启动”的安排,引发业界广泛关注。中国工程院院士、计算技术专家孙宏宇表示:“两套系统几乎同步推进,反映出国家在AI算力基础设施建设上正在从‘单点试验’转向‘规模化部署’。这不仅有利于加速技术迭代、降低边际成本,更能形成真正的国产算力生态闭环。”

从产业角度看,双系统并行建设将带动上下游产业链加速成熟。国产AI芯片厂商、高速互联设备供应商、运维软件开发商等均将受益于持续稳定的订单与场景验证。据测算,两套系统总投资规模将超过300亿元,直接带动就业岗位超万人。

破局“算力焦虑”:自主可控的未来之路

当前,全球AI竞争日益聚焦于算力基础设施。长期以来,我国高端AI算力市场高度依赖进口,面临供应链风险与性能制约。首个全国产十万卡AI超集群的落成,不仅证明了“中国设计、中国制造”可以支撑大型AI计算任务,更打破了“国产芯片无法高效组建大规模集群”的论调。

国家发改委高技术司相关负责人指出,下一步将继续支持在京津冀、粤港澳大湾区等区域规划布局新一代国产化算力枢纽,推动形成“东数西算”框架下的自主算力网络。“我们不仅要有‘十万卡’,未来还将向‘百万卡’目标迈进,真正把算力命脉掌握在自己手中。”

从此刻起,首套集群的冷却系统已开始低鸣,十万颗国产芯片同步运行。而在几十公里外的研发中心,第二套系统的蓝图已经铺开。中国AI算力的自主化征程,正以“建成即出征”的加速度,驶入深水区。