在人工智能大模型训练需求井喷的当下,算力基础设施的自主可控已成为国家战略竞争的核心。2024年8月19日,在深圳举办的全球智能计算博览会上,中科曙光正式发布了其最新一代国产AI算力集群——曙光8000,并首次面向全球公开展出。这款号称“全国产、十万卡”的超大规模集群系统,一经亮相便引发行业震动,标志着我国在高端算力基础设施领域迈出了里程碑式的一步。
全球首发:十万卡集群不再是“纸上蓝图”
展会现场,曙光8000以实体沙盘与动态演示相结合的方式全方位亮相。据中科曙光相关负责人介绍,该集群最高可支持超过10万张国产AI加速卡并行训练,采用全栈国产化技术路线,从处理器、加速卡到高速互联网络、分布式存储、AI框架,核心软硬件均实现了自主研发与可控,彻底摆脱了对外部供应链的依赖。
“十万卡”并非简单的数量堆砌。在AI大模型的训练中,随着卡数增加,通信延迟、能耗管理、负载均衡等难题呈指数级上升。曙光8000通过自研的X-Dragon全栈智能计算架构,实现了跨节点、跨机柜的高速互联,通信效率较上一代提升40%,线性扩展效率达95%以上,确保万卡级集群能够稳定、高效地运行千亿甚至万亿参数级别的大模型训练任务。
技术亮点:从芯片到系统的全面突破
曙光8000的核心竞争力在于“全国产”三个字的含金量。其搭载的国产AI加速卡采用了全新架构,单卡算力达到国际主流水平,同时在能效比上实现了20%的提升。此外,系统还集成了自研的“星链”高速互联网络,支持全对全通信无拥塞,有效解决了大规模并行训练中的通信瓶颈。
在散热与能耗方面,曙光8000采用了全液冷方案,通过冷板式液冷与浸没式液冷混合部署,实现了PUE(电能利用效率)低于1.1的优异成绩。这意味着,在十万卡满负荷运行状态下,相比传统风冷方案,每年可节省数千万度电,符合国家“双碳”战略导向。
更值得一提的是,曙光8000在AI框架层面深度支持国产化生态,兼容PaddlePaddle、MindSpore、OneFlow等主流国产深度学习框架,并通过自研的编译器实现了对主流国际框架的自动适配,降低了用户迁移成本。
行业应用:赋能千行百业智能化转型
在发布仪式上,中科曙光同时宣布,曙光8000已在国内多个超算中心、智算中心完成部署测试,并在自动驾驶、生物医药、气象预测、智能制造等关键领域取得了阶段性成果。例如,在医疗影像大模型训练中,曙光8000将训练周期从数周缩短至数天,准确率提升了5%以上。
“过去我们往往依赖海外算力基础设施,如今曙光8000的诞生,让国产大模型的训练成本大幅降低,同时数据安全得到了根本保障。”一位来自某头部AI企业的技术负责人在展会现场表示。
战略意义:算力自主的“压舱石”
中国工程院某院士在展会同期论坛上指出,曙光8000的出现不仅是一个产品层面的突破,更是我国在算力基础设施领域实现“从跟跑到并跑、甚至部分领跑”的关键标志。面对全球AI竞争加剧、算力封锁风险上升的复杂环境,拥有自主可控的十万卡级超大规模AI计算集群,对于保障国家安全、推动产业升级、支撑科技自立自强具有不可替代的战略价值。
据透露,曙光8000预计将于今年第四季度正式面向商业客户开放部署,将重点服务于国家级AI创新平台、重点实验室以及大型企业。可以预见,随着这一“算力巨兽”的全面落地,中国AI产业的发展将迎来更坚实的底座。
从“卡脖子”到“造底座”,曙光8000全球首展,不仅展示了一款产品,更宣告了一个新时代的到来:国产算力,正在以超乎想象的速度,站上世界舞台的中央。