2026年7月17日,上海——2026世界人工智能大会(WAIC)开幕首日,中国首个全国产十万卡AI超集群——曙光8000(登峰)真机正式迎来全球首展,并一举获评大会最高荣誉“镇馆之宝”。这一里程碑式的成果,标志着我国在自主可控的高性能计算与人工智能算力领域迈出了历史性的一步。

十万卡规模,全链条国产化

曙光8000由中科曙光自主研发,整系统搭载了超过10万张国产高性能AI加速卡,实现了从芯片、互联、操作系统到应用框架的全链路国产化。与以往依赖进口高端GPU的集群不同,曙光8000的每一块计算卡、每一根高速互联线缆、每一个冷却模块均采用国内自主研发设计,核心部件国产化率接近100%。系统采用创新的液冷散热架构,单机柜功率密度超过100千瓦,整体能效比达到国际领先水平。

在大会现场,曙光8000以真机形态亮相,巨大的银色机柜阵列整齐排列,运行时仅有轻微的低频嗡鸣。参观者可通过实时监控大屏看到系统当前的负载、功耗与任务调度情况,直观感受这座“算力巨兽”的澎湃动力。据曙光公司现场技术人员介绍,该集群理论峰值算力可达20 ExaFlops(百亿亿次浮点运算)级别,足以应对当前最复杂的科学计算和大规模AI训练任务。

接入国家超算互联网,融入全国一体化算力网

据记者了解,曙光8000目前已正式接入国家超算互联网,并纳入全国一体化算力网,成为国家算力基础设施体系的关键节点。这意味着,用户无需直接面对复杂的硬件环境,即可通过统一的超算互联网平台,按需调用曙光8000的计算资源,实现跨区域、跨中心的算力协同调度。

国家超算互联网自2023年启动建设以来,已连接国内多个超算中心和智算中心,旨在解决算力资源“孤岛化”问题。曙光8000的加入,不仅大幅提升了国家算力网的总容量,更凭借其全栈国产化的特性,为关键领域提供了安全、可控的算力保障。无论是气象预报、基因测序,还是基础粒子物理模拟,均可从这一平台上获得稳定可靠的支持。

多类型任务全覆盖,应用优化成果显著

曙光8000并非一座“冷冰冰”的算力堆砌,而是经过深度应用打磨的实战型系统。据中科曙光公布的数据,该集群已完成300余项重点应用优化,覆盖科学计算、大模型训练与推理、工业仿真等20余个科研和产业领域。其中,超过70项应用实现了万卡规模的扩展性验证,即在利用1万张以上计算卡并行时,仍能保持高效的线性加速比。

在AI领域,曙光8000已成功支持多个千亿参数级别的大语言模型训练,训练效率较上一代国产集群提升3倍以上。在工业仿真方面,针对航空发动机叶片、新能源汽车电池包等复杂场景,系统可在数小时内完成过去需要数天的模拟计算,大幅缩短研发周期。此外,曙光8000还支撑了国产视频生成大模型、自动驾驶决策模型等前沿应用,为产业智能化升级提供了坚实的算力底座。

自主创新的里程碑,算力强国的核心支撑

曙光8000的亮相,不仅是中国算力产业的一次技术展示,更是国家科技自立自强战略的生动注脚。近年来,人工智能大模型、科学智能(AI for Science)等新范式对算力规模提出了前所未有的要求,而国际供应链的不确定性更加剧了自主算力建设的紧迫性。曙光8000的十万卡规模,意味着我国在关键部件、系统架构、冷却技术、并行算法等环节均实现了突破,形成了一整套可复制、可推广的国产算力解决方案。

在本次WAIC大会上,多名院士和专家在参观曙光8000后表示,该集群的研制成功是“从0到1”的原创性成果,填补了国内在十万卡级国产AI超算领域的空白。未来,随着更多应用场景的适配和优化,曙光8000有望成为驱动国家数字经济与智能社会发展的核心引擎。

展望:从先行示范到全面开花

根据规划,曙光8000后续将面向全国高校、科研机构和企业开放算力服务,并将持续迭代升级。中科曙光透露,下一代基于更高性能国产芯片的算力集群已在研发中,目标将单集群规模提升至百万卡级别。而曙光8000作为先行者,其积累的系统集成经验、调度算法和应用优化成果,将为后续大规模国产算力建设铺平道路。

从“跟跑”到“并跑”,再到局部“领跑”,曙光8000的全球首展,向世界展示了中国在人工智能基础设施领域的创新实力。当算力成为新时代的“水电”,曙光8000的亮相,无疑为这场全球科技竞赛中的中国方案增添了极具分量的砝码。