记者 | 李华

2025年6月18日,上海——人工智能领域再迎基础设施重磅布局。商汤科技旗下AI云计算平台“商汤大装置”今日正式宣布发起“银河计划”,计划与产业合作伙伴共同建设5个万卡级国产智算集群,旨在为大规模AI模型训练与推理提供自主可控的算力底座。这一计划被视为中国AI产业在算力“卡脖子”问题上迈出的关键一步。

万卡级集群:算力新标杆

所谓“万卡级”,即每个智算集群配备超过1万张高性能AI加速卡(GPU或国产替代芯片)。据商汤大装置总裁刘伟在发布会上介绍,首批5个集群将分别部署于北京、上海、广州、成都及西部某算力枢纽节点,单集群算力峰值可达20 EFLOPS(每秒200亿亿次浮点运算),总算力规模将突破100 EFLOPS。这些集群将全部采用国产芯片方案,包括华为昇腾、寒武纪思元以及壁仞科技等企业的最新一代AI处理器,实现从芯片到服务器、网络、存储的全链路自主化。

“过去我们依赖进口芯片,不仅面临供应风险,而且在软硬件协同优化上受制于人。‘银河计划’的核心目标就是构建一个完全自主可控的算力生态。”刘伟在发布会上强调。

国产替代加速:从能用走向好用

当前,全球AI算力市场被英伟达主导,其H100、B200等芯片占据绝对优势。但自2022年起,美国对华出口管制持续升级,导致国内AI企业获取高端芯片的渠道严重受阻。在此背景下,国产算力基础设施的自主化进程成为行业共识。

商汤科技作为亚洲领先的AI软件公司,其大装置平台此前已支持多个千亿级参数大模型的训练,如日日新系列。然而,由于缺乏稳定的国产高端算力,部分训练任务仍需依赖海外租赁服务。此次“银河计划”的推出,标志着商汤从“被动适应”转向“主动构建”国产算力生态。

“万卡级集群的难点不只是卡的数量,更是集群的互联效率、训练稳定性和运维复杂度。”中国信息通信研究院云大所副所长李洁表示,“目前国产芯片的集群线性扩展比已能达到90%以上,意味着从硬件到软件的追平已进入实用阶段。”

产业协同:共建开放算力底座

根据计划,5个万卡级集群并非由商汤独立建设,而是采取“联合运营、成果共享”的模式。商汤将提供AI训练框架、模型优化工具和大模型开发平台,合作伙伴包括三大运营商、地方政府及能源企业提供数据中心场地、电力和网络资源。首批战略合作伙伴包括中国移动、国家电网成都分公司、上海临港新片区管委会等。

“我们不是简单建一个机房,而是打造一个开源的‘算力集市’。”刘伟比喻道,“未来第三方企业、高校、科研机构都可以像用电一样按需调用算力,并且享受国产芯片与商汤软件栈的深度优化。”

目前,商汤大装置已与多家国产芯片厂商达成联合测试协议。壁仞科技创始人张文表示:“万卡级集群的规模化部署,将倒逼国产芯片在稳定性、兼容性上快速迭代,这是从实验室走向产业化的关键一跃。”

行业影响:降低大模型门槛

“银河计划”的另一个核心目标是降低中小企业进入大模型领域的门槛。当前,训练一个千亿参数大模型的算力成本动辄数千万元,高昂的投入将大多数创新者挡在门外。通过共享国产算力集群,企业可以按模型参数规模、训练时长付费,成本有望降低40%以上。

据商汤透露,首批集群将于2025年底前陆续投产,2026年全部完成。届时,其服务的AI开发者数量将从目前的3万余人扩展至10万人以上,覆盖金融、医疗、自动驾驶、智能制造等关键行业。

“算力即生产力。当中国拥有了自主可控的万卡级算力网络,我们在全球AI竞赛中就不再是追随者,而是共建者。”刘伟在发布会结束前总结道。

随着“银河计划”的落地,中国AI产业正试图在芯片出口管制的夹缝中,走出一条属于自己的人工智能“高速公路”。而这条路能否通向未来,尚需时间检验,但至少,第一步已经迈出。