随着大模型竞赛进入“算力为王”的下半场,国产算力基础设施正迎来关键突破。近日,美团宣布基于5万张国产GPU卡集群成功训练出LongCat-2.0大模型,这一里程碑式进展不仅验证了国产算力集群在大规模训练场景下的可用性,更引发市场对国产算力产业链的高度关注。与此同时,国产服务器龙头上半年业绩有望超越去年全年,在超节点等前沿技术布局上领先行业,成为本轮国产算力景气度提升的直接受益者。

美团“万卡集群”验证国产算力

据公开信息,美团此次训练的LongCat-2.0模型参数量达数千亿级别,训练集群全部采用国产GPU芯片,总卡数超过5万张。这在国内互联网大厂中尚属首次——此前,头部企业的万卡级训练集群多依赖英伟达A100/H100等进口芯片。美团技术团队透露,通过自研的分布式训练框架和网络优化,集群在长达数月的训练中保持了较高有效算力利用率,模型在多个中文基准测试上达到业界领先水平。

分析师指出,这一案例具有三大标志性意义:其一,证明国产算力芯片已具备支撑千亿级模型训练的能力,打破了此前“国产卡只能做推理,做不了大规模训练”的刻板印象;其二,5万卡规模接近国际一线梯队,意味着国产算力集群在工程化、稳定性上迈过关键门槛;其三,美团的成功经验将为其他互联网及AI企业提供可复用的技术路径,加速国产算力替代进程。

国产算力链迎来结构性机会

随着国产大模型从“卷参数量”转向“卷落地应用”,算力需求正从训练侧向推理侧迁移。但美团此次大规模训练案例表明,高端训练场景依然存在刚性需求,而国产芯片的突破正在打开这个万亿级市场的新空间。多位券商分析师在最新研报中表示,看好国产算力链的长期成长性,尤其是国产AI芯片、服务器、交换机、光模块等环节将深度受益。

其中,国产服务器领域热度最高。据某头部券商测算,2024年上半年,国内AI服务器出货量同比增速超过80%,国产化率从2023年的不足30%跃升至45%左右。预计全年国产AI服务器市场规模将突破800亿元,核心供应商的订单能见度已排至2025年。

服务器龙头业绩超预期,超节点布局成关键

在上述背景下,国产服务器龙头——浪潮信息、中科曙光、华为昇腾生态伙伴等企业表现抢眼。以浪潮信息为例,公司5月发布的2024年半年度业绩预告显示,预计上半年归母净利润同比增长180%-220%,已超过2023年全年利润水平。分析认为,这主要得益于国内运营商、金融机构及互联网企业加速采购国产AI服务器,公司通用服务器及AI服务器出货量均创历史新高。

更值得关注的是,该龙头在“超节点”架构上的前瞻布局。所谓超节点,是将多台服务器通过高速互联网络组成一个超大算力池,能够满足万亿级参数模型的分布式训练需求。公司早在2023年就推出了基于自研高速互联协议的8卡/16卡超节点方案,并已中标多个国家级智算中心项目。分析师指出,随着千亿级模型训练成为常态,单一服务器已无法满足需求,超节点架构将成为下一代算力基础设施的核心形态,率先布局的企业有望建立深厚的竞争壁垒。

行业景气度有望持续提升

展望下半年,国产算力行业仍有多重催化因素:一是国内大模型厂商的“千卡/万卡”训练计划密集启动,算力采购预算大幅增加;二是国产GPU芯片的供应瓶颈逐步缓解,芯片厂商良率提升带动出货量上行;三是政策层面,各地智算中心建设进入加速期,对国产算力的采购比例要求普遍超过50%。

不过,行业也面临挑战:国产芯片在单卡性能、CUDA生态兼容性等方面仍与英伟达存在差距,部分高端场景仍需依赖进口。但正如美团案例所示,通过系统级优化(算法、框架、网络、散热)弥补单卡性能不足,已成为行业共识。长期来看,国产算力链从“能用”到“好用”的进化路径已经清晰。

结语

美团的5万卡国产集群训练实践,撕开了国产算力大规模落地的一道口子;服务器龙头的业绩预喜,则是对这一趋势的财务确认。在算力即国力的时代,国产算力产业链正站在从“替代”到“引领”的转折点上。对于投资者而言,把握超节点、国产芯片、智算中心三大主线,或将成为未来数年科技投资的核心命题。

(本文不构成投资建议,投资有风险,入市需谨慎。)