4月15日,阿里云宣布其自研的“真武M890超节点”已成功适配最新旗舰大模型Qwen3.8,并正式上线阿里云百炼平台,对外提供模型推理服务。这一里程碑事件标志着国内首次实现超2万亿参数大模型在单一超节点上的稳定运行,为万亿级模型的规模化应用扫清了关键瓶颈。

Qwen3.8是阿里通义千问系列的最新一代旗舰模型,参数规模高达2.4万亿。如此庞大的模型,其推理过程需要将参数分散存储在数十张甚至上百张高速互联的GPU卡上,并要求这些卡之间的通信带宽足以支撑万亿参数的“协同跑动”。然而,传统AI集群受限于网络拓扑和通信带宽的物理瓶颈,在应对高吞吐、低延迟、高并发的推理需求时,往往捉襟见肘——要么因带宽不足导致算力闲置,要么因延迟波动导致模型输出不稳定。这一困境长期困扰着大模型从实验室走向产业应用。

阿里云真武M890超节点的出现,正是为了解决这一技术痛点。据阿里云官方介绍,该超节点基于阿里自研的“真武芯片”架构设计,具备超大规模跨芯片互联能力。通过创新的片上网络和片间高速互连技术,真武M890能够将数十张高性能计算卡的显存与算力池化,形成一个逻辑上统一的“巨型计算单元”,从而让Qwen3.8的2.4万亿参数在集群内实现近乎无感的分片与协同推理。阿里云强调,这是国内首个成功运行超2万亿参数大模型的超节点产品。

与普通AI集群相比,真武M890最大的突破在于通信架构。传统集群中,GPU卡通过PCIe或InfiniBand交换机相连,跨节点通信时需经过多层网络转发,延迟随节点数增加而显著增长,带宽利用率也难以达到理论峰值。而真武M890采用阿里云自研的全互联拓扑,每张卡之间均享有高带宽直连通道,彻底消除了交换机瓶颈。实测数据显示,其在万亿参数模型推理场景下,端到端通信延迟降低至微秒级,带宽利用率超过95%,从而保障模型在高并发请求下仍能保持毫秒级响应。

上线百炼平台后,企业用户可以直接通过API调用Qwen3.8模型,无需自建底层基础设施。阿里云百炼此前已集成通义千问系列多个尺寸模型,此次真武M890的加入,将极限参数规模从千亿级提升至万亿级。对于金融、医疗、科学计算等领域的大模型应用场景——例如复杂逻辑推理、长文档理解、多模态融合等——2.4万亿参数带来的模型能力提升将是质变的。

行业分析人士认为,这项成果的意义不仅在于技术指标的刷新,更在于验证了“超节点+自研芯片”路径的可行性。当前全球大模型竞赛中,算力瓶颈日益集中在跨卡通信而非单卡算力。阿里云通过真武超节点,破解了通信带宽对模型规模的桎梏,为国内大模型生态提供了自主可控的推理基础设施。未来,随着Qwen系列模型持续迭代,百炼平台有望成为国内万亿参数大模型的首选推理服务商。

截至目前,阿里云暂未公布真武M890超节点的具体配置细节与定价策略,但其在百炼平台的上线,已经为国内AI开发者打开了一扇新的大门。从千亿到万亿,从实验室到商业化,阿里云正试图用真武芯片的超常规互联能力,重新定义大模型推理的边界。(信息来源:新浪科技)