近日,国家超算互联网平台正式宣布启动“万卡共创者激励计划”,面向全国科研机构、高校及企业开发者开放亿级词元(Token)额度,旨在通过大规模算力资源与数据支持,加速人工智能大模型训练与创新应用落地。这一举措被视为我国超算体系从“集中式服务”向“生态化共创”转型的关键一步,也为破解当前AI算力瓶颈提供了新思路。

亿级词元额度:降低大模型训练门槛

据国家超算互联网平台官方介绍,此次开放的“亿级词元额度”是指平台将为符合条件的共创者提供总计超过1亿个词元的免费计算资源。词元作为大模型训练中的基本语义单元,其规模直接决定了模型的理解能力与表达精度。以当前主流大语言模型为例,训练一个百亿参数模型通常需要数十亿甚至上百亿词元的数据输入,而此次开放的资源足以支撑中等规模模型的基础训练或微调任务。

“过去,大模型训练的高昂成本主要来自算力租赁与数据获取。如今,国家超算互联网通过资源整合,将分布在全国各地的超算中心、智算中心连接成一张‘算力网’,用户无需自建集群,即可按需调用万卡级别的算力。”平台技术负责人表示,“亿级词元额度相当于为初创团队和学术研究者打开了一扇低成本探索前沿技术的大门。”

万卡共创:构建协同创新生态

“万卡共创者激励计划”的核心在于“共创”模式。所谓“万卡”,是指平台可调度的总算力规模达到万张高性能计算卡(如GPU、NPU等)级别,而“共创者”则是参与模型训练、算法优化或应用开发的外部团队。与传统的算力租赁不同,平台不仅提供硬件资源,还将开放底层调度工具、数据集管理平台以及模型评测基准,形成“算力+数据+工具+社区”的一体化支持体系。

首批入选的共创者将享受三大权益:一是免费使用亿级词元额度及配套算力;二是获得国家超算互联网技术专家的定制化调优指导;三是成果优先纳入平台的“国产大模型应用示范库”,获得产业化推广机会。计划预计在年内招募100支团队,覆盖自然语言处理、计算机视觉、生物医药、气象预测等重点领域。

破解算力孤岛 推动国产技术迭代

当前,国内AI大模型研发面临“算力分散、标准不一、数据孤岛”等挑战。一方面,各地超算中心、智算中心各自为政,资源利用率参差不齐;另一方面,国产芯片生态尚在完善中,模型迁移成本较高。国家超算互联网的建立,正是为了打破这些壁垒。此次推出的激励计划,则进一步聚焦于“以应用促生态”——通过开放真实场景下的亿级词元数据(涵盖中文文本、多模态信息等),倒逼国产硬件与软件栈的适配优化。

业内人士分析,这一计划将产生三重效应:一是降低中小企业和高校参与大模型研发的门槛,激发创新活力;二是通过大规模实际负载测试,加速国产AI芯片、框架(如飞桨、MindSpore等)的迭代成熟;三是积累国产算力环境下的大规模训练经验,为未来国家级AI基础设施建设提供参考。

首批共创者招募启动 未来将持续扩容

据悉,国家超算互联网平台已于近日开放申请通道,首批共创者招募截止时间为2025年6月30日。申请团队需提交项目方案、算力需求说明及预期成果。平台将组织专家评审,择优支持。后续根据运行效果,有望追加词元额度并扩大共创者规模。

在全球AI竞赛日趋激烈的背景下,国家超算互联网以“开放共享、协同共创”的姿态,为本土大模型生态注入了新的动能。正如平台负责人所言:“我们不仅要跑出中国算力的速度,更要跑出中国创新的广度。”随着万卡共创者计划的推进,国产大模型有望在千行百业中加速落地,为数字经济高质量发展提供坚实底座。