导语
7月10日,北京市经济和信息化局在2024年全市数字经济工作推进会上宣布,下半年将加速推进人工智能基础设施布局,重点建设一批“Token工厂”,并力争全年新增智能算力5万P(Petaflops)。这一举措标志着北京在抢占全球人工智能算力制高点、推动数字经济高质量发展方面迈出关键一步。
正文
随着大模型技术的爆发式增长,算力已成为驱动人工智能创新与产业落地的核心资源。据统计,2024年上半年,北京智能算力规模已突破2万P,但面对企业日益增长的模型训练和推理需求,供给仍显不足。为破解这一瓶颈,北京市规划在下半年重点布局建设“Token工厂”——即规模化、专业化的人工智能算力供给基地,旨在通过集约化运营降低企业算力成本,提升模型迭代效率。
所谓“Token工厂”,并非传统意义上的物理工厂,而是以高性能计算集群为核心,集成先进GPU、交换机、存储及能耗管理系统的算力综合体。根据规划,这些工厂将采用“政府引导、市场主导”模式,由头部云计算企业、运营商及AI芯片公司联合承建,预计年内落地2-3个超大规模算力节点,单节点算力规模不低于1万P。同时,北京还将推动现有数据中心向智能算力升级,新建数据中心PUE(电能利用效率)必须低于1.2。
北京市经信局相关负责人表示,5万P新增智能算力的目标,相当于目前全市总量的2.5倍。为实现这一目标,北京将多措并举:一是加快存量数据中心改造,推动传统通用算力向智能算力转型;二是利用“东数西算”工程红利,在怀柔、昌平、亦庄等区域打造算力枢纽;三是设立千亿级人工智能产业基金,对Token工厂建设给予最高30%的固定资产投资补贴。
值得关注的是,Token工厂的运营模式也将创新。北京计划推出“算力券”政策,对中小企业使用本地算力给予最高50%的补贴,单家企业年度补贴上限可达500万元。同时,建立“算力调度平台”,实现全市算力资源统一纳管、动态调配,避免资源闲置。此外,北京还将探索“算力+数据+算法”一体化服务,联合顶尖AI研究院提供预训练模型库、数据标注等配套服务。
“5万P算力是什么概念?它相当于可以同时支撑50个千亿参数大模型的完整训练。”中国信通院云大所副所长李洁在解读中表示,北京此举将直接推动国产大模型迭代速度提升3至5倍,并加速自动驾驶、智慧医疗、金融科技等行业的应用落地。例如,一家自动驾驶企业借助Token工厂的高性能算力,可将模型训练周期从两个月缩短至一周。
不过,挑战同样存在。高性能GPU供应链的稳定性、电力保障、以及大规模算力集群的散热问题都是潜在风险。对此,北京已启动“算力芯片自主可控”工程,联合中科院计算所、华为等机构推进国产GPU适配验证,并规划在亦庄建设零碳算力示范园区,采用液冷、余热回收等绿色技术。
结尾
从“数据工厂”到“Token工厂”,北京正在定义算力新基建的范本。随着下半年布局的落地,5万P智能算力将为北京建设全球数字经济标杆城市注入强劲动力,也为全国算力基础设施建设提供可复制的“北京方案”。可以预见,当Token工厂开始运转,不仅将重塑AI产业格局,更将让计算成为像水电一样即取即用的城市公共资源。