日本云服务巨头樱花互联网(Sakura Internet)近日宣布,计划投资约260亿日元(约合人民币12.5亿元)建设面向生成式AI的专用基础设施,并将在新数据中心中全面引入英伟达最新一代GPU设备。此举被视为日本加速追赶全球AI算力竞赛的重要信号,也标志着樱花互联网从传统云计算向高性能AI云服务的战略转型。

投资规模与建设规划

根据樱花互联网发布的公告,这笔260亿日元的投资将分阶段在2024至2026财年执行。其中约180亿日元用于数据中心建筑、电力系统及冷却设施等硬件建设,剩余80亿日元则专门用于采购英伟达新一代GPU计算模块。新数据中心将选址于北海道石狩市,充分利用当地丰富的可再生能源供电,同时借助低温气候降低冷却能耗。

据悉,新设施的总建筑面积将达到1.5万平方米,设计电力容量为10兆瓦,完全建成后将成为日本国内最大规模的单体AI计算中心之一。樱花互联网社长田中裕二在新闻发布会上表示:“生成式AI正在重塑所有行业,日本必须拥有自主可控的高性能计算基础设施。这笔投资是我们对‘AI日本’愿景的坚定承诺。”

引入英伟达最新一代GPU

此次采购的核心是英伟达预计于2025年初量产的“B200”系列GPU(基于Blackwell架构)。相较于当前主流的H100 GPU,B200在训练速度上提升约2.5倍,推理功耗降低近40%,特别适合大语言模型(LLM)和多模态模型的规模化部署。樱花互联网计划首批部署约3000块B200 GPU,总FP8算力峰值达到1.2 exaflops,可同时支撑多个千亿参数级别的大模型训练任务。

樱花互联网CTO佐藤健一强调:“我们不是简单的硬件堆砌。新设施将采用英伟达的NVLink 4.0高速互联架构,并整合樱花自研的AI编排平台,实现GPU集群的弹性调度和自动故障恢复,帮助客户将模型训练时间从数周缩短至数天。”

瞄准日本企业AI需求

当前,日本企业正经历生成式AI应用爆发的初期阶段。金融、医疗、制造业等领域对私有化部署的AI基础设施需求激增,但多数企业缺乏自建算力中心和运营GPU集群的技术能力。樱花互联网的新服务将采用“按需付费+专属资源池”混合模式,既为中小企业提供即开即用的GPU云服务,也为大型客户提供物理隔离的专用计算集群。

市场分析人士指出,樱花互联网此举直接对标亚马逊AWS、微软Azure等国际巨头在日本推出的GPU云服务,但凭借本土化的数据合规支持和更低延迟,有望获得日本政府机构及传统企业的优先选择。事实上,日本经济产业省此前已明确表示,将支持本土云服务商建设国产AI算力中心,以保障数据主权和供应链安全。

行业影响与未来展望

此次投资不仅刷新了日本云服务商在AI基础设施领域的单笔投资纪录,也进一步巩固了英伟达在日本的战略地位。英伟达日本区负责人表示:“与樱花互联网的合作将加速日本从半导体设计到AI应用的完整产业闭环。日本在机器人、汽车、生物医药等领域的深厚积累,一旦与生成式AI深度融合,将释放巨大创新潜能。”

不过,也有业内人士提醒,大规模GPU集群的电力消耗和散热挑战不容忽视。樱花互联网计划采用液冷系统和余热回收技术,将PUE(电能利用效率)控制在1.15以内,并承诺在2030年前实现新数据中心100%使用可再生能源。

随着ChatGPT等海外AI应用在日本普及,本土化的大模型研发已成为国家战略课题。樱花互联网的这笔260亿日元的“豪赌”,不仅是对自身业务的重塑,更可能成为日本生成式AI生态破局的关键支点。未来三年,全球AI算力竞赛将愈演愈烈,而樱花互联网能否凭借这一基础设施弯道超车,值得持续关注。