近日,国内领先的企业级AI服务平台WorkBuddy对外发布公告称,旗下核心大模型产品Hy3的用户调用量在短时间内出现爆发式增长,系统负载一度逼近峰值。为保障服务稳定性,公司已启动紧急扩容预案,并同步优化调度策略。这一事件引发了行业内外对AI算力瓶颈与企业服务承载能力的广泛关注。
调用量创历史新高
据WorkBuddy内部监控数据显示,自本月10日起,Hy3模型的日均API调用次数较上月同期增长超过300%,峰值时段单秒请求数突破历史纪录。此次调用激增主要集中在金融、电商、教育等行业的智能客服、内容生成与数据分析场景。部分企业客户反馈,在业务高峰期曾短暂遇到响应延迟或接口超时的情况。
一位不愿具名的WorkBuddy技术负责人透露,此次流量冲击的规模远超预期。“我们原本规划了数月的扩容节奏,但用户增长曲线在短短几天内变得异常陡峭,现有算力集群的利用率迅速从60%攀升至95%以上。”
紧急扩容保服务
面对突发压力,WorkBuddy技术团队于当日凌晨启动一级响应机制。据公告,公司已于24小时内协调多家云服务商紧急调配了数千张高性能GPU卡,并新增了多个计算节点。同时,团队对模型推理引擎进行了实时优化,将单次推理的延迟降低了约15%。
WorkBuddy CEO在内部邮件中表示:“我们需要确保每一位付费客户的体验不受影响,即便这意味着临时增加近千万的算力成本。” 截至发稿时,系统整体响应时间已恢复至正常水平,服务可用性重新达到99.9%的SLA标准。不过,新增算力的部署仍需约48小时完成全面上线,期间部分非核心功能可能采取限流措施。
市场升温背后的隐忧
业内分析人士指出,Hy3调用量的激增并非孤例。随着生成式AI在企业级市场的渗透加速,不少模型厂商都面临“算力追不上需求”的窘境。此前,多家海外AI公司也因用户蜂拥而至导致服务瘫痪,不得不临时限制免费用户的使用次数。WorkBuddy的快速反应体现了其在基础设施弹性方面的储备能力,但也暴露出当前AI算力供应链的脆弱性——高端GPU的采购周期长、成本高,且云资源在高峰期的抢夺异常激烈。
“这就像是双十一的流量突然提前并持续数周,任何系统都会面临压力。” 某云计算资深架构师评价道,“真正的考验在于,当这种增长成为常态,企业是否能建立起可持续的弹性架构,而不仅仅是‘头痛医头’的紧急扩容。”
未来:从“救火”到“防火”
WorkBuddy方面表示,此次事件后,公司已启动“基础设施弹性升级三年计划”,包括与多家国产芯片厂商联合开发适配Hy3模型的高效推理硬件,以及引入更智能的流量预测与自动扩缩容系统。此外,WorkBuddy计划于下月推出“优先级调度”服务,允许关键业务客户预购算力资源,避免高峰期受到冲击。
对于用户而言,短期来看,Hy3的服务稳定性将逐步恢复;长期来看,整个行业必须正视算力瓶颈对AI应用落地的制约。正如WorkBuddy在公告最后所言:“AI的‘智能’最终要靠‘算力’托举,而算力的‘弹性’则是企业服务真正的护城河。”