(北京讯) 2025年2月18日下午,全球知名前端部署平台Vercel出现严重部署故障,大量用户反映无法正常推送代码、构建项目或访问已部署的静态站点。故障持续约四小时,波及范围涵盖北美、欧洲、亚太等多个地区,引发开发者社区广泛关注。截至发稿时,Vercel官方已确认问题并逐步恢复服务,但具体原因仍在调查中。

故障始末:从“构建超时”到全链路瘫痪

据多位开发者向本报提供的截图显示,故障始发于北京时间16时左右。用户在通过GitHub或GitLab触发自动部署时,系统长时间停留在“构建中”状态,最终返回“502 Bad Gateway”或“部署超时”错误。部分已部署的站点也出现间歇性加载失败,导致用户无法正常访问前端页面。

“我正准备上线一个紧急修复版本,结果连续尝试五次都失败了,连控制台日志都刷不出来。”来自上海的全栈开发者李浩告诉本报。他表示,自己团队运营的电商前端完全依赖Vercel的Edge Network,故障期间用户访问量骤降80%,直接影响了当日的促销活动。

类似的抱怨在Hacker News、Twitter以及国内的V2EX等技术社区迅速蔓延。有用户调侃称“Vercel变成Very-slow了”,也有开发者紧急将项目迁移至Netlify或Cloudflare Pages作为临时方案。

官方回应:基础设施层面配置错误

北京时间18时30分,Vercel官方在状态页面上更新公告,确认“部分用户无法部署项目或访问站点”,并指出问题源于“基础设施层面的配置错误”,而非DDoS攻击或代码漏洞。随后,Vercel CTO Malte Ubl在X平台(原Twitter)上发帖致歉,表示团队正在回滚相关配置,并强调“数据完整性未受影响”。

截至20时,Vercel状态页面显示大部分服务已恢复,但仍有少量边缘节点延迟较高。官方表示将发布详细的事后报告(post-mortem)。

值得注意的是,这已是Vercel近三个月内第二次出现大规模服务中断。2024年12月,该平台曾因DNS解析异常导致全球站点掉线约两小时,当时官方归因于第三方CDN供应商的配置变更。

行业影响:单点依赖风险凸显

Vercel作为Next.js的母公司及主流前端部署服务商,在全球拥有超过数百万开发者用户。其核心优势在于与Git工作流无缝集成、自动化的边缘渲染和零配置部署体验。然而,频繁的故障正让部分用户重新评估对其的依赖。

“前端基础设施的‘全家桶’式服务固然方便,但一旦出问题,整个链路都会‘停摆’。”独立技术顾问、前腾讯云工程师陈思远分析指出,“这次故障提醒我们,即使是AWS、Vercel这样的巨头,也需要建立多供应商冗余机制。对于商业项目而言,纯Serverless平台的不可控性值得警惕。”

受此次事件影响,一些中小型技术团队的发布流程被迫延后。杭州一家SaaS公司的CTO张磊透露,他们团队原计划在当天下午上线新版UI,由于无法部署,只能将发布时间推迟到次日凌晨。“虽然损失不大,但频繁的可靠性问题让我开始考虑自建CI/CD流水线作为备选。”

社区反思:开源生态与商业服务的平衡

在故障持续期间,部分开发者自发在GitHub上创建了“Vercel替代方案汇总”的仓库,列举了Railway、Fly.io、Deno Deploy等竞品。更有用户呼吁Vercel开源其部署引擎,以便社区在核心服务出现问题时能自建应急方案。

对此,Vercel官方尚未回应。但业内人士指出,作为一家估值超20亿美元的商业公司,Vercel的底层技术涉及大量专有优化和运维成本,完全开源并不现实。不过,提供更透明的事故响应机制和SLA赔偿条款,或许是其挽回用户信任的关键。

截至发稿时,Vercel平台已基本恢复正常。但这次持续四小时的“宕机风波”给整个前端社区敲响了警钟:当开发效率与业务连续性发生冲突时,后者永远是第一位的。