近日,人工智能领域备受瞩目的新一代大语言模型 Opus 5 出现大规模异常状况。据多方用户反馈与监测平台数据显示,自北京时间4月10日凌晨起,该模型的错误响应率急剧攀升,大量请求返回了不完整、逻辑混乱甚至完全错误的输出。截至发稿时,问题仍在持续,官方尚未公布根本原因与修复时间表。

异常表现:从“幻觉”到服务中断

最早一批异常报告来自北美和欧洲的开发者社区。多名用户在社交平台 X 上晒出截图,显示 Opus 5 在处理简单数学计算时得出荒谬结论,例如将“2+2”回答为“5”。更严重的是,在代码生成、法律分析等专业场景中,模型开始重复输出同一段落,或直接拒绝回应请求,显示“内部错误”提示。

第三方监控平台 StatusGator 的数据显示,Opus 5 的 API 错误率在12小时内从正常水平的0.3%飙升至7.8%,最高峰值达到12.1%。受影响的服务包括其网页聊天界面、API 调用以及部分嵌入式企业应用。这也是该模型自去年12月发布以来遭遇的最严重稳定性危机。

官方回应:已定位问题,修复进行中

针对不断发酵的舆情,开发 Opus 5 的 Anthropic 公司于北京时间4月10日晚间发布官方声明。公司技术团队在公告中承认:“我们检测到 Opus 5 模型在处理特定模式输入时出现了高于正常水平的错误率,主要影响推理链较长的任务。初步分析指向近期一次模型微调更新中引入的数值精度缺陷。”

Anthropic 表示已回滚了有问题的权重更新,并正在对受影响节点进行逐步热修复。但该公司也谨慎提醒,完全恢复正常可能需要24至48小时,因为部分边缘缓存节点需要手动刷新。

行业影响与企业用户焦虑

Opus 5 以其强大的逻辑推理能力和极低的“幻觉”率在业界享有盛誉,许多金融、医疗和法律机构已经将其深度集成到核心业务流程中。此次错误率飙升直接导致部分用户企业面临业务停滞。

一家美国律所的合伙人向媒体透露,其律所依赖 Opus 5 进行合同审查和判例检索,自异常出现后,18%的自动化案件摘要出现事实性错误,团队不得不暂停使用并启用人工复核流程。“我们信任这个模型就像信任一名高级律师,但现在它变得像一个精神恍惚的实习生。”

更令人担忧的是,事件对 AI 行业信任度的潜在冲击。斯坦福大学人工智能研究所研究员迈克尔·陈指出:“当最可靠的模型也开始出现系统性偏差时,整个行业的可靠性叙事将受到挑战。”他呼吁各模型提供商建立更完善的事故响应及用户赔偿机制。

技术剖析:微调陷阱与回滚策略

从技术角度看,此次事件暴露了大规模模型迭代过程中的风险平衡难题。大语言模型通常需要通过持续微调来修复已知缺陷和适应新任务,但每一次权重更新都可能引入不可预见的副作用。

据熟悉内情的消息人士透露,上周 Anthropic 对 Opus 5 进行了一次旨在提升长文档摘要准确性的微调,但该更新意外改变了底层注意力机制的数值分布,导致模型在处理多步推理时产生“精度溢出”。这类问题在实验室测试中很难被完全覆盖,往往只有在千万级用户应用中才会显现。

有外部研究员建议,AI 公司应当建立更严格的“金丝雀发布”机制,即先对1%的用户推送更新,观察48小时无异常后再全量发布。Anthropic 此前已采用类似流程,但此次似乎因某种原因加快了部署节奏。

未来展望:修复之后,信任重建

截至记者发稿时,Opus 5 的错误率已下降至4.6%,但仍显著高于正常水平。Anthropic 承诺受影响的企业用户将获得一定额度的 API 补偿额度,并开放了专属技术支持通道。

此次事件再次提醒我们:人工智能并非完美无缺,越是强大的工具,其故障带来的影响也越深远。对于用户而言,关键业务系统永远需要保留人工兜底机制;对于开发者而言,稳定性与可靠性比功能丰富性更为基础。

我们将持续关注 Opus 5 的修复进展,并在第一时间向读者通报后续动态。