据多位知情人士透露,人工智能安全公司Anthropic仍在持续与拜登政府相关机构进行非正式磋商,试图推动其此前因监管原因被叫停的产品“Mythos”重新获得市场准入许可。这一动态标志着Anthropic与联邦政府在AI技术安全与商业利益之间的博弈进入新阶段。
Mythos是Anthropic开发的一款面向特定行业的高性能AI推理模型,据内部人士描述,其核心能力在于“高度可控的自主决策执行”——能够在预设的伦理和安全边界内完成复杂任务流程,如金融风险评估、医疗诊断辅助以及工业自动化调度。然而,去年秋季,美国商务部工业与安全局(BIS)以“可能对国家安全构成潜在威胁”为由,要求Anthropic暂停Mythos的商用部署。当时官方声明指出,该模型在未经过充分“红队测试”的情况下可能被恶意利用,尤其是在关键基础设施领域的潜在漏洞尚未完全封堵。
此后,Anthropic展开了长达数月的游说和技术解释工作。公司首席科学家在一次内部会议上强调:“Mythos的设计哲学恰恰是为了解决AI失控风险,我们内置了多层级约束机制,其安全架构甚至优于市面上所有公开模型。”但政府的顾虑似乎更侧重于“不可预见的二次应用场景”——例如,通过复杂推理能力反向挖掘系统漏洞或生成误导性决策链。
最新接触发生在两周前,Anthropic技术合规团队与美国国家标准与技术研究院(NIST)的AI安全工作组进行了一场闭门会议。据接近会议的人士透露,Anthropic展示了改进后的“安全沙盒”系统,该系统能实时监控模型输出,并在检测到异常推理路径时自动切断逻辑链。此外,公司还提出了一项“分级授权”方案:将Mythos的能力按安全性等级拆分,只有通过政府认证的机构才能调用最高权限模块。
然而,谈判仍存在显著分歧。政府方面坚持要求Anthropic提交完整的训练数据审计报告,并开放源代码供第三方安全公司独立审查。而Anthropic担忧这会让核心商业机密暴露给竞争对手,尤其是涉及模型架构中的关键技术路径。一名参与谈判的政府官员匿名表示:“我们理解商业利益的重要性,但AI安全不是零和博弈。Mythos的能力太强了,它一旦不受控,影响的将是整个行业的生态安全。”
市场对此反应敏感。多名行业分析师指出,如果Mythos无法重返市场,Anthropic在ToB领域的收入预期将大幅缩水,甚至可能影响其下一代模型的研发资金。而若顺利获批,则可能开启一个新的安全AI商用范式,吸引更多公司效仿其“嵌入式安全机制”。
目前,Anthropic的CEO Dario Amodei在公开场合保持沉默,但公司发言人通过邮件回应称:“我们仍在积极与利益相关方沟通,致力于找到既能保障安全又能释放技术潜力的解决方案。Mythos的设计初衷从未改变——让人工智能成为人类的可靠伙伴,而非不确定因素。”
这场博弈的最终结果,不仅关乎一家公司的产品命运,更可能重塑美国AI监管的边界线。当技术先锋撞上安全红线,如何划定信任的刻度,将考验各方的智慧与诚意。