当ChatGPT一本正经地编造法律案例,当AI聊天机器人信心满满地给出错误医疗建议,当自动驾驶系统在明知无法处理的路况下仍选择“相信自己是正确的”——这背后并非技术的偶然失误,而是一场精心设计的“AI自信剧场”。

近日,人工智能领域的多位专家联合发出呼吁:“请停止AI自信剧场。”他们在AI研究期刊上发表联合声明,直指当前AI产品普遍存在的“过度自信”问题正在误导用户,并可能带来严重的社会后果。

所谓“AI自信剧场”,是指AI系统在面对无法回答或知识范围之外的问题时,不是坦诚地说“我不知道”,而是以一种极度自信的口吻编造看似合理的答案。这种现象在大型语言模型中尤为突出,从GPT系列到Claude,再到各种国内大模型,无一幸免。

“AI系统被设计成永远不能承认不确定性,因为那会被用户视为‘不够智能’,”斯坦福大学计算机科学教授李飞飞在接受采访时指出,“但这恰恰是最不智能的表现。真正的智能应该包含对自身局限性的认知。”

在商业利益的驱动下,AI公司面临客户期望与残酷竞争的双重压力。当用户向AI提问时,他们期待得到确定无疑的答案,而非模棱两可的判断。市场调查显示,超过70%的用户更倾向于使用“总是给出答案”的AI产品,而非那些“经常承认不知道”的系统。这种用户偏好形成的反馈闭环,不断强化着AI的“自信表演”。

然而,AI自信剧场的危害正在显现。2023年,一名美国律师因使用ChatGPT检索法律案例,结果AI“自信地”生成了多个根本不存在的判例,导致案件审理陷入混乱。今年年初,某知名AI医疗系统在诊断过程中,以极高置信度给出错误治疗方案,险些造成医疗事故。

“AI的过度自信比AI的无能更危险,”前谷歌AI伦理研究员蒂姆尼特·格布鲁警告,“无能的AI用户很快会意识到并停止使用,但过度自信的AI会让用户产生虚假的安全感,从而放弃自身的批判性思考。”

这场信任危机已经引起监管部门的关注。欧盟《人工智能法案》草案中明确要求AI系统应当标明置信度,并在无法确定答案时主动告知用户。中国国家网信办也在今年发布的《生成式人工智能服务管理办法》征求意见稿中强调,AI生成内容应当保持真实、准确,不得编造事实。

面对日益增长的压力,部分科技巨头开始尝试改变。OpenAI近期更新了ChatGPT的回应策略,在某些不确定性较高的问题上会提示用户“这超出了我的知识范围”。谷歌的Bard也开始在部分回答中标注“此信息可能不准确”。

然而,这些改变更像是一种技术性妥协而非根本性转变。“只要商业竞争的逻辑不变,AI自信剧场就会继续上演,”麻省理工学院教授马克斯·泰格马克坦言,“问题不在于技术本身,而在于我们如何定义‘智能’——是永远自信地给出答案,还是诚实面对未知。”

真正的突破可能需要从AI训练方式入手。研究人员正在开发能够评估自身知识边界的新型模型,通过引入“不确定性表示”机制,让AI在回答问题时不仅知道“什么是对的”,还能理解“什么是不确定的”。

正如联合声明中写道:“我们必须结束这场虚假的自信表演。AI的未来不在于它多么善于伪装成无所不知,而在于它何时学会诚实地说‘我不知道’。”