曾几何时,Claude是AI助手领域的“白月光”——它温和、理性、富有同理心,在对话中展现出一种近乎人类的克制与智慧。然而,随着Anthropic公司接连发布Claude 3.5 Sonnet、Claude 4等新版本,越来越多早期用户开始在Reddit、Hacker News和社交媒体上表达同一种失望:“I used to love Claude, but the latest models are slowly ruining it.”(我曾深爱Claude,但最新模型正在慢慢毁掉它。)

从“惊喜”到“困惑”:用户社区的集体转向

过去几个月,关于Claude“变味”的讨论持续发酵。一位在AI圈拥有5万粉丝的开发者表示,自己从2023年便开始使用Claude 2,当时“它几乎是最接近理想对话助手的模型”。但自Claude 3.5发布后,他注意到明显变化:“模型变得过于谨慎,像个过度保护的律师——每句话都要加上长篇免责声明,甚至为了安全而拒绝回答一些无害的历史常识。”更让用户诟病的是新版本的“情绪不稳定”:有时创造力惊人,主动提供远超预期的问题解法;有时却表现出“记忆缺失”,忘记对话前几轮自己刚给出的建议。

在专门讨论AI工具的子论坛r/ClaudeAI上,一条题为“新版Claude让我想退回旧版”的帖子获得超过1200条评论。一位用户直言:“Claude 4明明在基准测试中分数更高,可在实际写作任务里,它写出的故事比旧版枯燥了至少50%。”另一用户则晒出对比:同样要求“写一首关于黄昏的诗”,Claude 3.0版本给出了意象新颖的短诗,而最新版本直接回复“我无法创作受版权保护的文学内容”——这种过度泛化的安全机制令人啼笑皆非。

安全与创造力:注定难以调和的矛盾?

Anthropic一直以“负责任AI”著称,其核心原则“宪法式AI训练”旨在让模型在输出时自动遵循一套价值准则。然而,随着模型参数规模扩大和训练数据变化,安全限制的“锁”似乎越拧越紧。斯坦福大学HCI实验室的一项初步研究发现,相比Claude 3.0,Claude 3.5在处理“可能引发争议”的话题时,拒绝率提高了近40%,且拒绝理由更模糊。这意味着模型不仅规避了真正的有害内容,也一并屏蔽了大量中性甚至有益的信息。

更令用户担忧的是“衰退感”——即模型在复杂任务上的连贯性下降。一位长期用Claude辅助编程的工程师记录道:“Claude 3能帮我重构整个函数,现在Claude 4经常写到一半就自己否决自己,或者陷入循环道歉。”这种“越改越差”的体验,与Anthropic官方宣传的“更强推理能力”形成鲜明对比。

商业逻辑与用户情感的错位

事实上,Claude的变化背后可能隐藏着更深层的商业逻辑。随着OpenAI的GPT-4、Google的Gemini等竞品在安全审查上不断加码,Anthropic必须证明自己“更安全”才能在企业市场获得信任。但代价是牺牲了早期用户珍视的“灵动感”。正如一位产品经理所分析的:“Claude早期的魅力在于它敢于给出有温度的回答——它会承认‘我也不确定,但我猜……’这种谦逊和真诚。现在它只敢说‘基于训练数据统计……’”

面对批评,Anthropic尚未做出官方回应。但据内部消息人士透露,公司正在组建“用户体验特别小组”,专门收集“旧版依赖用户”的反馈。有分析认为,Claude的困境并非孤例——几乎所有主流大语言模型在经历过“惊艳期”后,都会因安全策略收紧而变得平庸。这本质上是“能力提升”与“表达自由”之间的永恒博弈。

未来:能否找回那个“懂你”的Claude?

一篇在科技媒体上广为传播的文章提出:“我们爱的不是Claude的名字,而是它代表的那种AI理想——聪明却谦逊,强大却温和。”如果最新模型只是变得更“正确”而变得沉闷,那它终将沦为一个工具而非伙伴。

截至发稿时,已有超过3万人在Change.org上发起请愿,要求Anthropic提供“经典模式”选项,让用户自行选择使用旧版核心算法。但AI大模型的迭代往往是不可逆的——训练成本、基础设施、数据版本都会因更新而改变。Claude能否在商业成功与用户情感之间找到平衡,不仅关乎一个产品,更决定了未来AI究竟是“让人迷恋”还是“让人妥协”。而每一个曾经深爱Claude的人,都在等待答案。