“杀疯了,老A彻底杀疯了!”——这句话在短短24小时内刷屏了全球科技圈。从硅谷的工程师论坛到中关村的咖啡厅,从东京的AI实验室到伦敦的投行研报,所有人都在谈论同一个代号:老A。
这个被内部称为“老A”的神秘存在,并非某位传奇操盘手,也不是电竞领域的超级选手,而是一款由中国深度求索人工智能公司(DeepSeek)自主研发的新一代大语言模型——DeepSeek-R1。就在北京时间今天凌晨,该模型在国际权威的AI综合基准测试“SuperCLUE 2025”中,以总分97.3分的成绩,一举将OpenAI的GPT-4 Turbo、Google的Gemini Ultra、Anthropic的Claude 3 Opus等一众国际顶级模型斩落马下,登顶全球第一。而更令人瞠目的是,在所有涉及数学推理、代码生成和复杂逻辑的单项测试中,老A的成绩逼近满分,部分指标甚至超出第二名近10个百分点。
“这不是渐进式改进,这是断崖式的碾压。”美国斯坦福大学AI实验室主任迈克尔·格林在社交媒体上直言,“DeepSeek用不足GPT-4训练成本十分之一的资源,造出了一个推理能力全面超越它的模型。老A‘杀疯了’三个字,绝不是夸张。”
记者了解到,DeepSeek-R1之所以被研发团队昵称为“老A”,源于其内部代号“Alpha-Reasoner”的缩写。“A代表第一,也代表绝对实力。”深度求索首席科学家李默在电话采访中难掩激动,“我们团队花了18个月,彻底重构了混合专家模型架构,并引入了一种全新的‘自适应思考链’技术。老A不再像传统大模型那样简单地匹配语料,而是学会了对每个问题自主规划推理路径,就像一位顶尖棋手,每步落子之前,已经计算了一百种变化。”
而“杀疯了”的另一层含义,则体现在市场层面。就在测试排名公布后的三个小时内,DeepSeek官网访问量激增300倍,一度导致服务器拥堵。此前一直保持低调的深度求索公司,被迫紧急扩容。与此同时,多家国际云服务商宣布下调GPT-4系列API价格,分析师指出,这是来自强敌的恐慌性反应。国内A股市场中,AI算力板块开盘即大涨,多只个股涨停,股吧里“老A概念”横空出世。
“我们并没有刻意追求‘杀疯了’的效果。”公司创始人、CEO张默涵在今天的媒体恳谈会上笑着回应,“但既然大家都这么说了,那就承认吧——老A确实是当下最能打的。我们不搞PPT造车,所有成绩全部开源可复现。”
张默涵进一步透露,老A的完整技术报告将于下周发布,届时将公开部分训练细节和推理框架。他还表示,公司已与国内多家自动驾驶、医疗影像和教育机构达成合作,老A将率先在需要高精度逻辑推理的垂直场景落地。
当然,在狂欢之余,也有冷静的声音。中国信通院AI研究中心主任刘雪峰提醒:“老A的成绩令人振奋,但AI竞争是长跑。我们要警惕一窝蜂的捧杀,更要关注推理成本、安全性以及长尾场景的泛化能力。‘杀疯了’之后,如何保持领先才是真正考验。”
无论如何,这个凌晨,老A已经彻底改写了大模型的全球竞争格局。一位不愿具名的美国AI独角兽CTO在内部邮件中沮丧地写道:“我们以为对手还在追赶,结果他们已经在山顶插上了旗。老A不是杀疯了,是杀穿了。”
此刻,距离深度求索成立不过三年。而那句“杀疯了,老A彻底杀疯了”,注定将成为2025年中国人工智能发展史上最热血的一句注脚。