自2024年底离开OpenAI后,前首席技术官米拉·穆拉蒂(Mira Murati)的去向一直是科技界关注的焦点。2月26日,这位曾在GPT-4、DALL-E 3等明星产品研发中扮演关键角色的女性技术领袖,正式揭晓了她的创业成果——新公司“思维机器实验室”(Thinking Machines Lab)及其首款自研AI模型“推理者”(Reasoner)。令人瞩目的是,该模型在技术路线上明确借鉴了中国AI企业的工程化经验,并旗帜鲜明地打出了“成本与性能平衡”的旗号。
创业背景:从硅谷巨头到独立领航
穆拉蒂在OpenAI任职期间,主导了多模态、推理能力等核心技术的突破,被业界视为推动生成式AI从实验室走向商业化的关键人物。然而,随着OpenAI转向更激进的商业化与安全治理路线,穆拉蒂选择离职创业,决心打造一家“更灵活、更务实”的基础模型公司。
思维机器实验室的首轮融资由知名风投机构红杉资本与安德森·霍洛维茨联合领投,估值已超过30亿美元。团队汇集了来自OpenAI、谷歌DeepMind、Meta AI等机构的多位资深研究员,重点聚焦“高性价比基础模型”的研发,目标是为中小企业与开发者降低AI部署门槛。
模型发布:技术亮点与成本优势
此次发布的Reasoner模型,在通用语言理解、代码生成与多步推理任务上,表现接近GPT-4o与Claude 3.5 Sonnet,但推理成本仅为后者的三分之一。穆拉蒂在发布会上直言:“我们认真研究了DeepSeek、智谱等中国公司的技术报告,在模型架构、训练策略和推理优化上借鉴了大量中国企业的成功经验。”
具体而言,Reasoner采用了混合专家模型(MoE)架构,并引入了一种高效的稀疏注意力机制,显著降低了计算开销。训练数据则通过蒸馏技术与对比学习进行精炼,使模型在保持推理深度的同时大幅压缩了参数量。此外,团队还针对低资源环境优化了推理引擎,让普通消费级GPU即可部署,真正实现了“高性能、低门槛”。
“我们不追求在每项基准上都拿第一,但我们确保在中小企业能承受的预算内,提供足够好的智能。”穆拉蒂强调。
行业评价:务实主义路线获认可
该模型发布后,迅速引发行业热议。斯坦福大学人工智能实验室主任克里斯托弗·曼宁评论道:“穆拉蒂正在践行一种‘东亚式’的效率哲学——不是堆算力,而是优化每一个参数。这种思路对于AI民主化至关重要。”
国内AI领域专家也持积极态度。字节跳动AI Lab前研究员王昊指出:“中国企业已经在工程优化上走得很远,但此前西方主流AI公司往往不屑于借鉴。穆拉蒂是第一个公开承认‘向中国学习’的硅谷明星创始人,这种开放心态值得肯定。”
当然,也有质疑声音。部分学者担忧过度追求成本效率可能导致模型在长尾知识、创造性任务上表现不足。但穆拉蒂回应称,公司将在下一版本中通过新型循环记忆机制弥补这一短板。
展望:AI竞赛进入“实用主义”时代
Reasoner模型的发布,标志着全球AI竞争正从“模型性能的军备竞赛”转向“成本与效用的务实博弈”。在DeepSeek、Qwen等中国开源模型先后证明“廉价高性能”的可行性后,西方头部AI公司也开始重新审视自己的技术路线。
穆拉蒂的创业故事,恰似一面镜子:她既深谙硅谷的前沿算法,又敢于拥抱东方工程智慧。当谈及未来计划时,她透露团队正在研发一款“1000美元即可私有化部署”的企业级模型,目标让AI不再是大公司的专利。
或许,当技术领导者不再固守所谓“纯正血统”,而是俯身向所有优秀实践学习,AI普惠的黎明才能真正到来。而穆拉蒂和她的小实验室,正试图推开这扇门。