2025年4月23日,小米集团在年度开发者大会上正式发布了自研的机器人基座模型——Xiaomi-Robotics-1(简称XR-1)。这一模型被视为小米在人工智能与机器人交叉领域的关键战略产品,标志着其从消费电子硬件厂商向AI原生智能体生态构建者的转型迈出实质性一步。
多模态感知与运动控制的双重突破
根据官方披露的信息,XR-1是一个面向通用机器人的基础模型,核心能力体现在“感知-决策-执行”的闭环链路中。与市面上多数仅聚焦语言或视觉理解的模型不同,XR-1集成了视觉、触觉、力觉等多模态感知模块,能够实时解析环境中的三维空间结构、物体属性以及动态变化。
在运动控制方面,XR-1通过强化学习与模型预测控制的融合架构,使搭载该模型的机器人可以在非结构化环境中完成行走、抓取、避障等复杂动作。现场演示中,配备XR-1的小米CyberOne二代机器人能够自主识别散落在地面的多种工具,并精准完成螺丝刀递送、水杯抓取等操作,展现了从“看到”到“做到”的端到端泛化能力。
小米AI实验室负责人表示,XR-1采用了“基座模型+轻量化子模型”的架构设计。基座模型负责通用场景下的世界理解与常识推理,而针对特定任务(如家庭清洁、工业巡检)的子模型则可以在基座之上进行低成本微调,这大幅降低了机器人在不同场景中的部署门槛。
技术路线与生态协同
XR-1的发布并非孤立事件。过去三年,小米已陆续推出人形机器人CyberOne、四足机器人CyberDog以及多款扫地机器人、智能家居产品。XR-1正是将这些硬件产品的感知与控制数据统一纳入了模型训练框架。据小米介绍,超过10亿条来自真实家庭和工厂环境的操作数据被用于模型预训练,涵盖抓取、移动、人机交互等核心任务。
相比谷歌RT系列模型和英伟达Project GR00T,XR-1的特点在于强调“低成本高效能”。小米依托其成熟的供应链体系与硬件规模化能力,宣称搭载XR-1的模块化机器人平台成本可比同类产品降低40%以上。这一策略有望加速机器人在中小型企业及家庭市场的渗透。
同时,小米宣布XR-1将面向开发者开放部分API接口。开发者可以通过小米AIoT平台调用XR-1的感知与运动能力,为自家设备赋予机器人特性。这种“模型即服务”的生态思路,与小米此前在智能家居领域的开放平台战略一脉相承。
行业影响与未来挑战
XR-1的亮相引发了产业界的高度关注。业内人士指出,机器人基座模型的关键价值在于解决了传统机器人“只知其一不知其二”的笨拙困境——过去机器人无法将视觉、语言和动作进行闭环推理,而XR-1通过大模型融合三者,使机器人具备了初步的“常识”和“主动适应能力”。
不过,XR-1距离真正意义上的通用智能机器人仍有距离。目前其在动态交互场景中的响应延迟约为150毫秒,在极端光照和复杂纹理环境下的感知精度仍有待提升。小米方面表示,下一代版本将引入世界模型,赋予机器人对物理规律的前瞻性理解,使其具备“计划性行为”。
从商业层面看,XR-1的发布进一步强化了小米“人-车-家”全场景智能战略。随着机器人在家庭服务、智能制造、仓储物流等领域的渗透加深,XR-1有望成为连接小米硬件矩阵与AI能力的“神经中枢”。但面对特斯拉Optimus、华为等强劲竞争对手,小米需要在数据积累、算法迭代和场景落地速度上持续加速。
结语
小米Xiaomi-Robotics-1的诞生,是AI大模型从数字世界跨入物理世界的一次关键尝试。当机器人真正学会理解环境、自主决策并与人类协作,智能生活的图景将不再只是屏幕里的想象。对于小米而言,此刻的发布只是长跑的第一公里——真正的挑战在于,如何让这位“机器人基座”在千行百业中生根发芽。