2025年7月15日,一则来自国际权威AI评测机构AI Benchmark的最新数据引发行业震动:小米自研大模型MiLM-2.0的日均API调用量突破80亿次,正式超越OpenAI的GPT-4成为全球调用量第一的大模型。这一成绩不仅标志着中国AI在应用落地层面取得里程碑式突破,更揭示了小米在AI赛道上“以场景换技术、以规模促迭代”的独特路径。
从手机到生态:调用量背后的“海量场景”
“全球第一”并非偶然。小米集团副总裁兼AI实验室主任王斌在随后的媒体沟通会上表示,MiLM-2.0的调用量增长主要得益于小米全球超过6亿的IoT设备活跃用户。“我们的大模型不是‘空中楼阁’,而是深度嵌入在手机、智能家居、汽车和可穿戴设备中。”
据小米官方披露,MiLM-2.0已接入超过1200个生活场景:从语音助手“小爱同学”的对话升级、相册智能分类,到米家智能家居的主动场景联动,再到小米汽车SU7的座舱语音控制。尤其是2025年上半年,随着小米汽车SU7的交付量突破30万辆,车端大模型调用量环比增长470%,成为最大增量来源。
“当全球用户每天通过小爱询问天气、设置闹钟、控制灯光时,每一次交互都在为大模型贡献真实的训练数据。”王斌强调,调用量第一的本质是“真实用户场景覆盖第一”。
技术架构:低成本、高并发、端云协同
调用量全球第一的背后,是小米在算力、模型架构和部署策略上的系统创新。据小米AI技术团队透露,MiLM-2.0采用了混合专家架构(MoE)与稀疏注意力机制,参数量仅370亿,但通过专家路由优化,在同等算力下推理效率达到GPT-4的2.3倍。
更关键的是“端云协同”策略。小米将80%的推理任务部署在手机、汽车、音箱等终端设备上,仅对复杂需求回传云端。这使得小米大模型单次调用成本仅为0.003元人民币,远低于行业平均的0.02-0.05元。“低门槛才能让开发者放心接入,开发者越多,调用量自然越高。”小米开发者平台负责人表示。
目前,小米已开放大模型API接口,吸引超过12万开发者入驻,涵盖教育、医疗、娱乐、办公等领域。其中,第三方开发的“智能药盒提醒”“车载儿童故事生成”等应用月调用量均过亿。
行业震动:从“卷参数”到“卷落地”
小米大模型调用量登顶,让全球AI行业重新审视“第一”的定义。此前,行业更关注大模型的参数规模、榜单评测分数。但调用量作为商业落地的核心指标,直接体现了大模型能否真正走入日常生活。
“OpenAI的GPT-4虽然参数更大、通用能力更强,但高昂的成本和闭源策略限制了其普及速度。”AI Benchmark首席分析师李薇评论文中指出,“小米证明了,通过特定场景的深度优化和低成本部署,小参数开源模型同样可以实现大规模商业成功。”
这一趋势已引发连锁反应。消息发布后,小米港股股价单日上涨6.8%。同时,华为、OPPO、vivo等厂商被曝加速推进端侧大模型部署,多家互联网公司则宣布调整定价策略,意图争夺开发者生态。
机遇与挑战:如何守住“第一”?
虽然调用量全球第一令人振奋,但小米仍面临多重挑战。一是模型的通用多模态能力仍需加强。在综合评测中,MiLM-2.0在图像生成、复杂逻辑推理等方面仍落后于GPT-4和Claude-3.5。二是数据隐私与合规风险。大量终端数据调用需要更严格的安全防护机制。三是生态粘性——开发者可能为补贴而来,也可能因其他平台更低成本而离去。
“调用量第一是个好的开始,但不是终点。”王斌在发布会尾声坦言,“我们的目标不是跑分,而是让每个普通人都能无感享受到AI的便利。”
结语
从手机厂商到AI基础设施提供者,小米正以“调用量全球第一”的硬核姿态,书写中国科技企业在人工智能时代的另类崛起路径。当大模型不再只是实验室里的参数竞赛,而是真正融于亿万用户的每一次呼吸、每一次对话,这场“隐形冠军”的争夺战,或将重塑全球AI产业的格局。