近日,国内AI应用开发平台Trae Work与虚拟人技术提供商魔珐科技联合宣布,双方基于深度合作推出“AI 3D具身交互智能数字人”快速构建方案。该方案将Trae Work的低代码AI工作流编排能力与魔珐星云的全栈数字人平台深度融合,让非技术用户也能在30分钟内打造出一个能够自主讲故事、具备3D形象、支持实时语音及肢体交互的智能数字人。这一突破大幅降低了企业级数字人应用的门槛,标志着AI具身智能正从实验室走向“人人可上手”的普惠阶段。
技术底座:Trae Work + 魔珐星云
Trae Work是一款面向AI应用开发的低代码工作流平台,其核心优势在于将大语言模型、视觉模型、语音模型等AI能力封装为可视化“积木块”,用户通过拖拽连线即可构建复杂的智能体逻辑。魔珐星云则是魔珐科技推出的数字人全栈生产平台,提供从3D形象建模、表情驱动、口型同步到肢体动作生成的完整管线,尤其擅长生成高质量、高真实感的3D数字人。
此次合作的关键在于打通了“智能”与“具身”的壁垒。以往,开发者需要分别训练对话模型、编写动作控制代码、调用语音合成接口,再手工拼接多模态数据流,开发周期动辄数周。而Trae Work与魔珐星云的集成,将数字人的“大脑”(语言理解与生成)、“五官”(语音识别与合成)、“身体”(3D模型与动作控制)统一封装成标准化模块,用户只需在Trae Work的图形化界面中配置几个关键节点,即可让数字人“活”起来。
30分钟快速搭建:从零到交互
根据官方演示,用户只需四步即可完成一个会讲故事的AI数字人:
第一步:选择或定制3D形象。 魔珐星云内置了超过50个预设高质量数字人角色(包括写实、卡通、二次元风格),用户可一键选用,也可通过照片扫描或参数调整快速生成专属形象。形象支持头发、服装、表情等细节微调,并自动绑定骨骼和面部blendshape。
第二步:配置故事脚本与交互逻辑。 在Trae Work的工作流编辑器中,用户将“语音输入”节点连接到“大语言模型”节点,再设置一个“故事生成”子工作流——例如,要求模型以“小王子”风格即兴讲述一段关于勇气与友情的童话。模型输出后,节点自动流转至“情绪分析”模块,根据故事内容标注喜悦、悲伤、紧张等情绪标签。
第三步:绑定动作与表情驱动。 魔珐星云的“动作映射”节点接收来自大模型的文本和情绪标签,自动生成口型动画、面部微表情及相应的肢体手势。例如,当故事讲到“主角跳跃”时,数字人会做出手臂上举、身体前倾的动作;讲到“悲伤”时,会低头、皱眉。用户还可手动调整动作幅度或添加自定义动画。
第四步:部署与测试。 一键输出为Web端、手机端或大屏端应用,支持实时语音或多轮文本对话。整个流程无需编写任何代码,即使没有AI或3D背景的运营人员,也能在30分钟内完成从形象定制到交互测试的全过程。
场景与价值:不只是“讲故事”
“会讲故事的AI数字人”并非只是娱乐噱头。该方案在多个行业展现出实际价值:
- 教育领域:数字人可以化身历史人物或虚构角色,为学生讲述课程故事,并根据学生提问实时调整叙事方向,实现个性化陪伴学习。
- 品牌营销:零售门店可部署数字人导购,用生动的故事介绍产品理念,同时识别顾客情绪,主动推荐商品。
- 文旅场景:博物馆、主题乐园利用数字人讲述文物或IP故事,配合肢体动作和场景互动,提升沉浸感。
魔珐科技相关负责人表示:“过去,一个高质量的交互式数字人需要团队耗时2-3周开发。现在,通过Trae Work与魔珐星云的组合,我们让‘数字人即服务’成为可能——用户关注的是故事本身,而非技术实现。”
展望:AI具身智能的“乐高化”
本次合作也反映出AI行业的一个明确趋势:大模型能力正通过低代码平台向各行各业渗透。当复杂的模型调用、多模态融合、实时渲染被抽象为可视化的模块,数字人不再是技术极客的专利,而成为内容创作者、教育工作者、市场营销人员的日常工具。
可以预见,随着Trae Work与魔珐星云这类“AI+3D”平台的持续迭代,未来每个人都能在几分钟内创造出专属的智能数字分身——它们不仅能讲故事,还能陪练口语、主持直播、甚至执行简单的物理操作。AI具身交互智能的“乐高化”时代,已经悄然到来。