2025年7月15日,北京 —— 备受关注的AI创意生产平台Muse今日正式发布其核心模型架构的升级版本「Muse Spark 1.1」。这一代号为“星火”的版本迭代,不仅标志着Muse在生成式AI领域迈向“深度推理+多模态融合”的关键一步,更通过全新的实时协作引擎与记忆系统,试图重新定义人机共创的边界。
从“生成”到“共创”:一次底层逻辑的跃迁
自去年Muse Spark 1.0问世以来,该平台凭借对文本、图像、代码、音频的跨模态理解与生成能力,迅速在设计师、开发者、内容创作者群体中积累了超过300万活跃用户。然而,随着大模型赛道竞争白热化,用户对“可控性”与“连贯性”的期待远不止于“一次性生成”。
“1.0版本更像一个强大的‘灵感放大器’,但用户需要的是能够持续对话、理解上下文、并能协同修改的‘创意伙伴’。”Muse首席技术官林远在发布媒体沟通会上表示,“Spark 1.1正是为此而生。”
本次升级最核心的变化在于“动态上下文记忆”系统。不同于传统大模型仅依赖单次对话窗口,Spark 1.1能够长期记住用户的项目背景、风格偏好甚至修改历史。例如,一位平面设计师在连续三天内迭代同一组品牌视觉方案,模型会理解“上次调整后的色调偏好”以及“甲方在第五轮修改中提出的字体方向”,从而在新的一轮生成中主动提供符合演进逻辑的建议。
三大核心功能升级:更懂创意场景
除了底层记忆架构,Muse Spark 1.1推出了三项面向实际工作流的工具级更新:
1. 多模态实时编辑:以视觉操控语言
新版本允许用户通过直接拖拽、圈选图像/视频中的元素,实时触发文本指令的修改。例如,在生成的一张“森林中的咖啡馆”图片中,用户只需用鼠标圈出天空区域并输入“改成日落时分”,模型便会精准重构该区域,而保持其他部分(如建筑、人物)的细节完整。这种“所见即所得”的编辑方式,将以往需要多次文本提示调优的过程压缩为一次点击。
2. 共创者模式:多人协作的思维同步
Spark 1.1首次支持异步与同步混合协作。在一个项目空间内,多个用户可以分别对同一生成结果提出修改建议,模型会以“思维导图分支”的形式可视化每个建议的推导逻辑,并在后台自动尝试合并最优解。例如,编剧与分镜师可以同时操作:编剧调整台词时,模型会自动建议相应的场景视觉基调变化,并实时推送给分镜师预览。
3. 轻量化推理引擎:离线可用,响应突破毫秒级
针对移动端和低算力设备,Muse团队优化了模型蒸馏技术,推出“Spark Lite”模式。在离线状态下,设备端推理速度较1.0版本提升3倍,且支持基础长文本生成与图像风格迁移。这意味着创作者在无网络的高铁、飞机上依然能保持灵感不中断。
行业反馈:加速“AI原生创作”时代来临
发布会现场,Muse展示了若干行业合作案例。国内知名独立游戏工作室“秋叶原像素”利用Spark 1.1的实时协作功能,在48小时内完成了支线任务中15个NPC角色的对话树与立绘风格统一。“以前这需要至少两周的文字与美术对齐会议。”其主策莫子清在分享中感叹。
在广告创意领域,奥美上海团队测试了“多模态实时编辑”功能后评价:“它模糊了构思与执行之间的所有中间环节——你不再需要先把想法翻译成提示词,再反复调试。你思考,它同步实现。”
不过,也有用户对模型在复杂逻辑推理(如数学证明、代码漏洞定位)方面的表现持观望态度。对此,林远承认:“Spark 1.1在严谨推理场景的准确性比1.0提升了42%,但生成式AI本质上仍是概率模型,对于高风险决策场景,我们依然推荐人工复核。”
未来路线图:从工具到生态
Muse同步公布了Spark系列后续计划:预计在今年第四季度推出“Spark API 2.0”,开放动态记忆与协作编辑的深度接口,允许企业将其嵌入自有内容管理系统(CMS)或设计工具中。同时,Muse Academy学习平台将上线“共创者认证”课程,帮助用户系统掌握AI协同工作流。
“每一位创作者都应该拥有自己的‘第二大脑’。”Muse CEO 陈曦在总结中表示,“Spark 1.1不是终点,而是我们通往真正人机共生创作时代的起点。”
目前,Muse Spark 1.1已向全球用户开放升级。现有订阅用户即日起可在官网及App内无额外付费更新,新用户可享受30天免费试用期(包含全功能共创模式)。
(完)