2025年4月28日,杭州——阿里云在今日举办的“云栖大会·智能前沿”峰会上,正式发布了新一代基座大模型“通义千问3.8”(Qwen 3.8)。这是继去年底Qwen 3.5版本之后,阿里云在大模型领域又一次重磅迭代。据官方数据显示,Qwen 3.8在综合性能上相比前代提升了超过30%,尤其在复杂推理、多模态理解与长文本处理方面取得了突破性进展,被业界视为国产大模型迈向“通用人工智能(AGI)探索”的重要里程碑。
性能跃升:从“千亿”到“万亿”的质变
发布会上,阿里云智能集团CEO张勇通过直播形式展示了Qwen 3.8的实际表现。在基于MMLU、C-Eval、HumanEval等权威基准测试中,Qwen 3.8以平均分92.7的成绩刷新了国内大模型记录,部分任务得分甚至超越了GPT-4o。张勇强调:“Qwen 3.8不仅仅是在参数规模上堆砌,更在稀疏注意力机制、混合专家模型(MoE)以及推理加速技术上实现了架构级创新。”
具体来看,Qwen 3.8采用了一种“动态门控路由”技术,能够在推理过程中根据任务类型自动调配计算资源。在数学证明、代码生成等需要深度推理的场景下,其正确率相比上一代提升了45%,而响应时间却缩短了20%。此外,该模型首次支持了“超长上下文”——其原生上下文窗口达到512K tokens,相当于一次性处理三卷《战争与和平》的文本量。
多模态“全能”:看懂画、听准音、理解三维
本次升级的另一大亮点在于多模态能力的全面进化。Qwen 3.8不仅能够处理文本、图像、音频,还新增了对视频、3D点云以及传感器数据的理解能力。在现场演示环节,工作人员向模型展示了一段无人驾驶车辆采集的实时街景视频,Qwen 3.8迅速识别出其中“路边施工围挡导致车道变窄”的情境,并自动生成了一段包含避让建议的自然语言叙述。
阿里云CTO周靖人解释称:“Qwen 3.8的多模态融合不同于简单的‘文字+图片’拼接,而是采用了统一的嵌入表征空间,使得不同模态的信息可以相互补偿。例如,当音频质量较差时,模型会自动调用唇语视觉信息进行辅助判断。”这种设计在智能客服、工业质检、远程医疗等场景中有巨大应用潜力。
开源生态:让大模型“飞入寻常企业”
值得一提的是,阿里云在发布Qwen 3.8的同时,宣布将其开源版本(Qwen 3.8-Open)同步上线至魔搭社区(ModelScope)。该开源版本包含8B、14B、30B三种参数规模,并支持一键部署至阿里云PAI平台。张勇表示:“我们不希望大模型成为少数巨头的专利。Qwen 3.8-Open将提供完整的微调工具链和行业模板,任何一家中小企业都可以在半小时内定制属于自己的行业大模型。”
据了解,开源版本已经获得了来自金融、医疗、制造等领域的多家头部企业试用。平安银行技术负责人反馈,基于Qwen 3.8-Open微调的风险控制模型,在反欺诈任务中的准确率达到了98.2%,较此前使用的开源模型提升了近10个百分点。
行业影响与未来展望
大模型评测机构SuperCLUE创始人刘刚在接受采访时表示:“Qwen 3.8的发布标志着国内大模型在核心指标上已经不再落后于国际先进水平。其在多模态和长文本方面的创新,很可能引领下一轮应用落地潮。”不过他也指出,国产大模型在成本控制、能耗优化以及数据安全方面仍面临挑战。
阿里云方面透露,Qwen 3.8的完整商业版(Qwen 3.8-Max)将于5月中旬正式开放API调用,定价策略将采用“按量计费+梯度折扣”,确保中小开发者的使用成本可控。后续还将推出面向教育、法律、医疗等领域的专用版本,并计划在今年第三季度将上下文窗口扩展至1M tokens。
从ChatGPT横空出世到国内大模型百花齐放,不到两年时间,AI的演进速度远超预期。Qwen 3.8的亮相,不仅是一次技术迭代,更是一种信号:通用智能正在从实验室的“空中楼阁”走向千行百业的“实际生产”。未来,当每一个普通人、每一家小公司都能借助这样的大脑解决问题,那才是人工智能真正的“iPhone时刻”。