通义千问持续加码开源!Qwen3-VL 家族迎来 2B 与 32B 新成员,开源生态再升级,手机也能跑

10.22 在行业普遍倾向闭源的当下,通义千问通过持续扩充开源模型家族,正推动AI能力从可用向好用易用演进,加速多模态大模型在千行百业中的真实应用与价值释放

在全球大模型竞争日趋白热化的背景下,阿里云以更丰富、更开放的开源策略积极应对。2025年10月22日,通义千问团队正式发布 Qwen3-VL 视觉语言模型家族的两款全新密集型(Dense)模型——Qwen3-VL-2B 与 Qwen3-VL-32B,进一步完善了其多模态产品矩阵。官方表示,该模型手机也能跑,且“更适合开发者体质”。

 

此次更新后,Qwen3-VL 家族已形成覆盖广泛应用场景的完整开源体系:包括四款 Dense 模型(2B、4B、8B、32B)以及两款 Mixture of Experts(MoE)架构模型(30B-A3B 与 235B-A22B),参数规模从 20 亿延伸至 2350 亿,全面适配从边缘端轻量部署到云端高性能推理的多样化需求。其中,2B 模型因体积小巧、效率高,特别适合端侧设备;而 32B 模型则在 STEM、视觉问答(VQA)、OCR、视频理解等复杂任务上展现出强大能力。

 

尤为引人注目的是,所有新老模型均同步提供 Instruct(指令微调)与 Thinking(推理增强)两个版本,开发者可根据具体任务灵活选择。例如,Qwen3-VL-2B-Thinking 已在 Hugging Face 平台开源,采用 Apache-2.0 许可,支持商业用途,并可通过 Transformers 接口直接调用。


2025-10-22_144054_325
2025-10-22_144107_462

 

为提升部署效率,阿里云还同步推出了 12 款 FP8 量化版本模型,在几乎不损失精度的前提下,显著降低显存占用与推理延迟,加速多模态 AI 在实际业务场景中的落地。

 

目前,全部 Qwen3-VL 开源模型权重已在魔搭(ModelScope)社区与 Hugging Face 免费开放下载,且均支持商业应用。这一举措不仅大幅降低了企业、学术机构及创业团队接入前沿多模态技术的门槛,也彰显了阿里云坚持开源开放、推动普惠智能的战略决心。

 

在行业普遍倾向闭源的当下,通义千问通过持续扩充开源模型家族,正推动 AI 能力从“可用”向“好用”“易用”演进,加速多模态大模型在千行百业中的真实应用与价值释放。


体验地址:
https://modelscope.cn/collections/Qwen3-VL-5c7a94c8cb144b 

https://huggingface.co/collections/Qwen/qwen3-vl-68d2a7c1b8a8afce4ebd2dbe