4月2日,阿里云正式发布新一代大语言模型Qwen3.6-Plus,这是千问3.6系列的首款模型,也被阿里云官方称为目前"中国编程能力最强的模型"。相较于前代模型,Qwen3.6-Plus在整体性能上实现了显著提升,尤其是在编程能力、智能体(Agent)能力和工具调用能力方面完成了全面跃升。
根据阿里方面公布的评测,Qwen3.6-Plus在多项权威评测中表现令人瞩目。其中,在SWE-bench系列真实编程任务测试、考察终端编程的Terminal-Bench2、长程编程任务NL2Repo,以及Claw-Eval、QwenClawBench等真实世界Agent能力评测中,超越一众模型,展现出明显的领先优势。特别是在编程能力上,千问3.6表现超越2倍乃至3倍参数量的GLM-5、Kimi-K2.5等模型。
随着编程能力的跃升,大模型驱动下的代理式编程(Agentic Coding)正从设想走向现实。实测显示,Qwen3.6-Plus能够自主拆解前端网页开发、仓库级复杂代码任务,规划执行路径,并在过程中自主测试、反复修正,直至任务完成。这种高度自主的编程能力,使得专业开发者可以大幅提升效率,也让非技术背景的普通用户得以通过自然语言指令,完成过去需要数小时甚至数天才能实现的复杂编程任务。
目前,Qwen3.6-Plus已上架阿里云百炼,每百万Tokens(词元)输入最低2元;千问3.6也已登陆悟空、千问APP等阿里AI应用和平台,开发者和个人用户可第一时间体验最新模型。