人工智能领域再迎里程碑,阿里通义千问团队于9月5日悄然上线了其迄今为止最强大的语言模型——Qwen3-Max-Preview,参数量达到惊人的1万亿级别,在多项基准测试中超越国际主流竞品,展现出中国在AI领域的强劲竞争力。
9月5日晚间,阿里通义千问团队悄然在其官网及OpenRouter平台推出了Qwen3-Max-Preview模型,并称其为通义千问系列中“最强大的语言模型”。

随后,通义大模型通过官方微博详细介绍了这款模型的特性。这款万亿参数模型的发布,标志着中国在大模型技术领域进入新的发展阶段。
Qwen3-Max-Preview作为阿里通义千问系列的性能巅峰,在继承Qwen3系列架构的基础上,进行了深度优化。官方数据显示,该模型在推理计算、指令响应、多语言处理及长尾知识覆盖等核心能力上实现了突破性提升。与2025年1月发布的版本相比,新模型在数学运算、代码生成、逻辑推理及科学任务处理等场景中展现出更高精度。特别值得一提的是,该模型在AIME25基准测试中获得了80.6分,展现了强大的逻辑思维能力。研发团队在减少模型幻觉方面取得了显著进展。他们通过改进注意力机制和知识蒸馏技术,使开放式问答、创意写作及对话生成的质量获得明显改善。这一改进在需要精确信息的医疗、法律等专业领域尤为重要,大幅降低了错误信息传播的风险,为模型商业化落地创造了更有利条件。在需要精确信息的专业领域,模型的可靠性提升尤为重要。
Qwen3-Max-Preview在多语言处理方面表现突出,现已支持超过100种语言的交互。其翻译准确率和常识推理能力较前代产品提升约37%,特别在跨语言文化场景中表现出更强的适应性。多语言能力的增强使得该模型能够更好地服务于全球化应用场景。针对企业级应用场景,Qwen3-Max-Preview专门优化了检索增强生成(RAG)和工具调用接口,能够更高效地整合外部知识库和执行复杂操作。不过研发团队明确指出,该版本未配备独立的“深度思考”模式,更适合需要快速响应的实时交互场景。
在商业化方面,OpenRouter平台公布的定价方案显示:输入服务收费为每百万tokens 1.20美元(约合人民币8.6元),输出服务收费为每百万tokens 6美元(约合人民币42.8元)。这种分层定价策略更具灵活性且降低了使用门槛。阿里云百炼平台则采用按输入长度阶梯计费模式:
0-32K:输入0.006元/千token,输出0.024元/千token;
32K-128K:输入0.01元/千token;输出0.04元/千token;
128K-252K:输入0.016元/千token;输出0.06元/千token。
根据华安证券的研究报告,Qwen3-Max-Preview在多个关键测评维度中均表现出色。该模型在通用知识(SuperGPQA)、数学推理(AIME25)、编程(LiveCodeBench v6)、人类偏好对齐(Arena-Hard v2)以及综合性能力评估(LiveBench)等测试中,超越了Claude-Opus 4 (Non-Thinking)、Kimi-K2、DeepSeek-V3.1等主流竞品。同时显著领先于阿里此前的开源最佳模型Qwen3-235B-A22BInstruct-2507。

目前,Qwen3-Max-Preview已在阿里百炼平台上线,并同步向通义千问应用及Qwen Chat用户开放免费体验。用户可通过Qwen Chat官网及OpenRouter的API接口两种方式体验新模型服务。OpenRouter平台还提供详细的调用数据统计和分析功能。即使用户通过Qwen Chat官网和OpenRouter平台免费体验这款万亿参数模型,其背后价值已然显现。
Qwen3-Max-Preview在Arena-Hard v2基准测试中“领跑榜单”,成为全球大模型竞赛中的重要里程碑。中国AI企业凭借中文及多语言能力、行业解决方案深度整合能力以及更具性价比的商业化路径,正加速迈向全球AI第一梯队。
Qwen Chat:
https://chat.qwen.ai/
阿里云百炼 API 服务:
https://bailian.console.aliyun.com/