12月6日消息,腾讯在人工智能领域迈出关键一步,正式推出其自研大模型混元2.0(Tencent HY2.0),并同步宣布已将第三方大模型DeepSeek V3.2逐步接入腾讯生态体系。

据悉,两大模型现已率先部署于腾讯旗下AI原生应用“元宝”和“ima”中,同时通过腾讯云面向开发者开放API及平台服务,进一步拓展其在产业端的应用场景。
新发布的混元2.0采用先进的混合专家(MoE)架构,总参数量达4060亿(其中激活参数为320亿),支持高达256K的上下文窗口,在推理能力与效率方面被官方称为“业界领先”。相较前代模型HunYuan-T1-20250822,HY2.0在预训练数据质量、强化学习策略以及复杂任务泛化能力上实现显著跃升。
在专业领域的评测中,该模型在国际数学奥林匹克竞赛(IMO-AnswerBench)和哈佛-麻省理工数学竞赛(HMMT2025)等高难度测试中表现优异;同时在综合性知识评估基准如Humanity's Last Exam(HLE)和通用推理任务ARC AGI上也取得大幅进步。

值得关注的是,混元2.0通过重要性采样等技术创新,有效缓解了长上下文训练与推理间的不一致问题,并结合多样化任务沙盒与基于打分准则的强化学习机制,显著提升了多轮对话与指令遵循能力。
在智能体与代码生成方面,腾讯构建了可验证的规模化训练环境与高质量合成数据体系,使模型在SWE-bench Verified、Tau2-Bench等面向真实工程场景的智能体任务中实现性能跃迁,进一步强化了其在工具调用与自主编程等复杂应用中的落地能力。

此次双模型并行策略,既彰显腾讯在大模型自主创新上的持续投入,也体现了其开放生态、融合业界优秀技术成果的战略方向。