腾讯近日宣布将其全新语言模型"混元-A13B"正式开源,该模型凭借创新的动态推理方法和高效的混合专家(MoE)架构,在AI领域引发广泛关注。这一开源举措标志着中国科技巨头在大模型技术竞赛中又迈出重要一步。

动态推理:智能切换快慢思考模式
混元-A13B最突出的特点是其实时调整推理深度的能力,使模型能够根据任务复杂性在快速和深度"思考"模式间智能切换。
快速模式:针对简单查询,模型以最少的推理步骤迅速响应,适合日常问答、信息检索等对速度要求高的场景。
深度模式:面对复杂问题(如数学推理、逻辑分析),模型会激活多步骤思考过程,包括反思和回溯,生成更长的思维链以提高准确性。
手动控制:用户可通过"/think"命令强制启用深度模式,或使用"/no_think"切换回快速响应。
这种动态推理策略显著优化了计算资源分配,在保证简单任务响应速度的同时,提升了复杂问题的解决能力。

MoE架构:800亿参数仅激活13亿
混元-A13B采用了混合专家(MoE)架构,技术特点包括:
总参数800亿,但实际推理时仅激活13亿参数,大幅提高运行效率
由1个共享专家和64个细粒度非共享专家组成,每次推理仅激活8个非共享专家
采用SWiGLU激活函数和Grouped-Query Attention机制,提升内存效率
支持256K tokens的超长上下文窗口,长文本处理能力突出
这种设计使模型在消费级GPU上即可运行,开发者仅需1张中低端显卡就能部署,极大降低了使用门槛。
训练数据与核心能力
混元-A13B基于海量高质量数据训练而成:
基础训练:20万亿token的通用语料
专项强化:特别收集2500亿token的STEM领域数据(数学教材、考试题、GitHub代码、科学文献等)
优化方向:重点提升数学推理、逻辑分析、代码生成和科学问题解决能力
腾讯内部数据显示,该模型已接入400+业务场景,日均请求量超1.3亿次,是腾讯应用最广泛的大模型之一。
性能表现:数学推理超越OpenAI o1
根据腾讯公布的测试结果:
AIME 2024:混元-A13B准确率达87.3%,超过OpenAI o1的74.3%
AIME 2025:得分76.8,高于DeepSeek-R1(70分)和OpenAI o1
Agent任务:在BFCL-V3、ComplexBench等测试中大幅领先竞品
长文本处理:在PenguinScrolls和LongBench-v2数据集中表现优异,仅次于Gemini 2.5 Pro
不过值得注意的是,腾讯的比较数据基于Deepseek-R1的1月版本,而Deepseek在5月发布的新版在AIME测试中成绩更高(2024年91.4%,2025年87.5%)。
开源生态与行业影响
腾讯此次开源包含:
模型本体(Apache 2.0协议)
两个新基准数据集:
ArtifactsBench:1825个代码生成任务
C3-Bench:1024条Agent任务测试数据
支持Hugging Face、GitHub、腾讯云API等多种使用方式
这一举措被视为腾讯构建AI开源生态的重要布局,未来还将推出从0.5B到32B参数的全系列模型。
业内专家指出,混元-A13B的动态推理策略与Claude 3.7、Qwen3等最新模型的"自适应推理"思路不谋而合,代表了提高AI效率的新方向。其开源性也将加速国产芯片与大模型的适配进程,推动行业整体发展。