腾讯混元大模型家族再添新成员:四款轻量级模型全面开源

8.4 技术实现上,这些模型采用单卡即可部署的轻量化设计,兼容主流推理框架SGLangvLLMTensorRT-LLM等,并支持多种量化格式

腾讯混元团队最新宣布开源四款轻量级大模型,参数规模分别为0.5B、1.8B、4B和7B。这些模型专为资源受限场景优化设计,可流畅运行于消费级显卡、笔记本电脑、移动终端及各类智能设备,显著降低了AI技术落地的硬件门槛。


2025080403

 

产品特性方面,新模型具有三大突出优势:

  • 高效推理能力:支持快慢双思考模式,可根据任务复杂度智能切换响应策略

  • 强大Agent功能:在任务规划、工具调用等场景表现优异,可完成Excel操作、旅行规划等复杂任务

  • 超长文本处理:原生支持256k上下文窗口,可一次性处理相当于3本《哈利波特》的内容量

 

技术实现上,这些模型采用单卡即可部署的轻量化设计,兼容主流推理框架(SGLang/vLLM/TensorRT-LLM等),并支持多种量化格式。特别值得注意的是,模型已获得Arm、高通等多家芯片厂商的底层优化支持,确保在各类终端设备上的运行效率。


2025080402

 

实际应用方面,这些轻量模型已在腾讯多个业务线成功落地:

  • 腾讯会议AI助手实现全程会议内容即时分析

  • 微信读书AI问书功能支持整本书籍内容理解

  • 手机管家实现毫秒级垃圾短信识别(准确率提升且无需上传隐私数据)

  • 智能座舱采用双模型架构,平衡性能与功耗

 

此次开源标志着腾讯混元模型体系进一步完善,为开发者提供了从微型到大型的全系列选择。目前模型代码及权重已在GitHub和HuggingFace等平台发布,其在小参数量级上的优异表现,或将推动AI技术在边缘计算和物联网领域的快速普及。


官网体验地址:
https://hunyuan.tencent.com/modelSquare/home/list 

【Github】

https://github.com/Tencent-Hunyuan/Hunyuan-0.5B     

https://github.com/Tencent-Hunyuan/Hunyuan-1.8B 

https://github.com/Tencent-Hunyuan/Hunyuan-4B 

https://github.com/Tencent-Hunyuan/Hunyuan-7B 

【HuggingFace】

https://huggingface.co/tencent/Hunyuan-0.5B-Instruct 

https://huggingface.co/tencent/Hunyuan-1.8B-Instruct 

https://huggingface.co/tencent/Hunyuan-4B-Instruct 

https://huggingface.co/tencent/Hunyuan-7B-Instruct