百度于今日(2025年6月30日)正式宣布开源其最新一代文心大模型4.5系列,这一重大举措涵盖了10款不同参数规模的模型,包括47B和3B激活参数的混合专家(MoE)模型,以及0.3B参数的稠密型模型,标志着中国AI大模型开源生态迈入新阶段。

模型架构与技术突破
文心大模型4.5系列在技术上实现了多项重大创新:
1. 多模态异构模型结构:针对MoE架构提出创新设计,支持从大语言模型向多模态模型的持续预训练范式,在保持文本任务性能的同时显著增强多模态理解能力。
2. 高效训练框架:基于飞桨深度学习框架,模型FLOPs利用率(MFU)达到47%的行业领先水平,通过异构混合并行、FP8混合精度训练等技术大幅提升训练效率。
3. 先进推理优化:采用多专家并行协同量化方法和卷积编码量化算法,实现效果接近无损的4-bit和2-bit量化,显著降低推理成本。

卓越的性能表现
文心4.5系列在多项基准测试中展现出行业领先水平:
文本模型:在指令遵循、世界知识记忆、推理和编程能力等方面超越DeepSeek-V3、Qwen3等主流模型。
多模态模型:视觉感知和多模态推理能力优于闭源的OpenAI o1,支持思考与非思考两种模式,在MathVista、MMMU等高难度基准上表现突出。
轻量模型:文心4.5-21B-A3B文本模型效果与同量级Qwen3相当,而文心4.5-VL-28B-A3B多模态模型则是目前同量级最佳的开源多模态模型。

全面开源与开发者支持
百度此次开源具有以下特点:
1. 完全开源:按照Apache 2.0协议开放预训练权重和推理代码,支持学术研究和产业应用。
2. 多平台支持:模型已在飞桨星河社区、HuggingFace等平台上线,开发者可自由下载部署。
3. API服务:通过百度智能云千帆大模型平台提供开源模型API服务,降低使用门槛。
4. 开发工具:同步升级文心大模型开发套件ERNIEKit和部署套件FastDeploy,提供从训练到部署的全流程支持。
产业影响与生态建设
此次开源实现了百度在框架层与模型层的"双层开源",依托飞桨深度学习平台和文心大模型构建了完整的AI技术栈。百度AI技术架构涵盖算力、框架、模型到应用四个层面,形成了显著的全栈技术优势。
文心大模型4.5系列的开源将进一步推动中国AI产业发展,降低企业技术门槛,加速AI应用落地。开发者现在即可通过文心一言官网( https://yiyan.baidu.com )体验最新开源技术,或前往飞桨星河社区、HuggingFace等平台获取模型资源。
这一重大开源举措不仅展示了百度在AI领域的技术实力,也为全球AI开发者社区贡献了强大的工具和资源,有望推动人工智能技术在各行业的创新应用和快速发展。
模型资源链接: