小米开源 MiMo-V2.5 系列大模型:真开源、高效率、低成本,专为智能体任务打造

4.29 中国科技巨头小米4月27日正式开源两款全新大语言模型MiMo-V2.5与MiMo-V2.5-Pro,以真开源超高推理效率和极具竞争力的定价策略,向OpenAIGoogleAnthropic等闭源模型发起正面挑战

2026年4月27日,中国科技巨头小米正式开源两款全新大语言模型——MiMo-V2.5 与 MiMo-V2.5-Pro,以真开源、超高推理效率和极具竞争力的定价策略,向 OpenAI、Google、Anthropic 等闭源模型发起正面挑战。此举标志着中国企业在基础大模型领域正从“技术追赶”迈向“生态定义”。


 

 MiMoV2.5

 


真开源:MIT 许可证打破商业壁垒

 

与众多仅开放权重但附加严格使用限制的“伪开源”模型不同,小米 MiMo-V2.5 系列采用标准 MIT 开源许可证,允许企业无需授权即可自由用于商业产品、私有部署、二次训练甚至发布衍生模型。开发者可直接从 Hugging Face 下载模型,在本地或私有云环境运行,彻底规避数据外泄与合规风险。

 

智能体任务效率领先:Token 消耗减少 40–60%

 

小米同步推出 ClawEval 智能体任务评测基准,专门衡量模型在“爪式任务”(Claw Tasks)中的表现——即通过聊天界面指挥 AI 自主完成复杂操作,如撰写营销内容、管理邮箱、安排日程、编写代码等。

 

测试结果显示:

 

  • MiMo-V2.5-Pro 在开源模型中排名第一,任务成功率达 63.8%;  

  • 完成一次完整任务轨迹仅需约 7 万 tokens;  

  • 相比之下,Claude Opus 4.6、Gemini 3.1 Pro 和 GPT-5.4 需多消耗 40% 至 60% 的 tokens。 

 

在 GitHub Copilot 等主流服务纷纷转向按 token 计费的背景下,这一效率优势直接转化为显著成本节约。


2026-04-29_111842_651

 


双模型战略:覆盖多模态与智能体两大场景

 

小米采用“双轨策略”精准定位不同需求:

 

MiMo-V2.5(全能多模态版):  

  原生支持文本、图像、音频理解,适合内容生成与视觉问答,采用 3100 亿稀疏参数(MoE),每次激活约 150 亿。

 

MiMo-V2.5-Pro(智能体专家版):  

  专为长周期、高复杂度任务设计,具备强大上下文管理与自我纠错能力,参数规模达 **1.02 万亿**(激活 420 亿)。  

  实测案例包括:  

 

  •   4.3 小时从零实现 Rust 编写的 SysY 编译器(672 次工具调用,测试满分)    

  •   11.5 小时开发 8192 行桌面视频编辑器    

  •   自主优化模拟电路,线性稳压性能提升 22 倍 

 


超高性价比:API 定价仅为 Claude Opus 的 1/5

 

小米提供极具竞争力的 API 定价(海外): 

  • MiMo-V2.5-Pro:输入 $1.00 / 百万 tokens(≤256K),输出 $3.00    

  • MiMo-V2.5:输入 $0.40,输出 $2.00  

 

对比显示,MiMo-V2.5-Pro 价格仅为 Claude Opus 4.7 的 1/5,GPT-5.4 的 1/2.5。

此外,小米对缓存命中请求提供低至 $0.20 的输入价格,并限时免收缓存写入费用。

 


生态协同:硬件巨头的 AI 全栈野心

 

作为连接超 8.23 亿台智能设备 的生态企业,小米正从“手机+汽车+家居”全面转向“人×车×家×AI”的智能体时代。MiMo 模型不仅是技术产品,更是其 HyperOS 操作系统和 SU7/YU7 智能汽车的“大脑”候选。

 

目前,MiMo-V2.5 已获SGLang、vLLM 等主流推理引擎“Day-0”支持,并与AWS、AMD、平头哥、燧原科技等芯片厂商深度适配。

 

开发者福利:100 万亿免费 Tokens

 

为加速生态建设,小米宣布向全球开发者提供100 万亿免费 tokens 额度,可用于体验 1M 超长上下文和智能体任务,无财务风险。

 

>编者按:小米 MiMo-V2.5 系列的发布,是中国科技公司首次在智能体任务效率与开源生态上实现全球领先。凭借真开源、高效率、低成本三大优势,它有望成为企业构建专属 AI 智能体的首选基座,加速终结“闭源模型垄断高价”的时代。