2026年4月27日,中国科技巨头小米正式开源两款全新大语言模型——MiMo-V2.5 与 MiMo-V2.5-Pro,以真开源、超高推理效率和极具竞争力的定价策略,向 OpenAI、Google、Anthropic 等闭源模型发起正面挑战。此举标志着中国企业在基础大模型领域正从“技术追赶”迈向“生态定义”。

真开源:MIT 许可证打破商业壁垒
与众多仅开放权重但附加严格使用限制的“伪开源”模型不同,小米 MiMo-V2.5 系列采用标准 MIT 开源许可证,允许企业无需授权即可自由用于商业产品、私有部署、二次训练甚至发布衍生模型。开发者可直接从 Hugging Face 下载模型,在本地或私有云环境运行,彻底规避数据外泄与合规风险。
智能体任务效率领先:Token 消耗减少 40–60%
小米同步推出 ClawEval 智能体任务评测基准,专门衡量模型在“爪式任务”(Claw Tasks)中的表现——即通过聊天界面指挥 AI 自主完成复杂操作,如撰写营销内容、管理邮箱、安排日程、编写代码等。
测试结果显示:
MiMo-V2.5-Pro 在开源模型中排名第一,任务成功率达 63.8%;
完成一次完整任务轨迹仅需约 7 万 tokens;
相比之下,Claude Opus 4.6、Gemini 3.1 Pro 和 GPT-5.4 需多消耗 40% 至 60% 的 tokens。
在 GitHub Copilot 等主流服务纷纷转向按 token 计费的背景下,这一效率优势直接转化为显著成本节约。

双模型战略:覆盖多模态与智能体两大场景
小米采用“双轨策略”精准定位不同需求:
MiMo-V2.5(全能多模态版):
原生支持文本、图像、音频理解,适合内容生成与视觉问答,采用 3100 亿稀疏参数(MoE),每次激活约 150 亿。
MiMo-V2.5-Pro(智能体专家版):
专为长周期、高复杂度任务设计,具备强大上下文管理与自我纠错能力,参数规模达 **1.02 万亿**(激活 420 亿)。
实测案例包括:
4.3 小时从零实现 Rust 编写的 SysY 编译器(672 次工具调用,测试满分)
11.5 小时开发 8192 行桌面视频编辑器
自主优化模拟电路,线性稳压性能提升 22 倍
超高性价比:API 定价仅为 Claude Opus 的 1/5
小米提供极具竞争力的 API 定价(海外):
MiMo-V2.5-Pro:输入 $1.00 / 百万 tokens(≤256K),输出 $3.00
MiMo-V2.5:输入 $0.40,输出 $2.00
对比显示,MiMo-V2.5-Pro 价格仅为 Claude Opus 4.7 的 1/5,GPT-5.4 的 1/2.5。
此外,小米对缓存命中请求提供低至 $0.20 的输入价格,并限时免收缓存写入费用。
生态协同:硬件巨头的 AI 全栈野心
作为连接超 8.23 亿台智能设备 的生态企业,小米正从“手机+汽车+家居”全面转向“人×车×家×AI”的智能体时代。MiMo 模型不仅是技术产品,更是其 HyperOS 操作系统和 SU7/YU7 智能汽车的“大脑”候选。
目前,MiMo-V2.5 已获SGLang、vLLM 等主流推理引擎“Day-0”支持,并与AWS、AMD、平头哥、燧原科技等芯片厂商深度适配。
开发者福利:100 万亿免费 Tokens
为加速生态建设,小米宣布向全球开发者提供100 万亿免费 tokens 额度,可用于体验 1M 超长上下文和智能体任务,无财务风险。
>编者按:小米 MiMo-V2.5 系列的发布,是中国科技公司首次在智能体任务效率与开源生态上实现全球领先。凭借真开源、高效率、低成本三大优势,它有望成为企业构建专属 AI 智能体的首选基座,加速终结“闭源模型垄断高价”的时代。