12月23日,中国人工智能公司 MiniMax 正式发布了其最新大语言模型 MiniMax-M2.1,并同步向开源社区开放模型权重,标志着其在推动前沿智能体(agentic)能力民主化方面迈出关键一步 。

开源与部署:全面开放,灵活使用
MiniMax-M2.1 不仅通过官方 API 提供服务,还将其完整模型权重开源至 Hugging Face,允许开发者本地部署和集成。官方推荐使用 SGLang 推理框架以获得最佳性能,并同时支持MLX与 KTransformers 等其他引擎。
专注编码与多语言:开发者首选
MiniMax-M2.1 延续了 M2 系列对软件开发任务的深度优化,在内部和第三方评测中展现出卓越的代码生成、测试用例编写、性能优化与代码审查能力。据官方披露,M2.1 在 e-commerce 指令理解、多语言编程、复杂架构设计等场景中表现尤为突出。
多家技术平台已迅速集成该模型。例如,Cline 平台称其“已成为平台上最受欢迎的模型之一”,而 Fireworks 平台联合创始人 Benny Chen 表示:“M2.1 在复杂指令遵循、重排序和分类任务上表现优异,尤其是在电商场景中。”
基准测试全面领先
MiniMax 公布了多项内部与行业标准基准结果:
在 VIBE 综合全栈开发评测中,M2.1 取得 88.6 的平均分,其中 Web 开发子项高达91.5,Android 开发达 89.7。
在代码测试生成、性能优化、代码审查等专项任务中,M2.1 全面超越前代 M2 模型,并达到或超越 Claude Sonnet 4.5 的水平。
在 SWE-bench Verified、Multi-SWE-Bench、Terminal-bench 2.0 等主流编程评测中,M2.1 均表现出高一致性与低幻觉率。

MiniMax 还预告将开源其自研的多个评测基准,包括面向长周期指令遵循的 OctoCodingbench 与专注缺陷审查的SWE Review。
智能体与自动化场景落地
除编码能力外,M2.1 也强化了 工具调用(Tool Use)与上下文管理能力,可支撑数字员工、端到端办公自动化等复杂智能体工作流。其在 BrowseComp 和 Toolathlon 等智能体行为评测中同样表现稳健。
社区与生态反响热烈
多位行业领袖对 M2.1 给予高度评价。Cline 团队称其“代表了编码专用模型的新高度”;Modulus Labs 联合创始人 Eno Reyes 表示:“M2.1 在多种软件开发任务中达到甚至超越前沿水平,为开发者提供了急需的选择。”
MiniMax-M2.1 的发布,不仅巩固了 MiniMax 在高效、低成本、高能力编码模型领域的领先地位,更通过开源策略加速了全球开发者社区的创新。随着其推理效率、多语言支持与智能体能力的综合提升,M2.1 有望成为 2026 年开发者构建下一代 AI 编程工具和自主智能体的核心引擎。
官方链接:
https://www.minimax.io/news/minimax-m21
API 开放平台:
https://platform.minimax.io/docs/guides/text-generation