
来源:Aiyxl/Jimeng AI
法国AI初创公司Mistral在2025年12月推出新一代编程大模型Devstral 2,包含1230亿参数的旗舰版和240亿参数的轻量版。其中小型版本采用完全开放的Apache 2.0协议,可在普通笔记本电脑离线运行;但大型版本却对月收入超2000万美元的企业关闭了大门。这一"半开放"策略在开发者社区引发热议。
性能对标顶级模型,体积却大幅缩小
Mistral此次发布包含两款模型:Devstral 2(123B参数)和Devstral Small 2(24B参数),均支持25.6万token的超大上下文窗口,专为"代理式"软件开发设计。
在权威的SWE-bench Verified基准测试中,Devstral 2取得72.2%的高分,而轻量版Devstral Small 2也达到68.0%,号称同尺寸开源模型中的最强者。值得注意的是,Devstral 2的模型体积仅为DeepSeek V3.2的1/,Kimi K2的1/8,却在关键软件推理指标上不落下风。

真人实测数据更具说服力:在头对头任务对比中,Devstral 2对DeepSeek V3.2的胜率为42.8%,败率仅28.6%;面对Anthropic的Claude Sonnet 4.5时虽然败率升至53.1%,但这一差距已远低于以往开源模型与闭源旗舰的差距。

"高效智能胜过盲目堆参数"——Mistral用实际行动诠释了这一理念。
Vibe CLI:终端里的AI编程伙伴
与模型同步发布的Mistral Vibe是一款原生命令行工具(CLI),并非传统的IDE插件或聊天式代码解释器。它能直接嵌入开发者的终端环境,实现项目级代码理解与编排。
Vibe CLI的核心能力包括:
自动读取项目文件树和Git状态,理解开发上下文
支持`@文件名`快速引用文件,`!命令`直接执行shell指令
可跨文件协调修改、追踪依赖关系、重试失败操作
支持架构级代码重构
不同于大多数模拟REPL环境的开发助手,Vibe从shell出发反向注入智能。该工具采用Apache 2.0协议开源,支持自定义编程和主题切换,个人和商业场景均可免费使用。
许可证争议:大企业需另付商业授权费
Mistral的"开源"策略暗藏玄机,两款模型采用截然不同的授权方式:
Devstral Small 2使用最宽松的Apache 2.0协议,无收入限制、无附加条款,企业可自由嵌入产品、微调再分发,堪称"开源黄金标准"。
Devstral 2则采用"修改版MIT协议" ,关键条款规定:若公司全球并月收入超过2000万美元,必须获得Mistral单独商业授权才能使用,包括微调版本和再分发版本。这一限制覆盖模型本身及所有衍生模型。
开发者社区对此意见不一。有用户在X平台尖锐批评:"将Devstral 2的许可证称为'修改版MIT'具有误导性,这本质上是一个带有MIT式署名要求的专有许可证。"
Mistral方面对此解释称,这是为了在保持开源精神的同时,为大企业客户提供商业服务支持。但对许多大型企业而言,这意味着他们要么选择性能稍逊的Small版本,要么必须开启采购谈判流程。
企业采用:Small版或成" pragmatic 选择"
对于中大型企业,Devstral Small 2能否作为Devstral 2的替代品?答案取决于具体场景。
该模型在本地部署、低延迟边缘推理、内部工具开发等场景下优势明显:
单GPU甚至纯CPU即可运行
可完全离线使用,满足金融、医疗、国防等行业的数据合规要求
在飞机、实地或隔离实验室等无网络环境同样可用
性能差距客观存在。对于多智能体协作、深度单体仓库重构等复杂任务,4个基准点的差距可能意味着体验上的明显差异。多数企业可能将其作为原型验证的低成本方案,或作为获取Devstral 2商业授权前的过渡方案。
Mistral此举实际上提供了多层次 adoption 路径:个人开发者和小团队可免费享用顶级能力;大企业则需付费获取完整版,但仍有免费的Small版作为保底选项。
技术部署与定价策略
技术规格方面:
Devstral 2:最低需4块H100级GPU,已上线NVIDIA build平台
Devstral Small 2:单GPU或笔记本CPU即可运行
两者均支持FP4/FP8量化权重,兼容vLLM推理框架,支持开箱微调
API定价(免费试用期结束后):
Devstral 2:输入0.40美元/百万token,输出2.00美元/百万token
Devstral Small 2:输入0.10美元/百万token,输出0.30美元/百万token
该定价略低于OpenAI GPT-4 Turbo,显著低于同性能的Anthropic Claude Sonnet。
社区反响与战略传承
发布后在X平台引发热烈讨论。Hugging Face产品负责人Victor Mustar询问:"Small版本是否已成为新的本地编程之王?" TestingCatalogNews账号则评价其为"SOTTA"(State Of The Tiny Art,小型模型最高水平)。
从战略脉络看,Devstral 2是Mistral在编程领域的第三次迭代:
1. 2024年5月:发布首代码模型Codestral(22B参数),支持80多种编程语言
2. 2025年初:推出Devstral(24B参数),首次实现笔记本运行的代理式编程
3. 2025年12月:发布Mistral 3系列,覆盖从手机到云端的完整模型矩阵
联合创始人Guillaume Lample曾向VentureBeat表示:"90%的情况下,小模型就能完成任务,不必非要用千亿参数级别的模型。" Devstral 2正是这一"分布式智能"理念的延续。
结语:开放与商业的平衡木
Mistral用Devstral 2系列描绘了一幅清晰的开发者生态地图:工具强大、集成精细,但也迫使使用者做出选择——不仅是技术架构,更是**使用权限的抉择**。
对个人开发者、初创团队和小型项目,这可能是当前可免费运行的最强AI编程系统;对财富500强企业的技术负责人,则意味着要么开启采购谈判,要么在Small版本上"将就"。
在AI模型日益黑箱化、SaaS锁定加剧的市场环境下,Mistral的半开放策略仍是一股清流。只是在大规模投入前,请务必——仔细阅读许可证的细则。
目前两款模型已在Mistral API和Hugging Face平台上线,限时免费体验。