近日,微博AI团队发布了一款名为 VibeThinker-1.5B 的开源语言模型,再度引发了业界对“小模型大潜力”的热议。这款仅有15亿参数的模型,不仅在数学推理和代码生成等高难度任务上表现抢眼 ,还在多个权威基准测试中击败了参数规模高达6710亿的 DeepSeek-R1 模型 。
尤为引人注目的是其极低的训练成本——整个后期训练阶段仅花费 7800 美元,远低于同类模型动辄数十万甚至上百万美元的开销 。这一突破性成果,有力挑战了“大模型必须依托高算力和高投入”的行业共识 。
VibeThinker-1.5B 的核心秘诀在于其独创的 “谱-信号原则”(Spectrum-to-Signal Principle, SSP)训练框架 。该框架将训练过程拆分为两个阶段:第一阶段聚焦于生成多样化的解决方案(“谱”),第二阶段则通过强化学习精准优化最优路径(“信号”),从而在有限参数下实现高效的推理能力放大 。
在实际性能方面,VibeThinker-1.5B 不仅超越了 DeepSeek-R1 ,还与 Mistral AI 的 Magistral Medium、Anthropic 的 Claude Opus 4 等知名商业大模型正面抗衡,甚至在部分指标上更胜一筹,而其所需的计算资源却微不足道 。
目前,该模型已在 Hugging Face、GitHub 和 ModelScope 等平台开源,并采用宽松的 MIT 许可证,允许研究人员和企业开发者自由使用乃至商用 。这一举措不仅为资源有限的团队提供了高性能的替代方案,也为人工智能的普惠化发展开辟了新的可能。