2月初,中国大模型公司阶跃星辰(Stepfun)正式开源其最新一代基座模型——Step 3.5 Flash。该模型专为智能体(Agent)场景设计,以“极致速度、高性价比、强稳定性”为核心优势,旨在为开发者提供一个更聪明、更高效、更易部署的“Agent 大脑”。在当前 Agentic AI 被广泛视为通往通用人工智能(AGI)关键路径的背景下,Step 3.5 Flash 的推出恰逢其时,填补了高性能轻量化 Agent 模型的市场空白。

极致性能:350 TPS 推理速度,比肩闭源大模型
Step 3.5 Flash 在多个关键指标上实现了显著突破:
推理速度高达 350 TPS(Tokens Per Second),尤其在代码生成与逻辑推理任务中表现卓越,远超同类开源模型;
性能比肩主流闭源模型,在 Agent 核心应用场景(如任务规划、工具调用、多步推理)和数学逻辑任务上,展现出与顶级商业模型相当的能力;
支持 256K 超长上下文,确保在处理复杂、长链条任务时依然保持高稳定性和上下文一致性。

这一系列特性使其成为构建高响应、高可靠智能体的理想选择,尤其适用于需要快速决策与实时交互的应用场景。
创新架构:稀疏 MoE + MTP-3,效率与能力兼得
Step 3.5 Flash 采用了一系列前沿技术架构,实现性能与效率的平衡:
稀疏混合专家(Sparse MoE):总参数量达1960 亿,但每个 Token 仅激活约110 亿参数,大幅降低计算开销;
MTP-3 技术(Multi-Token Prediction):单次前向预测可并行输出 3 个 Token,推理效率直接翻倍;
滑动窗口 + 全局注意力混合机制:在处理超长文本时,既能精准捕捉关键信息,又能有效控制显存与计算资源消耗。
这种“*大模型小激活”的设计思路,使得 Step 3.5 Flash 在保持强大语义理解与推理能力的同时,具备极低的部署门槛和运行成本。
多场景实测:从智能编程到端云协同
在实际应用演示中,Step 3.5 Flash 展现出强大的多任务泛化能力:
智能编程:仅凭一段自然语言描述(如“创建一个基于 WebGL 2.0 的粒子可视化平台”),即可自动生成完整、可运行的高性能前端代码;
复杂计算:无需调用外部工具,能直接完成等差数列求和、阶乘累加等高难度数学运算,体现其内生推理能力;
端云协同:作为“云端大脑”,可将用户模糊需求(如“对比京东、淘宝、拼多多上 iPhone 17 的价格”)自动拆解为多个子任务(搜索、抓取、比价),并将结构化指令下发至轻量级本地执行端,极大简化终端逻辑,提升系统整体可靠性。
全面开源与生态布局
阶跃星辰已将 Step 3.5 Flash 模型权重与推理代码全面开源,并同步上线至 **GitHub、Hugging Face 和 OpenRouter** 等主流平台。为降低本地部署门槛,团队还专门优化了模型在 NVIDIA DGX、Apple M4 Max 等个人工作站环境下的运行性能,支持开发者快速搭建专属智能体。
此外,阶跃星辰宣布已启动下一代模型 **Step 4** 的训练工作,并向全球开发者发出邀请,共同参与定义下一代 Agent 基础模型的能力边界与应用场景。
开源地址:
GitHub: https://github.com/stepfun-ai/Step-3.5-Flash
Hugging Face: https://huggingface.co/stepfun-ai/Step-3.5-Flash
OpenRouter(限免体验): https://openrouter.ai/stepfun/step-3.5-flash
随着 Step 3.5 Flash 的发布,阶跃星辰正加速构建以“高效 Agent”为核心的开源生态,推动智能体技术从实验室走向规模化产业落地,为 AGI 时代的基础设施建设注入新动能。