马斯克xAI推出Grok 4 Fast:速度提升10倍,价格暴降98%

9.20 这种速度提升得益于xAI对模型进行了专项优化,通过减少复杂任务的处理时间来实现快速响应

2025-09-20_143017_325
来源:Aiyxl/Jimeng AI


埃隆·马斯克(Elon Musk)旗下xAI公司于2025年9月20日正式推出全新AI模型Grok 4 Fast。这款模型在企业与消费级任务中实现接近Grok 4的推理表现,同时平均减少40%推理tokens。

 

在性能测试中,Grok 4 Fast的推理基准表现与Grok 4相当,但平均使用的推理tokens减少了40%,价格降低98%。这意味着AI技术的高门槛正在被彻底打破,企业和大规模用户现在能够以极低成本获得顶级AI能力。


2025-09-20_141930_768

 

Grok 4 Fast的核心优势在于其卓越的响应速度。根据用户反馈,其速度最高可达标准版Grok 4的10倍。这种速度提升得益于xAI对模型进行了专项优化,通过减少复杂任务的处理时间来实现快速响应。生成速度达到每秒75个token,比标准版Grok 4快了整整10倍。有测试用户形象地比喻:“左边Grok 4还在‘让我想想’,右边Grok 4 Fast已经问‘下一个问题呢?’”

 

尽管以速度见长,Grok 4 Fast在关键性能测试中的表现仍然出色。在AIME 2025无工具测试中,其正确率达92.0%,超越Grok 3 Mini,并在HMMT 2025等数学推理任务中取得显著优势。


2025-09-20_142048_486

2025-09-20_142557_263


在搜索与信息获取能力上,Grok 4 Fast展现出前沿的多跳搜索(multihop search)表现。在LMArena搜索竞技场中,grok-4-fast-search以1163 Elo分数排名第一,领先第二名17分。


2025-09-20_142208_395


在LMArena的Text Arena中,grok-4-fast(代号:tahoe)排名第8,性能与grok-4-0709相当,凸显了其卓越的智能密度。所有同等大小的模型都排在第18位或更靠后。


2025-09-20_142502_133

 

Grok 4 Fast在技术架构上实现了重要创新。它首次将长链推理模式与快速响应模式统一到同一模型中,并通过系统提示动态切换。这种设计不仅减少了延迟,也进一步降低了Token成本,适用于实时搜索、代码执行等多种场景。开发者可通过xAI API调整推理深度以匹配不同需求。该模型还展现出强大的多语言能力。在中文搜索、跨平台数据整合等任务中,其准确率明显高于同类模型。针对中文用户做了专门优化,使理解和表达更加准确流畅。

 

Grok 4 Fast带来的最直接冲击是价格体系的颠覆性变化。API调用定价显示,每100万tokens输入费用仅为0.20美元(约合1.4元人民币),输出费用为每100万tokens 0.50美元(约合3.6元人民币)。与之前相比,价格降幅达到98%,这使得个人开发者和小型企业也能够负担得起高性能AI模型的使用成本。Grok 4 Fast目前已对所有用户(包括免费用户)开放,并在OpenRouter和Vercel AI Gateway上限时免费提供。

 

Grok 4 Fast的设计理念明确体现了“速度优先于复杂度”的核心定位,并经过专项优化,通过减少复杂任务的处理时间实现快速响应。在实际应用中,该模型特别适合处理即时性需求。在代码片段生成、自动化流程配置、事实信息查询等场景中,其快速输出能力展现出独特优势。然而这种优化也带来了一定的局限性:在需要创意类输出或精细处理的任务时,为了保障响应速度,模型在内容深度与细节丰富度上会有所妥协。

 

xAI公司采取了积极的市场推广策略。Grok 4 Fast目前已对所有用户(包括免费用户)开放,并在OpenRouter和Vercel AI Gateway上限时免费提供。移动端适配工作已进入收尾阶段,预计不久后用户就能在移动设备上享受这种高效服务。国内已有多个Grok中文镜像站上线,用户触达明显扩大。这表明xAI正在悄悄铺设中国市场,采取务实策略扩大用户基础。

 

Grok 4 Fast的推出,不仅仅是一次技术迭代,更是AI发展思路的转变。它证明了通过优化模型结构,在特定场景下牺牲部分复杂度来换取更快的响应速度的可能性。这种策略对于提升用户体验,拓展大模型的应用范围具有积极意义。随着Grok 4 Fast向免费用户开放并可能取代Grok 3,高性能AI正在从奢侈品变成普惠工具,这可能彻底改变人工智能技术的普及轨迹和应用生态。