马斯克旗下 xAI 公司今日正式向全球用户推送其大语言模型Grok的最新迭代版本——Grok4.1。此次更新并非简单的增量修补,而是一次旨在全面提升用户体验与模型性能的重大演进,为年底即将发布的Grok5奠定了坚实基础。

xAI官方宣称,Grok4.1在核心体验上实现了显著突破:响应延迟降低了42%,让用户交互更为流畅;意图识别准确率提升了18%,使模型能更精准地理解用户需求;同时,对话连贯性也得到了大幅优化,为用户提供更自然、连贯的对话体验。
这一系列性能飞跃,得益于Grok4.1继续沿用并深化了其Grok-4MoE(Mixture-of-Experts,混合专家)架构。通过在架构中增加实时反馈层与个性化缓存机制,新模型成功实现了“秒回”式的交互体验,极大地缩短了用户等待时间。
在备受行业关注的基准测试中,Grok4.1同样表现亮眼,刷新了自身多项纪录。其在综合评估模型能力的MT-Bench测试中,得分高达8.97,首次突破8.9大关;在代码生成能力测试HumanEval中,通过率稳定在87.1%的顶尖水平;尤为突出的是,其多轮对话一致性达到了91.4%,较前代产品提升了6个百分点,展现了强大的上下文理解和记忆能力。
更引人注目的是,其无需深度思考的“即时响应”版本以 1465 的 Elo 分数位列第二,性能甚至超越了其他所有模型的“全推理”模式。这一成绩相较于前代 Grok 4(排名第 33 位)实现了巨大飞跃,印证了其在底层能力上的绝对优势。

为平衡用户体验与隐私关切,Grok4.1新增了“情境记忆”开关。用户可自主选择是否授权模型保留其过去30天内的交互记录,以帮助模型学习并优化个人化的回复风格,这一功能的引入体现了xAI在个性化AI服务上的前沿探索。
xAI产品负责人表示,Grok4.1将作为年底“Grok5”的重要预演,其核心任务是重点验证强化学习+人类反馈(RLHF)机制在实际应用中的效果,为下一代模型的技术路线提供数据支持。
在部署与可用性方面,Grok4.1已全量部署至xAI云端,并同步在网页版及X App上更新,移动端更新也将在稍后全面推送。API定价维持不变,依然为每百万token 5美元,而无限次使用权限仍面向X Premium+订阅用户开放。