中国初创公司 Z.ai 近日开源了 GLM-4.5,声称这种推理模型比 DeepSeek 的 R1 更具成本效益。

据称,该算法可以在八张 H20 显卡上运行。H20 是英伟达公司 H100 芯片的缩小版,直到去年,该芯片还是其旗舰人工智能加速器。美国政府最近已批准将这家前加工商出售给中国公司。
GLM-4.5 的推出是在 DeepSeek 发布其开源 R1 推理模型大约六个月后发布的。当时,该公司表示,该算法可以使用比 OpenAI 的 o50 少 1 倍的硬件来执行某些任务。此外,DeepSeek 声称训练其模型的成本仅为早期人工智能项目的一小部分。
据报道,Z.ai 预计每输入 GLM-4.5 的 100 万个输入代币将收取 11 美分。这比 R1 低了 3 美分。100 万个输出代币的成本为 28 美分,略高于 DeepSeek 对 R1 收费的十分之一。
GLM-4.5 成本效益背后的主要因素之一是它相对较小。该模型具有 3550 亿个参数,比 R1 少约 3.16 亿个。GLM-4.5 在任何给定时间仅激活其中的 320 亿个参数,以减少硬件使用。
人工智能模型由许多称为人工神经元的代码片段组成,每个代码片段都执行处理提示所涉及的一小部分工作。反过来,这些神经元被组织成所谓的层。Z.ai 删除了 GLM-4.5 的一些组件以添加更多层,据称这种方法有助于提高模型的推理能力。
该公司通过多步骤工作流程训练了 GLM-4.5。首先,它使用包含价值 15 万亿个代币的信息的数据集开发了模型的初始版本。然后,Z.ai 通过几个较小的训练数据集磨练了 GLM-4.5 的推理技能,这些数据集总共包含超过 7 万亿个标记。
该公司使用十几个流行的人工智能基准测试评估了该模型的功能。据 Z.ai 称,GLM-4.5 的性能优于包括 Claude 4 Opus 在内的多种流行替代品。它排名第三,仅次于 xAI Holdings Corp. 的 Grok 4 和 OpenAI 的 o3。

对于特别强调成本效益的用例,Z.ai 开发了其模型的缩小版,称为 GLM-4.5-Air。该算法具有 1060 亿个参数,大约是原始参数的三倍。GLM-4.5-Air 激活 120 亿个参数来处理提示。
今年 1 月,美国商务部将 Z.ai 家添加到其受出口管制组织实体清单中。该公司得到了阿里巴巴集团、腾讯公司和其他投资者的 15 亿美元资金支持,它计划在今年晚些时候还将申请公开募股。