3月14日加拿大 AI 初创公司 Cohere 发布了一款名为“Command A”的 轻量级AI 模型,只需要两块英伟达 A100 或 H100 GPU 即可轻松部署,据称性能表现能和 GPT-4o 相媲美,可以用最少的硬件发挥最大的性能。
Cohere 表示,Command A 专门为中小型企业工作环境设计,其支持 256k 的上下文长度和 23 种语言,而作为其他竞争对手的“同类模型”则需要 32 块 GPU 才能部署。
在性能测试中,Command A 最快每秒可以输出 156 个 Token,比 GPT-4o 快 1.75 倍。而在指令追踪、SQL、代理程序和工具任务的基准测试上,Command A 也表现十分出色。
目前,Cohere 的 Command A 已发布在 Hugging Face 平台上( 链接),共专业人员开放使用,以后还会发布至其他云服务平台。