
Anthropic PBC 10 月16 日正式发布 Claude Haiku 4.5,这是一款面向成本敏感场景的大型语言模型。新模型的定价为每百万输入令牌1美元、每百万输出令牌5美元,仅为其旗舰模型 Claude Sonnet 4.5 价格的三分之一。

Haiku 4.5 采用混合推理架构,可根据任务需求动态调整计算资源。在默认模式下,模型通过资源占用较低的工作流生成响应;用户也可启用“扩展思维”模式,以获得更复杂、生成时间更长的答案。
该模型基于公共网页、第三方数据及内部记录进行训练,其中包含客户授权使用的数据。通过去除数据集中的重复内容,训练效率得到提升。据称,Haiku 4.5 可处理多达20万个令牌的多模态提示,适用于处理大型商业文档,且单次回复最长支持6.4万个令牌。
在八项主流基准测试中,Haiku 4.5 的性能在多数项目中落后旗舰模型 Sonnet 4.5 不到10%,并在三项涉及编程与数学的测试中超越了前代旗舰 Sonnet 4。

除成本优势外,Haiku 4.5 还被官方称为迄今“最安全的语言模型”,其响应速度较 Sonnet 4 提升一倍以上,特别适合客服聊天机器人等低延迟场景。
该模型也适用于AI代理项目。基于 Sonnet 4.5 的代理可将简单任务交由 Haiku 4.5 子代理处理,从而降低多步骤编程或市场研究类工作流的推理成本。
Haiku 4.5 已通过API接口和 Claude 聊天机器人对外开放,并集成于 Claude Code——这一自五月推出以来已成为公司重要增长动力的编程助手。据路透社报道,Claude Code 的年经常性收入已接近10亿美元。
值得关注的是,Anthropic 的竞争对手 OpenAI 同样提供其旗舰模型的轻量版本 GPT-5 Mini 与 GPT-5 Nano,以更低成本满足有限推理需求。此外,两家公司均支持开发者缓存高频提示的响应结果,通过避免重复生成以进一步控制推理成本。
项目: