编程跑分翻倍、缓存成本直降75%:Anthropic双发Claude Fable 5.1与Mythos 5.1,同一模型两种安全等级

9.2 两款模型采用完全相同的基础模型,区别仅在于安全防护等级Fable5.1面向所有用户开放,Mythos5.1仅通过可信访问计划向经过审核的网络安全和生命科学领域机构提供

当地时间9月1日,Anthropic宣布推出Claude Fable 5.1与Claude Mythos 5.1。两款模型采用完全相同的基础模型,区别仅在于安全防护等级——Fable 5.1面向所有用户开放,Mythos 5.1仅通过可信访问计划向经过审核的网络安全和生命科学领域机构提供。

跑分翻倍:科研Agent能力从24.7%跃至52.6%

在智能体科学研究基准Terminal-Bench-Science 0.1中,Fable 5.1得分52.6%,而前代Fable 5仅为24.7%、Opus 5为29.0%、GPT-5.6 Sol为22.4%——提升超过一倍。

在智能体编程基准Terminal-Bench 4.0中,Fable 5.1得分为55.8%,Mythos 5.1在更宽松的安全防护下达60.9%。

知识工作方面,Fable 5.1在GDPval-AA v2测试中获得1853分,高于Opus 5的1824分和Fable 5的1723分。

在Artificial Analysis最新大模型排行榜上,Fable 5.1的两个版本包揽第一和第二,前四位全部由Anthropic旗下模型占据。

360截图20260902141422

价格更便宜:缓存读取费用直降75%,高Agent负载省45%

基础定价保持不变:输入每百万Token 10美元,输出每百万Token 50美元。但缓存读取费用下调75%,降至每百万Token 0.25美元。

典型工作负载下,Fable 5.1成本比Fable 5低约25%;高度智能体化的工作负载成本最高可降低45%。

科学能力落地:从蛋白质设计到金星地图

Anthropic展示了新模型在多个科学领域的真实成果:

蛋白质设计:Mythos 5.1利用开源蛋白质设计工具,在三个靶点上设计的蛋白质结合亲和力比蛋白质设计竞赛最佳作品高出10倍;在12个靶点上命中率接近50%,而行业典型命中率仅10%-15%。

计算分析:Fable 5.1基于NASA麦哲伦任务30多年前的雷达图像训练神经网络,绘制出覆盖金星三分之一区域的高分辨率高程地图,分辨率从10-20公里精细到2-3公里,精度提升25%。

计算生物学:Mythos 5.1通过编写自定义GPU内核,将七个开源深度学习模型推理速度提升最多2.5倍,预计可降低GPU成本30%-60%。

安全与合规:双轨策略应对监管

“双模型”策略:Fable 5.1与Mythos 5.1权重相同,但后者配备更宽松的安全防护,仅面向经审核的网络安全和生命科学机构。

误报大幅减少:新版网络安全防护的误报拦截数量比此前减少约60%。Fable 5.1现可用于发现软件漏洞,但不会用于开发利用程序。

欧盟AI法案合规:Fable 5.1已为生成文本加入不可见水印,满足自2026年8月2日起生效的透明度义务。

企业级数据防护(EFS):将零数据保留与先进安全防护结合,客户数据存储在由企业完全控制的云基础设施中,今年秋季推出。

这次发布的核心看点在于“同一模型,两种安全等级”的设计——Anthropic正在探索一种新的产品形态:最强模型不一定会以同一种形式提供给所有人。性能方面,科研Agent能力翻倍的同时,长任务成本下降45%,说明Anthropic的优化方向已从“单次问答”转向“持续运行的智能体”。而在IPO前夕发布这样一款兼具性能突破、成本优化与安全分级的产品,也是一次面向资本市场的“模型路演”。