返回首页
[ 头条新闻 ] 2026-09-02 13:19

Claude Fable 5.1上线:提示缓存直降75%,Agent能力翻倍,Mythos 5.1也来了

Claude Fable 5.1上线:提示缓存直降75%,Agent能力翻倍,Mythos 5.1也来了

Anthropic在9月1日一口气推出了Claude Fable 5.1和Mythos 5.1。这俩模型共享同一个底座,但安全边界不同。Fable 5.1在科学Agent基准上得分翻倍,提示缓存价格直降75%,综合成本比上一代便宜约25%,算是近期很有战斗力的一次模型更新。

同一个底座,两种安全设定

这次模型拆成了两个版本。Fable 5.1面向普通用户和企业,API可以正常调用;Mythos 5.1则把安全限制拉得更严,只对通过审核的受信任机构开放。两个版本底层一样,能力上限基本持平,差别主要在于“能说什么、能做什么”的边界。

  • Fable 5.1:适合大多数开发者和企业场景,可直接接入API。
  • Mythos 5.1:安全级别更高,面向研究机构做敏感任务。

数字说话:Agent能力几乎翻倍

Fable 5.1最出彩的地方在Agent任务。Terminal-Bench-Science 0.1基准上,它拿了52.6%,上一代Fable 5只有24.7%——科学终端类多步骤任务的成功率翻了一倍多。更通用的Terminal-Bench 4.0上,Fable 5.1得了55.8%,Mythos 5.1冲到60.9%。

代码评审的数据也挺有意思。CodeRabbit用45项评审任务对比,Fable 5.1和Fable 5找出的问题数几乎一样:64比65。但评论总数从253条降到166条,琐碎意见从265条降到79条,精确率从32.8%升到37.3%。换句话说,话变少了,每条意见的质量更高。代价是速度变慢:单次评审平均耗时从12分32秒拉长到18分38秒。

价格:缓存便宜了,但别忽略输出Token

这次价格调整力度最大的是提示缓存读取:每百万Token从1美元降到0.25美元,降幅75%。标准输入和输出价格没动,仍是每百万Token 10美元和50美元,上下文窗口保持100万Token。

成本画像比表面看起来复杂。Anthropic估算,普通工作负载综合成本比Fable 5低约25%,高度Agent化的任务最多能降45%。但如果你把推理强度拉到最高,Fable 5.1完成一次智能指数测试任务平均要花3.76美元,比Fable 5贵约20%——因为输出Token用量大概是前代的1.7倍。把推理强度调低,成本可以降到2.72美元,不过还是比Opus 5最高档的2.34美元高。

Cognition已经决定把Devin里的部分流量从Opus 5迁到Fable 5.1。这算是一个信号:在实际Agent产品中,Fable 5.1的性价比已经能打动团队。

真实案例:四年的老Bug和金星地图

性能基准再多,也不如一个具体故事有说服力。Millennium的工程师让Fable 5.1分析外部库、比对反汇编和核心转储文件,结果它定位到一个四五年没解决的崩溃问题。这个Bug大约每运行一百万次才出现一次,人工很难稳定复现。

另一个案例来自NASA数据。Fable 5.1用麦哲伦号雷达数据绘制了金星高分辨率图,能把地表细节分辨到2-3公里,地图已经公开。

Mythos 5.1则更偏向科研重活。在分子设计实验里,它针对三个靶点设计的蛋白质结合剂,亲和力比竞赛最佳方案高10倍;十二个靶点中有效命中率接近50%。

要不要升级?先把账算明白

如果你正在跑云服务器ECS,或者想把这类模型接入公司业务流程,“直接换”不一定是最优解。Fable 5.1在很多场景下确实更划算,特别是缓存命中率高、Agent调用频繁的项目,省下的成本很可观。但输出Token多的任务,成本反而可能上涨,最好先拿自己的prompt跑一轮小流量测试。

国内团队想把Claude接到生产环境的话,云服务器ECS和账号规划这些杂事,易枫顺 - 阿里云官方旗舰级代理商能省不少心;再赶上阿里云代金券活动,企业上云的整体预算还能往下压。

FAQ

Q: Fable 5.1和Mythos 5.1能直接用吗?

A: Fable 5.1面向普通用户和企业,可以通过API正常接入。Mythos 5.1仅限受信任机构,审核门槛高很多。

Q: Fable 5.1到底便宜了还是贵了?

A: 看你怎么用。普通工作负载综合成本比Fable 5低约25%,高度Agent化任务最高能省45%;提示缓存读取价格从每百万Token 1美元降到0.25美元。可如果推理强度拉满,输出Token用量大约是前代1.7倍,单次成本反而会高20%左右。

Q: 现有用Claude Opus 5的团队需要迁移吗?

A: 不一定。Cognition把Devin部分流量迁到Fable 5.1,说明Agent场景下它确实能打。但迁移前最好用小流量测试,重点看缓存命中率和输出Token消耗,别只看模型单价。

Q: Mythos 5.1在科研上有多强?

A: 在分子设计实验中,三个靶点的蛋白质结合剂亲和力比竞赛最佳方案高10倍,十二个靶点有效命中率接近50%。不过它只能由受信任机构访问,普通用户暂时用不到。

关于易枫顺

深圳市易枫顺网络科技有限公司是阿里云官方旗舰级代理商。提供云服务器ECS、云数据库RDS、对象存储OSS等阿里云全系产品官方特惠折扣与代金券申请,以及多云成本优化、企业上云一站式服务。客服热线:19520841949 - 易枫顺

易枫顺 - 阿里云官方旗舰级代理商

来源:InfoQ

微信扫码咨询

微信二维码