Claude Fable 5.1发布:会修根因的编程模型,缓存降价75%总成本省25%

Anthropic在9月初发布了新旗舰:Claude Fable 5.1,以及它的受限版本Claude Mythos 5.1。官方给的定义是”用于编程和知识工作的全球最先进模型”,并且直接点明:Fable 5.1和Mythos 5.1是同一个模型,只是安全防护级别不同。

Fable 5.1面向所有用户开放,Claude.ai、Claude Code、API以及AWS、Google Cloud、Azure上都能用;Mythos 5.1则为网络安全和生命科学设计,只通过可信访问项目向部分美国机构提供。

Claude Fable 5.1 编程能力

强在哪:不只更聪明,还会修根因

按Anthropic的说法,Fable 5.1比Fable 5更聪明,而且不是”表面聪明”——它避免走低质量捷径,能修复软件问题的根因而不是只修表象。早期合作伙伴的反馈也很直接:Every说它”有Fable级的智能、Opus级的价格、Sonnet级的速度”;Browserbase在自家最难浏览器代理基准上,Fable 5.1完成了82%的任务,Opus 5是74%,Fable 5只有57%。

跑分上,Fable 5.1在科研编程基准Terminal-Bench-Science拿到52.6%,Fable 5只有24.7%;Agentic编程Terminal-Bench 4.0是55.8%(Fable 5为42%);OSWorld 2.0电脑操作77.9%对72.9%。Anthropic的评估还显示,Fable 5.1用Low或Medium档努力程度,就能达到甚至超过Fable 5高挡位的性能。

便宜在缓存:典型负载总成本低25%

价格上,Fable 5.1维持Fable 5的每百万token输入10美元、输出50美元不变,但缓存读取价格下降75%,降到0.25美元。对长上下文、工具密集的Agent工作负载来说这是大头——Anthropic估算,典型工作负载总体成本比Fable 5低约25%,高度Agentic的长上下文场景最高能省45%。

对Claude Code用户,Fable 5.1默认以High档努力运行,而且新版防护下,Claude Code用户平均每次会话的安全干预比旧版少约60%。Red Hat的反馈说,用Claude Code时Fable 5.1能直接找到每次构建失败的根因,输出还更简洁。

另外两个变化值得注意:一是8月2日之后的模型输出都要带欧盟要求的不可见文本水印;二是Anthropic封堵了常见的公开蒸馏手法——新创建的API账号没法再用”手动编辑历史对话保留思考记录”的方式蒸馏模型了。对于拿Claude当生产力工具的人来说,Fable 5.1这次升级的性价比提升,比单纯的分数上涨更实在。