Claude Fable 5.1 发布:缓存读取降价75%,典型负载总成本低25%

Anthropic 的新旗舰 Claude Fable 5.1 在9月初发布,一同出来的还有受限版 Mythos 5.1。官方说明里两个版本是同一个模型,差别只在安全防护级别。Fable 5.1 全平台开放,Claude.ai、Claude Code、API 和各家云上都能用。Mythos 5.1 给网络安全和生命科学场景用,只通过可信访问项目向部分美国机构提供。

Claude Fable 5.1 编程能力

这版提升的方向不是单纯更聪明,而是修问题修到根上,不满足于把表面现象处理掉。早期合作方里,Every 给的评价是,有旗舰级的智能、Opus 级的价格、Sonnet 级的速度。Browserbase 在自家最难的一组浏览器代理任务上测出,Fable 5.1 完成 82%,Opus 5 完成 74%,Fable 5 只有 57%。

基准上拉开得也明显。科研编程的 Terminal-Bench-Science,Fable 5.1 拿到 52.6%,上一代 Fable 5 只有 24.7%。Agentic 编程的 Terminal-Bench 4.0 是 55.8%,Fable 5 是 42%。电脑操作的 OSWorld 2.0 是 77.9%,Fable 5 是 72.9%。Anthropic 自己的评估说,用低或中档的努力程度,就能达到甚至超过 Fable 5 高档位的表现。

价格结构里变化最大的是缓存。单价没动,输入一百万个 token 10 美元,输出一百万个 50 美元。缓存读取从 1 美元降到 0.25 美元,降了四分之三。长上下文、工具密集的 Agent 负载里,这是成本大头,Anthropic 估算典型负载总成本能省 25%,高度 Agentic 的长场景最高省 45%。

对 Claude Code 用户,Fable 5.1 默认按高努力档跑。新版防护下,平均每次会话的安全干预比旧版少约 60%。Red Hat 的反馈是,构建失败的根因现在能直接定位,输出也简洁了。

两个附带的改动要留意。8月2日之后的模型输出都会带欧盟要求的不可见水印。另外 Anthropic 封了公开蒸馏的路子,新建的 API 账号不能再靠手动编辑历史对话保留思考记录来蒸馏模型。对把 Claude 当生产力工具的人,这版的实际收益在成本端,缓存降价对长任务的影响比分数上涨更直接。