Claude Fable 5.1 测评,缓存降价能省多少
这篇 Claude Fable 5.1 测评讲清它与 Mythos 5.1 的关系、缓存读取价格和开放范围,并给出 Claude Code 长会话的成本核对方法。
Claude Fable 5.1 与 Claude Mythos 5.1 在 9 月初同时发布。两个名字很容易让人以为需要选性能档位。Anthropic 的说明更直接,它们使用同一底层模型,主要差别来自安全措施和开放范围。普通个人与团队能使用的是 Fable 5.1,Mythos 5.1 只向经过审核的网络安全与生命科学机构开放。这篇 Claude Fable 5.1 测评重点看普通用户真正能获得的能力与成本变化。
75% 指的是缓存读取单价
Fable 5.1 的常规 API 价格仍是每百万输入 token 10 美元、输出 token 50 美元。缓存读取降到每百万 token 0.25 美元,比 Fable 5 低 75%。这项变化对 Claude Code 一类长会话很重要,因为系统提示、代码文件和工具说明会在多轮请求里反复出现。
整张账单不会自动下降 75%。Anthropic 根据 2026 年 8 月的实际用量估算,典型工作负载的总成本约低 25%,上下文和工具调用较多的代理任务最高可能低约 45%。这两个数字来自发布方测量,具体节省取决于缓存命中率。提示词前半段经常变化,系统就会重新按完整输入计费。
近期 Claude Code 社区报告过 Fable 5.1 上线后的缓存回归,官方更新日志随后修复了几类问题。用户的实际感受因此会受到客户端版本影响。比较 Fable 5 和 5.1 以前,应当先更新 Claude Code,并查看成本命令里的缓存写入、缓存读取和未缓存输入。
Fable 与 Mythos 怎么选
对绝大多数用户,答案已经由访问条件决定。Fable 5.1 在 Claude、Claude Code 和 API 等平台开放,也可通过主要云平台使用。Mythos 5.1 面向经过审核的专业机构,目前开放范围很小,价格从每百万输入 token 10 美元、输出 token 50 美元起。
Mythos 的价值来自更适合专业网络安全与生命科学研究的安全边界。Fable 的网络安全限制也比上一代更精确。Anthropic 称误拦截正常安全请求的比例降低了 60%,并允许模型帮助发现源代码漏洞,但仍限制漏洞利用开发等高风险任务。
普通开发者无需寻找 Mythos 的入口。代码编写、知识工作和常规漏洞修复先用 Fable 5.1。只有所在机构符合受信访问计划,且任务确实受到 Fable 限制时,Mythos 才成为实际选项。
长会话怎样验证节省
选三类真实任务做比较。第一类是短问答,缓存帮助有限。第二类是持续修改同一代码库的 Claude Code 会话。第三类是包含多个代理和工具的长流程。每类至少跑五次,记录成功率、总输入、缓存读取、缓存写入和总费用。
保持可缓存的前缀稳定。项目规则、工具定义和长期背景放在前面,临时日志与当轮要求放在后面。频繁改动前缀或在会话中切换推理配置,可能让已有缓存失效。缓存命中突然归零时,先检查客户端版本和会话结构,再判断模型变贵。
Fable 5.1 还支持用较低推理档位完成部分任务。官方称它在低档位可以用更低成本取得接近或超过 Fable 5 的结果。测试时从能通过验收的最低档开始,随后只对难任务增加推理。这样才能把缓存降价和推理消耗分开观察。
当前结论
Fable 5.1 的升级价值主要落在长上下文与工具密集型工作。缓存读取单价大幅下降,会直接帮助多轮编码和代理流程。短会话里,10 美元输入和 50 美元输出的基础价格没有下降,节省可能很小。
普通用户选择 Fable 5.1 即可。先更新 Claude Code,确认缓存命中正常,再用真实任务比较整张账单。看到缓存便宜 75% 就预估总费用也降 75%,会把采购判断带偏。
