Claude Code 默认模型换成 Fable 5.1:1M 上下文、缓存读取降 75%,auto 模式多了条碰不得的红线

扁平编辑插画:Claude Code 终端设置窗口中央一个默认模型切换开关指向新版本,右侧一枚价签显示缓存价格箭头向下直降 75%,窗口底部一条红色安全边界线上立着盾牌,象征默认模型升级与 auto 模式安全红线收紧
内容摘要

9 月 1 日 Claude Code 迎来大版本更新,默认模型换成 Fable 5.1:1M 上下文、缓存读取直降 75%,auto 模式新增"逃逸遏制"红线,不再自动放行抓云凭据等危险操作。本文讲清新模型能省多少钱、哪些配置会踩坑,以及接 API 的团队必改的破坏性变更。

Claude Code 用户注意:这周最大的更新不是”多了个新功能”,而是默认模型悄悄换了

9 月 1 日,Anthropic 一口气发布 Claude Code v2.1.257 和 v2.1.258。其中 v2.1.257 是当周最大的一次版本更新,官方 changelog 里塞了 80 多项变更,最关键的一条是:Claude Fable 5.1 正式成为 Claude Code 的默认 Fable 模型。

对普通用户来说,这意味着什么都不用改——升级完 Claude Code,下一次对话跑的就是新模型。

一、Fable 5.1 换了什么:1M 上下文,缓存读取降 75%

先看模型本身。Fable 5.1(模型 ID:claude-fable-5-1)支持 100 万 token 上下文,默认输出 64K、上限 128K,定价维持每百万输入 $10、输出 $50。

真正的变化在缓存读取:从每百万 token $1 直接降到 $0.25,降幅 75%。Anthropic 给的说法是,典型负载下光这一项就能让有效成本降约 25%;而长会话、反复读大仓库这类上下文很重的 agent 场景,省幅能到四成以上。

顺带一提,同一天 Anthropic 还发布了 Mythos 5.1。它和 Fable 5.1 共用同一套底模,只是护栏不同——Mythos 只对通过验证的网络安全、生命科学机构开放。普通用户用不上,但这条产品线说明 Anthropic 已经在认真做”同一模型、不同安全策略”这件事了。

这里有个坑要提醒:如果你是在 Claude 官方应用或网关环境里用 Claude Code,fable 和 best 这两个别名目前还没自动指向 5.1,仍会解析到老的 Fable 5。想立刻用上,要在 /model 里手动选 claude-fable-5-1;不确定自己跑的是哪个版本,敲一下 /model 看最保险。

二、auto 模式多了条碰不得的红线

如果说换模型是”给你好处”,那 v2.1.257 的另一半就是”给你上规矩”——新增的 Containment Escape(逃逸遏制)规则,专治 auto 模式。

以前 auto 模式为了少打扰你,会把操作一股脑自动批准。现在有四类动作不再自动放行,会停下来等明确确认:

  • 抓云元数据凭据(就是 AWS/GCP 上那个经典的 169.254.169.254 内网地址);
  • 试图绕过出网限制(egress evasion);
  • 跨租户访问;
  • 容器逃逸类操作。

说白了,这些都是在长跑 Agent 上被反复验证过的真实攻击路径:提示词注入进长任务后,借 Agent 之手去偷云上凭据。以前要靠你自己配策略去堵,现在官方默认替你踩了刹车。

另外两个小变化方向一致:auto 模式第一次读取工作目录以外的文件,会先弹一次询问(也可以用 permissions.blockReadsOutsideWorkingDirectories 直接禁止);项目设置里的 defaultMode: "bypassPermissions" 被直接忽略,不再生效。

这波操作让我想起昨天刚写的那场事故(Claude Code 一次”安全审查”删掉 700GB):那次 Anthropic 的”安全降级”机制把高能力模型换成弱模型,结果越帮越忙。这次的思路明显换了——不再靠降级模型来”变乖”,而是给 Agent 画边界、卡敏感动作。方向对了。

三、两个会踩坑的变更

对普通 CLI 用户,这版基本都是增量改进:新增 timeFormat / timeZone 设置,可以固定回合结束时钟和会话时间戳的时区;CLAUDE_CODE_SUBAGENT_MODEL_FORCE 环境变量可以强制所有子代理统一用某个模型,批量降本很好使;/effort 也支持 -s 参数,只对当前会话生效。

但如果你是自己接 Anthropic API 做编排,有个硬性破坏性变更必须知道:强制指定工具的 tool_choice 参数({type: "any"} 或指定某个工具)现在直接返回 HTTP 400,token 计数和批量任务里也一样。官方给的替代思路是显式编排:声明可用工具、让模型自己选、路由逻辑放到应用层。虽然更啰嗦,但每一步都可追踪。建议现在就扫一遍代码,别等线上半夜报错。

四、老达点评

第一,”换默认模型”比”发新模型”更值得关注。发新模型你可以不理会;默认模型一换,所有 Claude Code 用户被动升级。Anthropic 敢这么干,说明 Fable 5.1 在真实 agent 工作流上的稳定性过了他们自己那关。这也是为什么我一直建议盯紧 Claude 专题——模型轮换本身就是风向标。

第二,成本账要重新算。缓存读取降 75%,对每天开长会话、反复读大仓库的人来说是实打实的省钱。过去因为”上下文烧钱”不敢开的任务(整库分析、长文档批量处理),现在可以重新评估。更系统的省钱思路是不同负载用不同档位的模型路由,别一个旗舰模型跑到底。

第三,安全正在从”人肉审批”走向”边界规则”。Claude Code 这半年的演进脉络很清楚:先是各种审批模式,然后 auto mode,现在给 auto mode 装”红线”。配合这周聊过的桌面端 /resume 跨窗口续跑和之前的四连更,一个共识在成型:让 AI 放手干,但把不可逆的高风险动作焊死在边界里。这条思路对 Codex、Cursor 同样适用——别只盯着模型榜单,多看看各家给 Agent 画的边界画到哪了。

升级建议就三条:升级后先 /model 确认版本;auto 模式涉及云操作、容器环境的,把新规则先在低风险任务上跑一遍;接 API 的团队,今天就把强制 tool_choice 的代码清掉。

相关阅读:

发表评论

您的电子邮箱地址不会被公开,必填项已标注 *