本文要点
- Claude Fable 5.1 已于 2026 年 9 月 1 日发布,Claude API 模型 ID 为 claude-fable-5-1;Mythos 5.1 只向获批组织开放。
- Fable 5.1 不支持强制 tool_choice 的 any 或指定 tool;继续发送会返回 400 invalid_request_error。
- thinking 始终自适应;disabled、enabled 加 budget_tokens,以及最后一条 assistant prefill 都会失败。
- Fable 5.1 与 Mythos 5.1 默认要求 30 天数据保留;未获明确授权的 ZDR 组织请求会返回 400。
- 先固定旧模型基线,再灰度新模型;工具调用、thinking block、拒绝、成本和长任务恢复任一失真都应停手。
发生了什么:为什么只换模型 ID 仍会报 400
Anthropic 于 2026 年 9 月 1 日发布 Claude Fable 5.1 和 Claude Mythos 5.1。Fable 5.1 面向一般 API 客户,模型 ID 是 claude-fable-5-1;Mythos 5.1 使用 claude-mythos-5-1,但仍限 Project Glasswing 获批客户。两者不是把旧请求体原样复制后一定成功的别名。
最典型场景是:模型名已经更新,生产请求却连续返回 400。错误直觉是先换代理或无限重试;真正风险通常来自强制工具、手动 thinking、assistant prefill 或数据保留条件。第一步应保存错误体与 request ID,并对请求参数做静态清点。
先选 Fable 5.1 还是 Mythos 5.1
普通编码、知识工作和长时间代理任务优先评估 Fable 5.1,因为它不要求 Mythos 的访问审批。Mythos 5.1 面向获批的网络防御和生命科学组织;没有获批资格时,不要把 model not found 当成网络故障,也不要用反复换账号绕过访问控制。
Fable 5.1 与 Mythos 5.1 使用相同基础能力,但安全分类器、可用范围和审批路径不同。官方还说明 Fable 请求可能因安全分类转到其他模型;业务必须记录实际响应、stop_reason 和 stop_details,而不是只记录请求中的模型名。
四类必须清理的请求配置
第一类是 tool_choice:auto 和 none 可用,any 或指定 tool 会返回 400。若只是为了强制结构化 JSON,改用严格 schema 的输出格式;若业务必须调用某个工具,应把要求写进指令并验证实际 tool_use,不能假装仍有服务端强制保证。
第二类是 thinking:不要发送 disabled,也不要发送 enabled 加 budget_tokens;第三类是最后一条 assistant prefill,应改为 system 指令或结构化输出;第四类是 temperature、top_p、top_k 等旧采样控制,跨代迁移时应按官方模型说明删除而不是继续试值。
跨模型 thinking block 可能让续接会话失败
Fable 5.1 可以读取部分旧模型产生的 thinking blocks,但旧模型不能读取 Fable 5.1 产生的 blocks。若灰度路由会在同一会话中来回切模型,直接复用完整 assistant 内容可能让回滚链路失效。
上线前要分别测试旧到新、新到新、新回旧三条路径。回滚时优先从用户可见文本、工具结果和业务状态重建上下文,不要假设受保护的 thinking 内容可以跨模型往返。
数据保留、价格与可用性边界
官方迁移指南写明,两种 5.1 模型默认要求 30 天数据保留;没有明确授权的 ZDR 组织或工作区会收到 400 invalid_request_error。先让安全、法务和账号负责人确认工作区资格,不要在生产报错后临时修改全组织数据策略。
Fable 5.1 的输入与输出单价与 Fable 5 相同,缓存读取单价降低;但真实单任务成本仍取决于缓存命中、工具循环、输出长度和回退模型。价格页和账单是最终依据,不能把官方示例中的平均节省当作自己的承诺。
从清点到灰度的七步迁移
按顺序执行:搜索所有模型 ID;导出请求参数矩阵;删除会触发 400 的配置;固定一批文本、工具、长上下文和拒绝样本;在测试工作区回放;按小比例灰度;最后才更新默认模型和后台任务。每一步都记录负责人、样本、错误率、延迟、token、缓存和费用。
无人值守代理还要验证超时、取消、工具幂等、会话恢复和通知。若只验证一条同步文本请求,不能据此放行定时任务或长时间代理。可结合<a href="/resources/ai-api-key-base-url-model-guide">AI API 配置指南</a>核对 endpoint、key、model 三层边界。
停手、回滚与排错顺序
出现持续 400、强制工具语义无法替代、跨模型会话不能恢复、ZDR 资格不清、拒绝分类未处理、成本或延迟超出阈值时,应停止扩大流量。保留旧模型路由和独立会话基线,不要在事故中同时改提示、SDK、模型和网络。
排错顺序是错误体与 request ID、模型可用性、请求参数、工作区保留策略、工具与会话状态,最后才是连接层。只有 DNS、TLS、连接超时或代理认证证据出现时,才转到<a href="/resources/proxy-connection-troubleshooting-checklist">代理连接排查清单</a>。
资料来源
常见问题
Claude Fable 5.1 的 API 模型 ID 是什么?
官方迁移指南给出的模型 ID 是 claude-fable-5-1。Mythos 5.1 使用 claude-mythos-5-1,但只对获批组织开放。
迁移后 tool_choice 为什么返回 400?
Fable 5.1 不支持 any 或指定 tool 的强制选择。使用 auto 或 none,并用严格结构化输出或明确指令替代旧强制方式。
budget_tokens 还能继续使用吗?
不能。Fable 5.1 和 Mythos 5.1 的 thinking 始终自适应;手动 enabled 加 budget_tokens 以及 disabled 都会返回 400。
ZDR 工作区可以直接调用 Fable 5.1 吗?
默认不可以。官方要求 30 天数据保留,除非 Anthropic 明确授权;不满足条件的组织或工作区请求会返回 400。
Fable 5.1 能直接接着旧模型的会话跑吗?
需要测试。它能读取部分旧模型 thinking blocks,但旧模型不能读取 Fable 5.1 产生的 blocks,灰度回滚尤其要验证。
什么时候应该回滚到旧模型?
当工具调用、会话恢复、数据保留、拒绝处理、成本或错误率未达到预设门槛时,停止放量并回到已验证的旧路由。