PuppyIP 资源中心
AI 工具动态 7 分钟 发布于 2026-09-27

Claude 拒答也会计费吗?三类输出前拒答与 fallback 成本边界

Anthropic 于 2026 年 9 月 24 日恢复对三类输出前拒答计费。调用 Claude Fable 或 Opus 安全分类器的开发者,先看 stop_reason、stop_details.category 和 usage,再判断空响应是否收费,以及 fallback 是否增加第二次请求成本。

Claude API Anthropic 拒答计费 fallback API 成本

服务对象与地域限制

PuppyIP 仅面向海外合规企业及其授权人员提供服务,不面向中国大陆地区开放或提供代理服务。本服务仅限用于中国大陆境外的合法业务活动,严禁在中国大陆境内使用本服务。

代理 IP 或服务器位于境外,不改变上述限制。不得通过中转、转接、共享或转售向中国大陆境内的最终使用者提供本服务。使用前请阅读用户服务协议。

本文要点

  • 直接答案:输出前拒答只有 bio、frontier_llm、reasoning_extraction 三类恢复按实际运行模型费率计费;其他类别或 null 类别仍不计费,但会占用速率限制。
  • 流式输出到一半才拒答,输入 token 和已经输出的 token 原本就按正常费率计费;不能用最终内容为空或 HTTP 200 推断账单。
  • 若启用 fallback,符合计费条件的首次拒答与后续 fallback 请求分别计费;fallback credit 只补偿后续请求的提示缓存未命中,不把两次模型调用变成免费。
  • Anthropic 文档把该计费规则用于 Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud 和 Microsoft Foundry;服务端 fallbacks 参数仍只在 Claude API 的 beta 中提供。
  • 对成本敏感的团队应按模型、类别、token 用量和每次重试分别核对账单。本文没有账户级实测,误判比例、实际费用增幅和准确生效时刻仍未知。PRODUCT_FIT=NONE:网络出口不能改变拒答类别或模型计费。

先回答费用问题:空响应不等于免费请求

Anthropic 的 2026 年 9 月 24 日 Claude Platform 更新写明,恢复对输出前拒答中 stop_details.category 为 bio、frontier_llm 或 reasoning_extraction 的请求按运行模型费率计费。它针对的是安全分类器拒答,不是所有没有生成文本的 API 请求;公告只有日期,没有公开精确切换时刻或时区。

Claude Fable 5.1、Fable 5、Opus 5.5 和 Opus 5 的相关文档把分类器拒答表示为正常 HTTP 200、stop_reason 为 refusal、content 可以为空、usage 仍列 token。先保留响应中的模型名、stop_reason、类别和 usage,再判断费用。模型单价应查当前价格表;Opus 5.5 的模型价和迁移边界另见<a href="/resources/claude-opus-5-5-pricing-reset-migration-guide">Claude Opus 5.5 价格与迁移说明</a>。

影响矩阵:拒答阶段、类别与 fallback 分开算

输出前拒答:bio、frontier_llm、reasoning_extraction 三类按实际运行模型计费;cyber、general_harms、其他类别或 null 类别不计费,但仍计入 rate limits。即使 output_tokens 为 0,也不能把前一组写成零费用;反过来,usage 显示输入 token 也不能推断后一组已收费。

流式中途拒答:已处理的输入和已流出的输出按正常费率计费,之后的部分应视为不完整而丢弃。fallback:若首次拒答在中途发生或属于三种可计费类别,首次调用与随后真正运行的 fallback 模型分别产生费用。fallback credit 补的是重试请求的提示缓存未命中成本,不能抵消两次请求的全部 token 费用。

哪些平台受规则影响,fallback 应怎么选

Anthropic 将拒答计费规则列为适用于 Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud 和 Microsoft Foundry。平台适用不等于功能入口相同:服务端 fallbacks 参数目前仅在 Claude API beta 可用,且需要 server-side-fallback-2026-07-01 头;Bedrock、Google Cloud 和 Microsoft Foundry 需评估 SDK 中间件或客户端重试。

要在一次 Claude API 调用中获得 Anthropic 推荐的分类 fallback,可评估服务端 default 模式;要固定可审查的后备模型或跨平台一致行为,可评估客户端方案。两种选择都应记录实际回答模型和 usage.iterations。速率限制、过载与服务器错误不会因安全分类器 fallback 自动解决,不应把所有 HTTP 失败都当成拒答重试。

给现有调用链做成本核对,不预设账户结果

先在现有日志中区分 stop_reason=refusal 和普通 4xx/5xx;仅在合法保留范围内记录 category、响应 model、输入/输出 token、是否中途输出、是否真的出现 fallback_message,以及对应账单窗口。按类别和模型分组比较 9 月 24 日前后同口径样本,再与提供商账单核对。缺失分类字段、跨平台计费映射或账单未结算时,结论保持未知。

如果成本或拒答率超过团队门槛,先暂停自动重试扩量、保留原始请求与响应 ID,分别检查分类器拒答和业务异常。不要靠换 IP 或更换账户推断能够绕过计费或安全规则。正常 400 参数错误的排查可参考<a href="/resources/claude-fable-5-1-migration-400-error-guide">Claude Fable 5.1 迁移错误说明</a>,但它不应混入拒答费用统计。

目前不能从官方公告推断的事

官方文档没有给出每个客户实际账单、分类误判率、被影响请求的频率或你的应用成本增幅。公告使用日期级时间,不能倒推某个时区的午夜生效。类别列表也可能随 Anthropic 后续测量调整,因此预算和告警应以当前官方分类表及真实账户账单为准。

资料来源

常见问题

Claude 输出前拒答一定收费吗?

不一定。自 2026 年 9 月 24 日公告起,bio、frontier_llm、reasoning_extraction 三类按运行模型费率计费;其他或 null 类别输出前拒答不计费,但占用速率限制。

HTTP 200 且 content 为空,如何判断是否为可计费拒答?

检查 stop_reason 是否为 refusal,再看 stop_details.category、响应 model 和 usage;仅靠 HTTP 状态或 content 为空不能判断。最终金额仍须对照账户账单。

流式输出到一半才拒答,前面的 token 计费吗?

计费。已处理的输入 token 和已经流出的输出 token 按正常费率计算,部分输出应视为不完整。

开启 fallback 会把首次拒答费用抵消吗?

不会。首次拒答若属于可计费类别或发生在流式中途,会与后续真正运行的 fallback 请求分别计费;fallback credit 仅补偿后续请求的提示缓存未命中。

Bedrock 或 Google Cloud 能直接用 Claude API 的服务端 fallbacks 参数吗?

不能据此假设。拒答计费规则适用于这些平台,但服务端 fallbacks 参数目前是 Claude API beta 功能;其他平台应核对其 SDK 中间件或客户端重试支持。

更换网络出口能避免 Claude 拒答计费吗?

不能。拒答分类与计费由模型请求和平台规则决定,网络出口不改变类别、费率或账户账单。