PuppyIP 资源中心
AI 工具动态 7 分钟 发布于 2026-10-08

Haiku 5.5上线:每百万输入0.10美元,超过100k怎么计费?

Haiku 5.5已经正式发布,短请求的API输入单价降到每百万tokens 0.10美元。不过100k是一道计费分界:超过它,输入和输出都按另一档算。高频摘要、分类和子任务值得重新估算,长任务别直接套最低价。

Claude Haiku 5.5 Claude API API费用 Max 提示缓存

服务对象与地域限制

PuppyIP 仅面向海外合规企业及其授权人员提供服务,不面向中国大陆地区开放或提供代理服务。本服务仅限用于中国大陆境外的合法业务活动,严禁在中国大陆境内使用本服务。

代理 IP 或服务器位于境外,不改变上述限制。不得通过中转、转接、共享或转售向中国大陆境内的最终使用者提供本服务。使用前请阅读用户服务协议。

本文要点

  • 官方10月7日宣布Haiku 5.5可用,Claude Platform模型ID为claude-haiku-5-5;具体云地区和账号开放仍要确认。
  • prompt不超过100k tokens时,输入0.10美元、输出0.50美元;超过100k则为0.50美元和2.50美元,均按每百万tokens计。
  • 首次加入可调effort,但更高推理投入和新的分词方式会改变实际成本,不能保证每项任务都省75%。
  • Max与Team的API赠额本周逐步推出;需满足订阅条件并关联组织,不是聊天额度统一重置。

先回答:现在能用,适合拿来做什么?

Anthropic于2026年10月7日正式发布Claude Haiku 5.5,定位是高频、对成本和速度敏感的任务。开发者可在Claude Platform使用claude-haiku-5-5。

官方也宣布AWS、Google Cloud和Microsoft Azure提供该模型。这里是平台可用声明,不代表每个地区、账号或第三方工具都已经出现入口;使用云服务的人仍需确认自己的模型目录与权限。

摘要、分类、压缩上下文和范围明确的子任务,是值得先评估的场景。复杂的长程编码仍应比较Sonnet或Opus;小模型更便宜,不等于所有任务都应切过去。

0.10美元的前提:prompt不超过100k

按官方API价格表,prompt不超过100,000 tokens时,每百万输入tokens为0.10美元,输出为0.50美元。超过100k时,对应单价变为0.50美元和2.50美元;100k是价格档位门槛,不是本文确认的上下文上限。

缓存读取同样分档:每百万tokens为0.01美元或0.05美元。5分钟缓存写入为0.125美元或0.625美元,1小时写入为0.20美元或1美元;前后分别对应不超过100k与超过100k。缓存时长也会改变费用。

举个虚构算例:一次请求有20,000个未缓存输入tokens和2,000个输出tokens,只算这两项,费用为0.002美元加0.001美元,即0.003美元。它不是每次请求0.10美元,也没有包含其他工具或服务费用。

effort可调了,为什么还要重新估算?

Haiku 5.5首次给Haiku系列加入可调effort,可以理解为让模型投入多少推理工夫。它增加了选择,但更高投入并不自动保住最低成本;应按自己的任务比较结果、延迟和实际token用量。

官方所说平均运行成本约降低75%,包含请求长度构成和分词变化。迁移文档提醒,相同文本在新分词器下可能使用更多tokens;单价下降比例不能直接当成每项任务的账单降幅。

同日Sonnet 5.5缓存读取从每百万0.20美元降至0.10美元。省下多少取决于实际缓存读取占比,不能把这一项减半写成所有Sonnet调用总价减半。

换了模型ID,还要检查哪些旧参数?

先在独立测试请求中换为claude-haiku-5-5,并重新核对输入长度、输出上限与返回内容。这个模型ID不带日期;不要只改名称,然后假设旧请求格式和用量完全相同。

迁移文档提示,旧的enabled加budget_tokens思考配置应改为adaptive。默认自适应思考时,响应可能先有thinking块;读取结果时按内容块类型取文本,别把第一个块固定当答案。

还应检查assistant prefill,它在新模型上会返回400;temperature、top_p、top_k等旧采样参数也按迁移说明清理。若使用computer或browser工具,另看对应toolset要求,不把参数错误误判成网络故障。

Max和Team赠额:先看资格,再看到账

同次公告提出本周逐步推出每月API赠额:Max 5x为100美元,Max 20x为200美元;Team按席位形成共享额度,Standard每席20美元、Premium每席100美元,每月合计最多500美元。Team不是每个账号各得500美元。

帮助中心要求订阅有效、状态良好且已满七天;Free、Pro和Enterprise不属于该赠额范围。合资格用户在网页Billing的API credits中关联Claude Console组织,入口尚未出现时不能预设额度已到账。

关联操作由Max订阅本人,或Team的Owner、Primary Owner完成;操作者还需具有关联Console组织的Owner、Admin或Billing权限。只具备Team管理员身份,不代表能关联任意API组织。

一份计划只关联一个组织,一个组织也只关联一份计划,不能自助随意换绑。赠额按账单周期刷新,到期不滚存;它用于Claude Platform API,不用于Bedrock、Vertex、Foundry或交互式Claude Code、Cowork额外用量。

现在怎么选,才能把低价变成实际收益?

先选一个范围明确、重复较多的任务,保留现有模型作为比较对象。用同一批自己有权使用的样本,记录正确结果、重试次数、总tokens和费用;一次回答快,不足以证明整个工作流更省钱。

再根据真实请求长度选价格档位,根据缓存命中情况算缓存项。若小模型频繁返工或升级大模型才能完成,把这些额外步骤计入总成本,而不是只展示最低输入单价。

本文未调用模型、领取赠额或实测速度。发布日期、API价格和计划条件来自已打开的官方原文;云地区、具体账号菜单及赠额实际到账,仍以本人平台状态为准。

资料来源

常见问题

Haiku 5.5是免费模型吗?

不是。公告给出了按tokens计费的API单价。Max或Team的合资格赠额属于单独权益,有周期与使用入口限制,不代表模型无限免费。

API赠额会增加Claude聊天套餐的周额度吗?

不会。帮助中心明确套餐用量限制保持原状。新增权益用于关联组织的Claude Platform API,要与聊天、交互式Claude Code及额外用量分别核对。

官方说最快,是否比Opus Fast Mode也快?

官方脚注按各模型标准速度比较;同时注明Haiku 5.5仍慢于Opus的Fast Mode。实际延迟也受任务、effort、工具和平台影响,本文没有速度实测。