服务对象与地域限制
PuppyIP 仅面向海外合规企业及其授权人员提供服务,不面向中国大陆地区开放或提供代理服务。本服务仅限用于中国大陆境外的合法业务活动,严禁在中国大陆境内使用本服务。
代理 IP 或服务器位于境外,不改变上述限制。不得通过中转、转接、共享或转售向中国大陆境内的最终使用者提供本服务。使用前请阅读用户服务协议。
本文要点
- 正式可用与开始计费是两个日期:官方公告为 10 月 1 日,计费计划从 11 月 1 日开始;官方没有在这些页面给出具体时刻或时区。
- 每账户每月含 500 万摄入 token、10 GB-month 存储、1000 次语义搜索和 1000 次全文搜索;两类搜索免费池分别计算。
- OCR 默认关闭;启用后 PDF 上限为 10 MiB,不启用时 PDF 上限仍为 4 MiB,改变 OCR 设置会触发完整重建索引。
- 原生图像嵌入可以选 Qwen3-VL,但它不是默认模型;生成答案、查询改写和外部模型服务的费用另行核对。
发生了什么,适合谁先检查
<a href="https://blog.cloudflare.com/ai-search-ga/">Cloudflare 的 GA 公告</a>把原生图像嵌入、PDF OCR、较大的文件处理能力与计费安排放在同一次更新中。本文在北京时间 10 月 2 日核验公开资料,没有替读者运行实际账户或索引。已有知识库应先估算重建成本;新项目可以用少量文本、扫描件和图片验证检索质量。
官方<a href="https://developers.cloudflare.com/ai-search/get-started/">入门文档</a>提供控制台、Wrangler、Workers 与 Python/REST 路径。产品可供 Workers 免费和付费账户使用,但实例、文件数量等限制随计划不同。音频和视频的进一步支持属于公告中的后续方向,不能当成当前已验收能力。
先分清免费池与超额单价
按<a href="https://developers.cloudflare.com/ai-search/platform/limits-pricing/">官方 Limits and pricing</a>,每账户每月有一个 500 万摄入 token 池、10 GB-month 存储、1000 次语义搜索和 1000 次全文搜索。语义与全文是独立池,不能把它们合成任意搜索共用的 2000 次。图像与 OCR 使用同一个摄入 token 池。
超额基础摄入为每百万 token 0.75 美元;图像处理附加每百万 token 0.50 美元。超额存储为每 GB-month 2 美元;语义搜索(向量或混合)每千次 0.75 美元,全文搜索每千次 0.10 美元。摄入按最终切块计算,重叠部分也计 token;OCR 提取文本对应基础摄入与图像处理附加费。
一个只含文本的假设月:600 万摄入 token、12 GB-month 存储、3000 次语义与 3000 次全文搜索,在各自免费池扣除后,AI Search 这四项超额费用为 0.75 + 4 + 1.50 + 0.20 = 6.45 美元。这不是实际账单或总成本,还未计答案生成、查询改写、外部模型服务、税费及账户其他用量。价格按 10 月 2 日公开文档记录,实际结算前再次核对。
PDF 不是一律 10 MiB,OCR 也不是自动打开
<a href="https://developers.cloudflare.com/ai-search/configuration/data-source/">数据源文档</a>明确区分:启用 OCR 的 PDF 上限为 10 MiB,未启用 OCR 的 PDF 为 4 MiB;纯文本和代码为 10 MiB,其他富文本格式为 4 MiB。超限文件不会成功索引,应检查错误日志,不能仅凭上传动作认定知识已可检索。
OCR 面向所有账户但默认关闭,创建或更新实例时设置 indexing_options.use_ocr 为 true。修改这个开关会触发完整重建索引;已有大库应先记录文件数量、切块量与预算,再安排变更。扫描件能否正确识别仍需实测,OCR 不保证表格、图表或低清图片内容全部准确。
图片检索先确认嵌入模型
<a href="https://developers.cloudflare.com/ai-search/configuration/models/supported-models/">支持模型表</a>列出的原生图像模型为 @cf/qwen/qwen3-vl-embedding-2b,支持图片、1024 维向量和 32768 token 输入。默认模型 @cf/qwen/qwen3-embedding-0.6b 不支持原生图像嵌入;启用产品不表示已选中多模态模型。
使用文本嵌入模型时,图像可走描述文本的路径;原生多模态向量则保留另一种表示方式。应拿相同问题比较命中来源、漏检和误检,而不是仅凭模型名判断质量。表中外部供应商模型的资格与费用另计,不能套用 Workers AI 内置模型的计费边界。
用小样本完成一轮上线验收
第一步,按官方入门路径创建测试实例,选择内置上传、自己的 R2 或网站数据源;只放有权处理的资料。准备一份小 PDF 扫描件、一份普通文本和几张有明确内容的图片,记录文件大小与预期答案。
第二步,按需要启用 OCR 并选择支持图像的嵌入模型。检查索引状态与错误日志,分别确认超限、失败和未索引文件。第三步,用关键词与语义问题分别检索,核对答案中的原始片段与来源,留出应回答不知道的反例。
第四步,记录摄入 token、存储和两类搜索次数,并单独核对答案生成、查询改写的模型用量。第五步,再决定是否扩大数据集或重建旧索引;如果质量或费用不合预期,保留测试结果并调整配置,避免重复摄入整个库。
哪些费用包含,哪些还要另查
官方计费文档称 Workers AI 的嵌入与重排已包含在 AI Search 费用中,AI Search 的存储、向量索引与网站抓取也在对应边界内;答案生成、查询改写和外部模型仍由相应服务计费。过去的 R2 数据源桶不会因为新存储安排自动清空,遗留对象可能继续产生 R2 费用;先审查用途与保留需求,不要直接删除唯一副本。
检索结果差、OCR 未开启、文件超限或免费池用完,都应先查对应配置和计量证据。只有出现明确的 DNS、TLS 或连接超时,才另做<a href="/resources/proxy-connection-troubleshooting-checklist">网络排查</a>;网络变化不能增加免费额度或解除产品限制。
资料来源
常见问题
AI Search 正式可用后马上收费吗?
官方 2026 年 10 月 1 日公告称从 11 月 1 日开始计费。两者日期不同,页面未给出精确切换时刻或时区,实际使用前应再次核对当前计费页。
1000 次语义与 1000 次全文搜索可以互相借用吗?
当前公开文档按两类独立免费池列出,没有说可以互相借用;混合搜索归语义搜索类别。
所有 PDF 都能上传到 10 MiB 吗?
不能。启用 OCR 的 PDF 为 10 MiB;未启用 OCR 的 PDF 仍为 4 MiB。OCR 默认关闭,改变设置会触发完整重建索引。
默认嵌入模型能直接处理图片吗?
默认 @cf/qwen/qwen3-embedding-0.6b 不支持原生图像嵌入。可按官方模型表选择支持图片的 @cf/qwen/qwen3-vl-embedding-2b,并实测检索质量。
AI Search 免费额度包含所有模型推理费用吗?
不包含。内置 Workers AI 嵌入与重排有明确包含边界,答案生成、查询改写及外部模型费用仍需单独核对。