PuppyIP 资源中心
AI API 迁移 13 分钟 发布于 2026-09-10

阿里云 Model Studio DeepSeek 模型下架:10 月 10 日迁移清单

阿里云 Model Studio 官方文档于 2026 年 9 月 10 日标明:DeepSeek V3、V3.1、V3.2、R1、R1-0528 及三款 R1 蒸馏模型将在 10 月 10 日下架。仍使用这些 model ID 的团队应先盘点区域、端点和调用,再用官方建议的 Qwen 模型做固定样本灰度,不要只改模型名后直接全量切换。

阿里云 Model Studio DeepSeek 模型下架 Qwen API 迁移

本文要点

  • 下架范围包括 deepseek-v3、deepseek-v3.1、deepseek-v3.2、deepseek-v3.2-exp、deepseek-r1、deepseek-r1-0528,以及 deepseek-r1-distill-qwen-7b、14b、32b。
  • 官方建议替代模型是 qwen3.7-plus、qwen3.7-max 和 qwen3.6-flash,但没有声明它们与每个 DeepSeek 模型一一等价。
  • 截止日为 2026 年 10 月 10 日;官方页面只给出日期,没有给出执行时刻、时区、错误码、自动路由或宽限期,这些均为 UNKNOWN。
  • Model Studio 的 Workspace endpoint、API Key、可用模型和配额按区域区分,迁移时不能把北京、新加坡、弗吉尼亚、法兰克福或东京配置混用。
  • 迁移验收必须覆盖输出质量、thinking 参数、工具调用、结构化输出、流式结束、上下文、速率限制、费用和失败处理。
  • PRODUCT_FIT=CONDITIONAL_NETWORK_ONLY:固定出口不能延长模型寿命;只有 DNS、TLS、407、超时或区域链路差异才进入网络排查。

发生了什么:九个 DeepSeek model ID 将被下架

阿里云 Model Studio 的 DeepSeek API 文档标注 Last Updated: Sep 10, 2026,并明确 deepseek-v3、deepseek-v3.1、deepseek-v3.2、deepseek-v3.2-exp、deepseek-r1、deepseek-r1-0528,以及 deepseek-r1-distill-qwen-7b、deepseek-r1-distill-qwen-14b、deepseek-r1-distill-qwen-32b 将于 2026 年 10 月 10 日下架。

页面没有提供下架执行的具体时刻、时区、错误码、自动重定向、宽限期或逐区域完成顺序,因此这些细节均为 UNKNOWN。第一步是从代码、环境变量、配置中心、API 网关、定时任务、批处理、评测脚本和账单标签中找齐九个旧 ID,并记录业务 owner、调用区域和最后验证时间。

替代模型不是一一映射:先按任务类型建立选择矩阵

官方建议使用 qwen3.7-plus、qwen3.7-max 或 qwen3.6-flash,但没有把某个 DeepSeek V3/R1 ID 固定映射到某个 Qwen ID。团队应按推理强度、延迟、成本、上下文、工具调用、结构化输出和地区可用性分别选择候选,不要把推荐列表理解成行为兼容承诺。

为每个旧调用记录输入类型、thinking 设置、temperature、max tokens、工具 schema、JSON 约束、流式解析、重试、并发和验收阈值。保留一组脱敏固定样本及人工判定标准,再对三个候选逐项比较;没有完成这一步时,只能标记待迁移,不能把一次 200 响应记为完成。

先锁定区域与 endpoint:Workspace ID、Key 和模型可用性必须成套

DeepSeek 文档列出的 OpenAI-compatible Workspace endpoint 覆盖北京、弗吉尼亚、新加坡、法兰克福和东京,URL 都包含对应区域的 WorkspaceId。官方同时提示不同区域的可用模型和 rate limit 可能不同;API Key、Workspace 和 base URL 应作为一套配置核对。

不要把北京 Key 配到新加坡 endpoint,也不要只因模型名相同就假设区域、数据边界、配额和价格一致。迁移清单至少保存 region、base URL、Workspace ID 引用、Key owner、model、协议和限流配置;密钥本身不得写入日志、测试夹具或资源页。

协议和参数验收:Chat Completions、Responses 与 thinking 分开测

现有 DeepSeek 调用可能走 OpenAI Chat Completions、DashScope 或 Anthropic-compatible Messages。官方文档还说明 Responses API 目前只支持列出的 DeepSeek V4 模型并且仅在北京和新加坡可用;不能由此推断待下架的 V3/R1 调用会自动获得相同协议能力。

测试应分别覆盖非流式、流式、工具调用、结构化输出、多轮、长上下文、拒答和超时。enable_thinking 不是标准 OpenAI 参数:Python OpenAI SDK 示例通过 extra_body 传递,Node.js 示例为顶层参数;迁移到 Qwen 后应按目标模型文档重新确认,而不是照搬后假定生效。

灰度迁移:固定样本、真实费用与可回退流量一起验证

先在非生产环境对三个建议模型运行同一批固定样本,记录实际 model、request ID、首 token、总耗时、输入输出 token、工具调用、结构化结果和人工质量评分。价格必须按目标区域的官方价格页及账户实际账单核对,因为不同模型、区域、上下文档位和缓存规则可能产生不同费用。

选定候选后按低风险内部任务、只读业务、少量生产流量逐步扩大,并给每阶段设置错误率、质量、费用和延迟阈值。遇到工具越权、结构化结果破坏、费用超阈值、配额不足或结果不可解释时立即停手;截止日前可回到仍可用的旧模型,截止后只能切到另一款已验证模型或暂停队列。

失败排查:模型、区域、认证、配额和网络逐层分开

404 或 model unavailable 先核对 model ID、下架日期和区域可用性;401/403 核对 Workspace、Key owner、权限和账户状态;429 核对该区域的配额、并发和 rate limit;400 核对协议与参数;200 但输出变化则回到固定样本、实际 model 和工具 schema 对比。不要用无限重试掩盖模型下架或有副作用请求的未知状态。

只有 DNS 解析失败、TLS 握手错误、代理 407、连接超时,或同一账号、区域和 endpoint 在不同合规出口稳定分叉时,才参考<a href="/resources/proxy-connection-troubleshooting-checklist">代理连接系统排查清单</a>。固定出口可以帮助复现链路,但不能恢复已下架模型、授予权限、改变配额或让跨区域 Key 生效。

完成标准与停手条件:截止日前消除隐式依赖

迁移完成至少要求:九个旧 ID 已归零或有明确停用记录;每条生产路径绑定正确区域、Workspace 和 Key;目标模型通过功能、质量、费用、配额与失败处理验收;监控记录实际 model;回退或暂停队列经过演练;所有临时权限和测试数据已收回。

在切换前、截止前一周和 10 月 9 日再次核对 DeepSeek 文档、模型列表、区域与价格页。若官方仍未给出 10 月 10 日的精确时刻,应按最保守边界提前完成,不自行编造 00:00;若候选模型在目标区域不可用、账户价格不可读或关键任务无可接受替代,停止扩流并由业务 owner 决定降级或暂停。

资料来源

常见问题

阿里云 Model Studio 哪些 DeepSeek 模型会下架?

官方列出 deepseek-v3、v3.1、v3.2、v3.2-exp、r1、r1-0528,以及 deepseek-r1-distill-qwen-7b、14b、32b,共九个 model ID。

DeepSeek 模型在 10 月 10 日几点下架?

官方页面只写 2026 年 10 月 10 日,没有给出时刻或时区。应把精确执行时间记为 UNKNOWN,并在截止日前完成迁移。

官方推荐迁移到哪些模型?

官方建议 qwen3.7-plus、qwen3.7-max 和 qwen3.6-flash,但没有承诺一一映射或行为等价,必须按实际任务测试。

只替换 model 参数就够了吗?

不够。还要核对区域 endpoint、Workspace、API Key、协议、thinking 参数、工具调用、输出质量、配额、价格、监控和失败处理。

截止后还能回退到旧 DeepSeek ID 吗?

不能把旧 ID 当作可靠回退。截止后应切到另一款已验证且仍可用的模型,或暂停相关队列并人工处理。

更换固定 IP 可以继续调用下架模型吗?

不能。模型下架是平台供应规则;固定出口只在 DNS、TLS、407、超时或稳定区域链路差异有证据时用于排查。