PuppyIP 资源中心
AI 工具动态 5 分钟 发布于 2026-10-07

Mistral Large 4 能试了:API 公测、当前费用与开权重计划

Mistral Large 4 现在可以通过 API 公测。对想做图文分析或 Agent 的开发者,先试自己的任务最有用;准备自部署的人,则还要等月底的权重发布计划兑现。

Mistral Large 4 Mistral API 多模态 Agent 模型费用

服务对象与地域限制

PuppyIP 仅面向海外合规企业及其授权人员提供服务,不面向中国大陆地区开放或提供代理服务。本服务仅限用于中国大陆境外的合法业务活动,严禁在中国大陆境内使用本服务。

代理 IP 或服务器位于境外,不改变上述限制。不得通过中转、转接、共享或转售向中国大陆境内的最终使用者提供本服务。使用前请阅读用户服务协议。

本文要点

  • 官方模型 ID 为 mistral-large-4,状态是 Public Preview;公测可访问与权重已开放是两回事。
  • 当前 Standard 优惠价按每百万 token 计:输入 0.68 美元、缓存输入 0.07 美元、输出 2.09 美元;优惠结束日尚未注明。
  • 模型页列出 1M 上下文、结构化输出、函数调用及 Agent 接口支持,实际任务仍需控制输入长度与工具权限。
  • 已有应用可先单独接入新模型,比较自己的图文、代码或工具调用样本,再决定是否切换。

API 现在能试,权重还要等什么?

Mistral 于 2026 年 10 月 6 日宣布 Large 4 公开预览,并给出 Mistral Studio 的 API 体验入口。对开发者来说,眼下可以开始评估模型,没必要等权重发布才了解它是否适合自己的应用。

但这次不是已经交付可下载权重的公告。官方承诺在本月底发布权重,并继续补充架构与训练说明;截至 10 月 7 日核对,最终下载入口、许可证和自部署细节不能从这项计划直接推定。

公开预览目前由 Mistral 自有的欧洲基础设施提供。公告中提到的更多全球部署地区属于后续安排,不能据此认定所有地区、账号或企业部署选项已经开放。

要接 API,先用对模型 ID

从官方公告进入 Mistral Studio,再查看当前账号的模型访问、计费和额度状态。公告确认有公开预览入口,但没有承诺所有账号都获得免费调用额度;能登录控制台也不等于已经具备无限调用资格。

接入时,模型页给出的 ID 是 mistral-large-4。普通聊天接口是 POST https://api.mistral.ai/v1/chat/completions;请求的 model 选择这个 ID,messages 放入对话,API 密钥通过鉴权头传递。完整请求示例见文末官方 API 文档。

如果你已经接过 Mistral,先单独增加 Large 4 配置,保留原模型作为回退。通用文档里的 mistral-large-latest 示例不能自动当作 Large 4 的固定版本证明,复制示例时应核对实际选择的模型。

当前优惠价怎么读,预算怎么算?

截至 10 月 7 日,官方定价页的 Standard 档标注 Sale price:每百万 token,输入 0.68 美元、缓存输入 0.07 美元、输出 2.09 美元。token 是模型计量文本的单位,不等同于一个中文字或一页文档。

公告中的价格卡仍显示输入 1.36 美元、输出 4.18 美元,定价页则把它们列为原价并展示优惠价。因此,当前预算应注明采用的是定价页优惠口径,不能把原价与优惠价混在同一笔计算中。

输入与输出需要分别计量,只有符合缓存条件的输入才按缓存价格计算。长对话反复带入历史内容、让 Agent 多轮调用工具,都可能增加用量;比较模型时应看完成同一任务的总成本。

页面提供 Standard、Batch 与 Priority 等档位,本文的数字只对应当前 Standard 展示。优惠结束时间尚未注明,长期预算应保留价格变化空间,实际账单以所用档位与账号显示为准。

图文与 Agent 应用,这次值得试在哪里?

Large 4 是多模态模型,可以把图像理解与文本任务结合起来。官方将代码、复杂文档和 Agent 工作流作为重点;模型页同时列出结构化输出、函数调用、文档问答,以及 Agents 和 Conversations 接口支持。

结构化输出是按约定字段返回答案,函数调用则是让模型提出调用工具的请求。它们能帮助应用衔接后续流程,但不会替你决定某个工具是否应该拥有写入、发送消息或付款权限。

一个假设场景:卖家希望从商品说明与包装图片里整理规格。先用不含客户信息的样例,检查提取字段、图片细节与缺失项提示;只有文字结果符合要求,再考虑把它接到自己的商品资料流程。这个例子不是实测结果。

模型页标注 1M 上下文,意味着可容纳较长的输入范围,不代表任何长度的文档都能完整理解,也不代表调用免费。先挑与任务有关的材料,比一次塞入所有文件更容易判断答案质量与费用。

从旧模型切过来,先看三种结果

第一种是答案质量:用你真正关心的短样本比较新旧模型,尤其看中文指令、表格字段、图片细节和引用依据。官方基准成绩可以帮助了解定位,不能代替你的业务样本,也不能证明每项任务都会提升。

第二种是程序能否接住结果:检查返回文本、结构化字段、工具调用和流式事件的处理。接口文档说明,content 可能是文本,也可能包含不同类型的内容块;应用只按纯字符串处理时,需要留意这类差异。

第三种是一次任务的时间和成本:记录输入、输出以及重复调用次数,再决定是否扩大使用。预览阶段适合独立配置、保留旧路径;如果遇到访问或额度提示,应查看控制台与官方说明,而不是靠更换网络推定计费或资格问题已经解决。

准备自部署的人,现在可以做什么?

现在可以先把应用依赖的输入、输出和工具接口梳理清楚,借 API 预览判断模型是否值得继续跟进。把评估结论与部署计划分开,会更容易在权重真正发布时决定下一步。

等官方提供权重、许可证和部署说明后,再确认硬件、推理框架、商业使用条件与数据处理要求。公告里的月底计划仍需后续发布来兑现,当前不应据此购买硬件,或承诺某台普通 VPS 已能运行完整模型。

资料来源

常见问题

Le Chat 里能不能直接选 Large 4?

这次公告明确的是 Mistral Studio 的 API 公开预览。已核对的公告和模型页没有给出 Le Chat 各套餐的完整开放范围,不能把 API 发布等同于所有聊天账号已经可选。

能直接把 OpenAI 的 API Key 用在 Mistral 接口上吗?

不能。即使接口采用熟悉的聊天请求形式,Mistral 的服务地址、模型 ID 与鉴权仍属于 Mistral;应使用对应服务的有效密钥,并按官方接口文档配置。

模型返回了 JSON,就能直接写入业务系统吗?

格式符合约定只说明程序更容易解析,不证明字段内容一定正确。涉及商品资料、订单或其他业务写入时,还应检查必填项、允许值与来源,并按原有权限处理。