provider
Mistral AI
直接答案直连 Mistral 首调使用 Mistral Base URL、Authorization: Bearer 和精确模型 ID;本站只保留已适配的 /v1/chat/completions,必须改用本站 Base URL 与密钥。Batch、Guardrails 和 Moderation 是 Mistral 官方能力,不代表本站入口自动支持或自动开启。
更新 · 审核信息
先分清厂商 API、本站兼容入口与开放权重
Mistral AI 既是模型厂商,也是托管 API 平台,并发布部分可自行部署的开放权重。三种方式不能混为一谈:官方直连由 Mistral 管理账号、配额和数据条款;本站用本站凭证转发到已配置渠道;自部署团队则负责硬件、推理服务、安全和权重许可证。
Bearer 首调与模型 ID
官方直连先在 Studio 创建工作区 API Key,再向 https://api.mistral.ai/v1/chat/completions 发送 JSON,并设置 Authorization: Bearer <MISTRAL_API_KEY>。首调只发送一个短问题并固定精确模型 ID,便于区分认证、模型权限和参数错误。本站虽然提供同名 /v1/chat/completions,但 Base URL、密钥和可用模型以本站模型广场为准。
Batch 是官方异步作业
Mistral Batch 适合大量离线请求:可提交内联 requests,或上传每行含唯一 custom_id 与 body 的 JSONL 文件;大文件批次最多可达一百万个请求,少于一万个请求可使用内联方式。创建后按 job ID 查看 QUEUED、RUNNING、SUCCESS、FAILED 等状态,并在成功后读取输出。本站未在本页列出 Batch 路径,不能直接照搬官方 Batch URL。
RPS、TPM 与 429
Mistral 的 Completion 限流按模型展示,至少包含每秒请求数 RPS 和每分钟 token 数 TPM。短请求并发过高会碰到 RPS,单次上下文很长或持续生成可能碰到 TPM;任一耗尽都可能出现 429。上线时读取组织实际 Limits,限制并发,遵循退避并避免无限重试。
Guardrails 与 Moderation 的职责不同
官方把 Custom Guardrails 作为推荐方式,可随 Chat Completions、Conversations 或 Agent 配置声明规则;独立 Moderation API 用安全模型对原始文本或对话分类,适合需要原始分数和自定义阈值的流程。应用仍应处理误判、漏判、申诉、日志与人工升级,不能把“用了大模型”当成已经完成安全治理。
开放权重不等于统一许可证
官方说明多数开放模型采用 Apache 2.0,但部分模型使用带条件的修改版 MIT,其中月收入超过 2,000 万美元的企业需要商业许可或改用 Mistral Studio。应以精确模型卡随附的许可证为准,并分别核验权重、代码、数据与托管服务条款;latest 别名也不适合做许可证或复现依据。
已核验厂商目录
按能力类型查看最新模型
这里展示厂商官方目录中的具体型号,不代表本站一定已开放;可调用 ID、端点和价格请以模型广场为准。
文本、推理与代码
-
mistral-medium-3-5稳定Mistral 当前中高档通用旗舰,面向复杂文本、代码与代理任务。
-
mistral-small-2603稳定Mistral Small 4 的生产型号,兼顾能力、速度和部署成本。
语音与音频
-
voxtral-mini-tts-2603稳定Voxtral 最新文本转语音型号。
-
voxtral-mini-transcribe-realtime-2602稳定用于低延迟流式语音识别的实时转录型号。
向量、检索与重排
-
codestral-embed-2505稳定针对代码搜索和仓库级检索训练的向量模型。
-
mistral-embed-2312稳定Mistral 的通用文本向量模型。
适用场景
- 多模态智能体
- 代码和推理
- OCR、语音与安全
API 协议
/v1/chat/completions
FAQ
Mistral API 第一次调用返回 401,应该检查什么?
直连时确认请求发往 https://api.mistral.ai/v1/chat/completions,请求头为 Authorization: Bearer <MISTRAL_API_KEY>,并使用当前工作区可访问的精确模型 ID。通过本站时必须同时改为本站 Base URL 和本站密钥,不能混用两家的 Key。
Mistral Batch API 是同步返回结果吗?本站支持吗?
不是。官方 Batch 创建作业后进入 QUEUED、RUNNING 等状态,需要按 job ID 查询,成功后再读取输出;请求可内联或用带 custom_id 与 body 的 JSONL 文件提交。本站当前 api_paths 未列出 Batch,因此不能把官方 /v1/batch/jobs 当作本站入口。
Mistral 的 RPS 和 TPM 有什么区别,为什么仍会收到 429?
RPS 限制每秒请求数,TPM 限制模型每分钟 token 吞吐;任一维度达到当前组织和模型的上限都可能返回 429。实际额度应以 Admin Panel 的 API Limits 为准,不要把别人的套餐数字写死在程序里。
Mistral Guardrails 和 Moderation API 是一回事吗?
不是。官方推荐可在聊天、Conversations 或 Agent 请求中声明 Custom Guardrails;独立 Moderation API 则返回安全类别的分类结果或分数,适合应用自行设阈值和流程。两者都不等于本站默认替你完成输入输出审核。
Mistral 开放权重模型都可以无条件商用吗?
不能一概而论。官方说明多数开放模型使用 Apache 2.0,但部分采用带收入门槛条件的修改版 MIT;必须查看精确模型卡和许可证。购买托管 API 调用权也不自动授予下载、修改或再分发权重的权利。
关联指南
官方来源
- Mistral Studio 激活与 API Key 首调 Official
- Mistral Batch Processing Official
- Mistral Usage and Limits Official
- Mistral Moderation 与 Guardrailing Official
- Mistral Model Selection Guide Official
- Mistral 开放模型许可证说明 Official
- Mistral API Reference Official
兔子API