model

DeepSeek

直接答案当前官方 ID 是 deepseek-v4-flash 和 deepseek-v4-pro,两者默认启用思考并可关闭;本站仅保证模型列表和协议页明确启用的名称与路径。

更新 · 审核信息

当前家族

截至本页审核日,DeepSeek 官方 API 的当前模型 ID 是 deepseek-v4-flashdeepseek-v4-pro。官方页面列出的上下文为 1M、最大输出为 384K,并支持 JSON 与工具调用;这些数值、价格和并发会更新,生产配置应以实时官方页为准,而不是长期复制静态表格。

思考不是另一个固定家族

两个 V4 模型均默认启用思考。官方直连可用 thinking.type=enabled|disabled 切换,并使用 reasoning_effort 调整强度。不要继续把“chat 必然普通、reasoner 必然推理”当作当前规则;本站若显示带模式后缀的名称,那是网关便利别名或渠道映射,不是新的官方 ID。

直连与本站模型名

直连使用 https://api.deepseek.com、DeepSeek API Key 和官方模型 ID。本站使用本站 Base URL、本站 Bearer 令牌与本站模型列表中的启用名称;即使官方 ID 存在,本站渠道未启用或未映射时也不能调用。本站当前模型页只声明 /v1/chat/completions,不要把官方 Responses、Anthropic 兼容或 beta 路径当作本站入口。

流式、JSON 与工具

官方 Chat 流采用 SSE,以 [DONE] 结束;需要汇总用量时可使用支持的 stream_options.include_usage。JSON 模式必须在提示词中明确要求 JSON,否则可能持续输出空白。工具参数必须在应用端校验,并由应用自行执行;高风险操作应增加白名单、权限和人工确认。

选择与费用安全

先用同一批真实样本比较 Flash 与 Pro 的正确率、延迟、输出 token 和工具成功率。简单任务可评估关闭思考,复杂数学、代码和多约束任务再启用。设置最大输出、超时、并发、余额告警和有限重试;401、402、429、500/503 要分类处理,不要无条件重放请求。

可复现性

保留完整请求、返回 model、usage、request ID 和日期,并固定回归样本。官方可能调整模型实现、价格和并发;强审计业务应在每次升级前重新验证工具、JSON、上下文和输出边界。

适用场景

  • 深度推理
  • 代码任务
  • 长上下文

API 协议

  • /v1/chat/completions

FAQ

当前 DeepSeek 官方模型名是什么?

截至本页审核日,官方 ID 是 deepseek-v4-flashdeepseek-v4-pro。两者都是 1M 上下文、最大输出 384K,并支持思考开关;这些限制和价格会变化,上线前仍要复核官方定价页。

普通生成和推理是否还要选择两个不同模型?

当前 V4 模型默认启用思考,官方直连使用 thinking.type=disabled 可关闭,并可通过 reasoning_effort 调整强度。若本站模型列表出现带后缀的便利别名,它属于网关映射,不是新的官方模型 ID。

为什么官方模型可用,但本站请求提示 model 不存在?

厂商模型目录与本站模型列表不是同一份清单。直连填官方 ID 和官方 Key;本站必须填管理员已启用的本站名称并使用本站令牌,必要时由渠道映射到官方模型。

怎样控制思考模式的延迟和费用?

简单抽取或分类可先评估关闭思考,复杂推理再启用;始终设置最大输出、超时、并发和余额告警。流式以 [DONE] 结束,并可在官方支持时请求 stream_options.include_usage 记录实际消耗。

官方来源

  1. DeepSeek Models and Pricing Official
  2. DeepSeek Chat Completions API Official
  3. DeepSeek Error Codes Official