model
DeepSeek
直接答案当前官方 ID 是 deepseek-v4-flash 和 deepseek-v4-pro,两者默认启用思考并可关闭;本站仅保证模型列表和协议页明确启用的名称与路径。
更新 · 审核信息
当前家族
截至本页审核日,DeepSeek 官方 API 的当前模型 ID 是 deepseek-v4-flash 和 deepseek-v4-pro。官方页面列出的上下文为 1M、最大输出为 384K,并支持 JSON 与工具调用;这些数值、价格和并发会更新,生产配置应以实时官方页为准,而不是长期复制静态表格。
思考不是另一个固定家族
两个 V4 模型均默认启用思考。官方直连可用 thinking.type=enabled|disabled 切换,并使用 reasoning_effort 调整强度。不要继续把“chat 必然普通、reasoner 必然推理”当作当前规则;本站若显示带模式后缀的名称,那是网关便利别名或渠道映射,不是新的官方 ID。
直连与本站模型名
直连使用 https://api.deepseek.com、DeepSeek API Key 和官方模型 ID。本站使用本站 Base URL、本站 Bearer 令牌与本站模型列表中的启用名称;即使官方 ID 存在,本站渠道未启用或未映射时也不能调用。本站当前模型页只声明 /v1/chat/completions,不要把官方 Responses、Anthropic 兼容或 beta 路径当作本站入口。
流式、JSON 与工具
官方 Chat 流采用 SSE,以 [DONE] 结束;需要汇总用量时可使用支持的 stream_options.include_usage。JSON 模式必须在提示词中明确要求 JSON,否则可能持续输出空白。工具参数必须在应用端校验,并由应用自行执行;高风险操作应增加白名单、权限和人工确认。
选择与费用安全
先用同一批真实样本比较 Flash 与 Pro 的正确率、延迟、输出 token 和工具成功率。简单任务可评估关闭思考,复杂数学、代码和多约束任务再启用。设置最大输出、超时、并发、余额告警和有限重试;401、402、429、500/503 要分类处理,不要无条件重放请求。
可复现性
保留完整请求、返回 model、usage、request ID 和日期,并固定回归样本。官方可能调整模型实现、价格和并发;强审计业务应在每次升级前重新验证工具、JSON、上下文和输出边界。
适用场景
- 深度推理
- 代码任务
- 长上下文
API 协议
/v1/chat/completions
FAQ
当前 DeepSeek 官方模型名是什么?
截至本页审核日,官方 ID 是 deepseek-v4-flash 和 deepseek-v4-pro。两者都是 1M 上下文、最大输出 384K,并支持思考开关;这些限制和价格会变化,上线前仍要复核官方定价页。
普通生成和推理是否还要选择两个不同模型?
当前 V4 模型默认启用思考,官方直连使用 thinking.type=disabled 可关闭,并可通过 reasoning_effort 调整强度。若本站模型列表出现带后缀的便利别名,它属于网关映射,不是新的官方模型 ID。
为什么官方模型可用,但本站请求提示 model 不存在?
厂商模型目录与本站模型列表不是同一份清单。直连填官方 ID 和官方 Key;本站必须填管理员已启用的本站名称并使用本站令牌,必要时由渠道映射到官方模型。
怎样控制思考模式的延迟和费用?
简单抽取或分类可先评估关闭思考,复杂推理再启用;始终设置最大输出、超时、并发和余额告警。流式以 [DONE] 结束,并可在官方支持时请求 stream_options.include_usage 记录实际消耗。
关联指南
官方来源
- DeepSeek Models and Pricing Official
- DeepSeek Chat Completions API Official
- DeepSeek Error Codes Official
兔子API