DeepSeek

deepseek-v4-pro

模型 IDdeepseek-v4-pro

接入文档Markdown

模型简介

DeepSeek V4-Pro 是 DeepSeek V4 系列中的 Pro 模型。官方更新说明确认该模型可通过 OpenAI Chat Completions 和 Anthropic 接口调用。

模型能力

规格来自已列明的模型资料;目录标签用于快速判断接入能力,精确限制以来源文档为准。

OpenAI 兼容Responses APIAnthropic 兼容Gemini 兼容提示词缓存推理

已核验规格

官方模型参数
deepseek-v4-pro
已验证接口
OpenAI Chat Completions、Anthropic
官方公告日期
2026-04-24

资料来源: DeepSeek 模型与价格文档

独立能力评测

仅展示与精确模型 ID 和推理档位相符的公开测评,不用相近型号替代。

智能指数

43

同类排名 #5 / 97

输出速度

67.8 tok/s

同类排名 #23 / 97

首字延迟

1.64s

推理,高投入

在大型开放权重模型同级中排名靠前,首字延迟低,能力与成本平衡突出。

测评档位: 推理,高投入. Artificial Analysis · 评测方法

模型价格和接入方式

价格直接读取 MoleAPI 控制台目录,并按当前计费分组与上下文档位展示。

实际结算价格以控制台中的账户分组为准。
实时价格来源

价格表

USD / 1M tokens
标准x1default输入 $0.67 · 输出 $1.34

输入

$0.67 / 1M tokens

输出

$1.34 / 1M tokens

缓存读取

$0.02 / 1M tokens

缓存写入

$0.83 / 1M tokens

特价x0.8discount输入 $0.536 · 输出 $1.072

输入

$0.536 / 1M tokens

输出

$1.072 / 1M tokens

缓存读取

$0.016 / 1M tokens

缓存写入

$0.664 / 1M tokens

转接x0.3relay输入 $0.201 · 输出 $0.402

输入

$0.201 / 1M tokens

输出

$0.402 / 1M tokens

缓存读取

$0.006 / 1M tokens

缓存写入

$0.249 / 1M tokens

临时(可用性随缘)x0.1temp输入 $0.067 · 输出 $0.134

输入

$0.067 / 1M tokens

输出

$0.134 / 1M tokens

缓存读取

$0.002 / 1M tokens

缓存写入

$0.083 / 1M tokens

接入协议

可用计费分组: 标准, 特价, 转接, 临时(可用性随缘)

openai
POST
/v1/chat/completions
openai-response
POST
/v1/responses
anthropic
POST
/v1/messages
gemini
POST
/v1beta/models/{model}:generateContent
openai-response-compact
POST
/v1/responses/compact
openai-alpha-search
POST
/v1/alpha/search

完整模型指南

基于厂商资料整理,并经过独立审稿。 · 2026-07-28

DeepSeek V4-Pro 是 DeepSeek V4 系列的 Pro 模型,支持思考与非思考模式,默认使用思考模式,并提供面向长上下文处理、结构化输出和工具调用的 API 能力。[7] DeepSeek 将 V4 Preview 描述为具备更强 Agent 能力和高阶推理能力的模型系列。[5]

模型定位与核心能力

DeepSeek V4-Pro 面向复杂推理、工具驱动任务与长链路智能体工作流,支持思考与非思考两种生成模式。[7] 其能力组合覆盖 JSON 输出、工具调用、对话前缀续写和代码 FIM 补全。[7]

思考模式适用于需要展开推理过程的任务;非思考模式可用于不需要该模式的常规文本和代码生成任务。[7] 模型支持 JSON Output,可生成结构化结果;Tool Calls 可用于由模型发起工具调用的工作流。[7]

能力与规格

DeepSeek V4-Pro 提供 100 万 Token 上下文窗口与最高 38.4 万 Token 输出长度,覆盖超长输入、长文档综合和大规模代码上下文处理。[7]

规格信息
上下文窗口1M Token [7]
最大输出384K Token [7]
推理模式支持思考与非思考模式;默认思考模式 [7]
结构化输出JSON Output [7]
工具能力Tool Calls [7]
前缀续写Chat Prefix Completion(Beta)[7]
代码补全FIM Completion(Beta)[7]
并发限制500 [7]

对话前缀续写支持在既有内容后继续生成,FIM 补全支持在代码中间位置生成或补齐内容。[7]

使用场景

DeepSeek V4-Pro 的长上下文与长输出规格可用于长文档综合、多文件代码库分析、复杂报告生成和长链路任务编排。[7] 工具调用与 JSON 输出能力可用于结构化信息抽取、函数调用编排和 Agent 工作流。[7]

在代码相关任务中,Chat Prefix Completion 可用于基于已给定前缀继续生成内容;FIM Completion 则覆盖代码中间补全等场景。[7] 思考模式和非思考模式使同一模型可覆盖需要推理展开的任务与常规生成任务。[7]

重要限制

FIM Completion 仅适用于非思考模式,不能与思考模式同时使用。[7] Chat Prefix Completion 与 FIM Completion 均处于 Beta 状态。[7]

DeepSeek V4-Pro 的官方并发限制为 500,超出该限制的请求受平台限流规则约束。[7]

来源

[5] DeepSeek
[7] 模型 & 价格 | DeepSeek API Docs

代码示例

示例使用 MoleAPI 的 Responses API 地址;替换 API Key 后即可运行。

curl https://api.moleapi.com/v1/responses \
  -H "Authorization: Bearer $MOLEAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "input": "Explain this problem step by step."
  }'

常见问题

deepseek-v4-pro 怎么计费?

本页价格从 MoleAPI 控制台接口动态读取,并随模型价格、上下文档位和账户分组更新。

deepseek-v4-pro 支持哪些接入方式?

本页协议和接口来自 MoleAPI 模型目录的 supported_endpoint_types 字段。

如何在现有项目中切换到 deepseek-v4-pro?

保留 MoleAPI 的 API 地址和密钥,把请求中的 model 参数替换为本页模型 ID;再按照对应协议检查参数差异。

deepseek-v4-pro 的模型资料来自哪里?

模型能力与限制已根据 DeepSeek 等页面核验;价格和可用协议只采用 MoleAPI 控制台数据。