# DeepSeek: deepseek-v4-pro

- 模型 ID: `deepseek-v4-pro`
- 供应商: DeepSeek
- 网页版本: https://www.moleapi.com/zh-CN/models/deepseek/deepseek-v4-pro
- 内容状态: verified

## 模型简介

DeepSeek V4-Pro 是 DeepSeek V4 系列中的 Pro 模型。官方更新说明确认该模型可通过 OpenAI Chat Completions 和 Anthropic 接口调用。

## 模型能力

- OpenAI 兼容
- Responses API
- Anthropic 兼容
- Gemini 兼容
- 提示词缓存
- 推理

### 已核验规格

- 官方模型参数: deepseek-v4-pro
- 已验证接口: OpenAI Chat Completions、Anthropic
- 官方公告日期: 2026-04-24

### 独立能力评测

- 推理，高投入
- Intelligence: 43 (#5/97)
- Output speed: 67.8 tok/s (#23/97)
- Time to first token: 1.64s
- Source: https://artificialanalysis.ai/models/deepseek-v4-pro-high

在大型开放权重模型同级中排名靠前，首字延迟低，能力与成本平衡突出。

## 模型价格和接入方式

价格由 MoleAPI 控制台接口动态提供。

### 标准 (default, x1)

- 输入: $0.67 / 1M tokens
- 输出: $1.34 / 1M tokens
- 缓存读取: $0.02 / 1M tokens
- 缓存写入: $0.83 / 1M tokens

### 特价 (discount, x0.8)

- 输入: $0.536 / 1M tokens
- 输出: $1.072 / 1M tokens
- 缓存读取: $0.016 / 1M tokens
- 缓存写入: $0.664 / 1M tokens

### 转接 (relay, x0.3)

- 输入: $0.201 / 1M tokens
- 输出: $0.402 / 1M tokens
- 缓存读取: $0.006 / 1M tokens
- 缓存写入: $0.249 / 1M tokens

### 临时（可用性随缘） (temp, x0.1)

- 输入: $0.067 / 1M tokens
- 输出: $0.134 / 1M tokens
- 缓存读取: $0.002 / 1M tokens
- 缓存写入: $0.083 / 1M tokens

### 接入协议

| Protocol | Method | Endpoint |
| --- | --- | --- |
| openai | POST | /v1/chat/completions |
| openai-response | POST | /v1/responses |
| anthropic | POST | /v1/messages |
| gemini | POST | /v1beta/models/{model}:generateContent |
| openai-response-compact | POST | /v1/responses/compact |
| openai-alpha-search | POST | /v1/alpha/search |

- 实时价格来源: https://home.moleapi.com/api/pricing

## deepseek-v4-pro 模型介绍

DeepSeek V4-Pro 是 DeepSeek V4 系列的 Pro 模型，支持思考与非思考模式，默认使用思考模式，并提供面向长上下文处理、结构化输出和工具调用的 API 能力。[7] DeepSeek 将 V4 Preview 描述为具备更强 Agent 能力和高阶推理能力的模型系列。[5]

## 模型定位与核心能力

DeepSeek V4-Pro 面向复杂推理、工具驱动任务与长链路智能体工作流，支持思考与非思考两种生成模式。[7] 其能力组合覆盖 JSON 输出、工具调用、对话前缀续写和代码 FIM 补全。[7]

思考模式适用于需要展开推理过程的任务；非思考模式可用于不需要该模式的常规文本和代码生成任务。[7] 模型支持 JSON Output，可生成结构化结果；Tool Calls 可用于由模型发起工具调用的工作流。[7]

## 能力与规格

DeepSeek V4-Pro 提供 100 万 Token 上下文窗口与最高 38.4 万 Token 输出长度，覆盖超长输入、长文档综合和大规模代码上下文处理。[7]

| 规格 | 信息 |
| --- | --- |
| 上下文窗口 | 1M Token [7] |
| 最大输出 | 384K Token [7] |
| 推理模式 | 支持思考与非思考模式；默认思考模式 [7] |
| 结构化输出 | JSON Output [7] |
| 工具能力 | Tool Calls [7] |
| 前缀续写 | Chat Prefix Completion（Beta）[7] |
| 代码补全 | FIM Completion（Beta）[7] |
| 并发限制 | 500 [7] |

对话前缀续写支持在既有内容后继续生成，FIM 补全支持在代码中间位置生成或补齐内容。[7]

## 使用场景

DeepSeek V4-Pro 的长上下文与长输出规格可用于长文档综合、多文件代码库分析、复杂报告生成和长链路任务编排。[7] 工具调用与 JSON 输出能力可用于结构化信息抽取、函数调用编排和 Agent 工作流。[7]

在代码相关任务中，Chat Prefix Completion 可用于基于已给定前缀继续生成内容；FIM Completion 则覆盖代码中间补全等场景。[7] 思考模式和非思考模式使同一模型可覆盖需要推理展开的任务与常规生成任务。[7]

## 重要限制

FIM Completion 仅适用于非思考模式，不能与思考模式同时使用。[7] Chat Prefix Completion 与 FIM Completion 均处于 Beta 状态。[7]

DeepSeek V4-Pro 的官方并发限制为 500，超出该限制的请求受平台限流规则约束。[7]

## 来源

[5] [DeepSeek](https://deepseek.com/en/index.html)  
[7] [模型 & 价格 | DeepSeek API Docs](https://api-docs.deepseek.com/zh-cn/quick_start/pricing)


## 代码示例

### cURL

```bash
curl https://api.moleapi.com/v1/responses \
  -H "Authorization: Bearer $MOLEAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-pro","input":"Explain this problem step by step."}'
```

### Python

```python
from openai import OpenAI

client = OpenAI(base_url="https://api.moleapi.com/v1", api_key="YOUR_MOLEAPI_API_KEY")
response = client.responses.create(model="deepseek-v4-pro", input="Explain this problem step by step.")
print(response.output_text)
```

### TypeScript

```typescript
import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.moleapi.com/v1", apiKey: process.env.MOLEAPI_API_KEY });
const response = await client.responses.create({ model: "deepseek-v4-pro", input: "Explain this problem step by step." });
console.log(response.output_text);
```

## 更多相关模型

- [deepseek-v4-flash](https://www.moleapi.com/zh-CN/models/deepseek/deepseek-v4-flash) — DeepSeek
- [deepseek-v4-flash-260425](https://www.moleapi.com/zh-CN/models/deepseek/deepseek-v4-flash-260425) — DeepSeek
- [deepseek-v4-flash-vision-exp](https://www.moleapi.com/zh-CN/models/deepseek/deepseek-v4-flash-vision-exp) — DeepSeek
- [gpt-5.6-luna](https://www.moleapi.com/zh-CN/models/openai/gpt-5.6-luna) — OpenAI
- [gpt-5.6-sol](https://www.moleapi.com/zh-CN/models/openai/gpt-5.6-sol) — OpenAI
- [gpt-5.6-terra](https://www.moleapi.com/zh-CN/models/openai/gpt-5.6-terra) — OpenAI

## 常见问题

### deepseek-v4-pro 怎么计费？

本页价格从 MoleAPI 控制台接口动态读取，并随模型价格、上下文档位和账户分组更新。

### deepseek-v4-pro 支持哪些接入方式？

当前目录列出的协议是 openai、openai-response、anthropic、gemini、openai-response-compact、openai-alpha-search。

### 如何在现有项目中切换到 deepseek-v4-pro？

保留 MoleAPI 的 API 地址和密钥，替换 model 参数，再检查所用协议的参数差异。

### deepseek-v4-pro 的资料来自哪里？

模型能力与限制根据 DeepSeek 等列明页面核验；价格与协议来自 MoleAPI 控制台。
