# DeepSeek: deepseek-v4-flash-260425

- 模型 ID: `deepseek-v4-flash-260425`
- 供应商: DeepSeek
- 网页版本: https://www.moleapi.com/zh-CN/models/deepseek/deepseek-v4-flash
- 内容状态: alias

## 模型简介

DeepSeek V4-Flash 是 V4 系列的快速经济型开放权重模型，支持 1M 上下文、思考与非思考模式，以及 OpenAI 和 Anthropic 兼容接口。

## 模型能力

- OpenAI 兼容
- Responses API
- Anthropic 兼容
- Gemini 兼容
- 提示词缓存
- 推理

### 已核验规格

- 官方定位: 快速、高效、经济型 V4 模型
- 上下文窗口: 1,000,000 tokens
- 最大输出: 384,000 tokens
- 模型规模: 284B 总参数 / 13B 激活参数

## 模型价格和接入方式

价格由 MoleAPI 控制台接口动态提供。

### 标准 (default, x1)

- 输入: $0.22 / 1M tokens
- 输出: $0.67 / 1M tokens
- 缓存读取: $0.0075 / 1M tokens
- 缓存写入: $0.275 / 1M tokens

### 特价 (discount, x0.8)

- 输入: $0.176 / 1M tokens
- 输出: $0.536 / 1M tokens
- 缓存读取: $0.006 / 1M tokens
- 缓存写入: $0.22 / 1M tokens

### 转接 (relay, x0.3)

- 输入: $0.066 / 1M tokens
- 输出: $0.201 / 1M tokens
- 缓存读取: $0.0023 / 1M tokens
- 缓存写入: $0.0825 / 1M tokens

### 接入协议

| Protocol | Method | Endpoint |
| --- | --- | --- |
| openai | POST | /v1/chat/completions |
| openai-response | POST | /v1/responses |
| anthropic | POST | /v1/messages |
| gemini | POST | /v1beta/models/{model}:generateContent |

- 实时价格来源: https://home.moleapi.com/api/pricing

## deepseek-v4-flash-260425 模型介绍

DeepSeek V4-Flash 是 V4 系列的快速经济型开放权重模型，支持 1M 上下文、思考与非思考模式，以及 OpenAI 和 Anthropic 兼容接口。

### 适合场景

高并发代码、代理子任务、长文档处理和成本敏感的推理工作负载。

### 核心优势

- 独立测评中的输出速度明显高于 V4-Pro，同时保持较强开放权重能力。
- 1M 上下文、最高 384K 输出，适合长输入和长结果。
- 284B 总参数、13B 激活参数，官方 API 价格较低。

### 使用限制

- 综合能力低于 V4-Pro，更适合吞吐优先而非追求系列最高质量。
- 最大推理档位可能非常冗长，实际成本仍取决于输出 token 数。

### 选型与上线评估

选择 deepseek-v4-flash-260425 时，先把官方定位映射到真实任务：高并发代码、代理子任务、长文档处理和成本敏感的推理工作负载。 第一轮评测应同时覆盖它的主要优势“独立测评中的输出速度明显高于 V4-Pro，同时保持较强开放权重能力。”和已知限制“综合能力低于 V4-Pro，更适合吞吐优先而非追求系列最高质量。”，而不是只比较一次通用问答的主观观感。

接入层面，MoleAPI 当前为这款 DeepSeek 模型列出 openai, openai-response, anthropic, gemini 协议和 标准, 特价, 转接 计费分组；默认价格摘要为 输入 $0.22 / 1M tokens · 输出 $0.67 / 1M tokens。价格、协议与可用分组来自实时目录，正式上线前仍应按自己的上下文长度、输出规模和缓存命中率计算代表性请求成本。

目前没有展示与该精确模型 ID 和推理档位完全匹配的独立排名，因此不使用相近型号推断分数。上线前应固定模型 ID、提示词和样本集，记录正确率、结构化输出合格率、工具调用成功率与超时率，再与候选模型做同条件比较。

本页模型资料最近核验于 2026-07-23。当上游模型卡、上下文限制或工具支持发生变化时，应先更新来源与双语事实，再调整推荐结论；MoleAPI 的实时价格变化则由目录自动同步，不与静态能力描述混在一起。

### 资料来源

- [DeepSeek 模型与价格文档](https://api-docs.deepseek.com/quick_start/pricing/) — DeepSeek
- 最近核验: 2026-07-23

## 代码示例

### cURL

```bash
curl https://api.moleapi.com/v1/responses \
  -H "Authorization: Bearer $MOLEAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash-260425","input":"Explain this problem step by step."}'
```

### Python

```python
from openai import OpenAI

client = OpenAI(base_url="https://api.moleapi.com/v1", api_key="YOUR_MOLEAPI_API_KEY")
response = client.responses.create(model="deepseek-v4-flash-260425", input="Explain this problem step by step.")
print(response.output_text)
```

### TypeScript

```typescript
import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.moleapi.com/v1", apiKey: process.env.MOLEAPI_API_KEY });
const response = await client.responses.create({ model: "deepseek-v4-flash-260425", input: "Explain this problem step by step." });
console.log(response.output_text);
```

## 更多相关模型

- [deepseek-v4-flash](https://www.moleapi.com/zh-CN/models/deepseek/deepseek-v4-flash) — DeepSeek
- [deepseek-v4-pro](https://www.moleapi.com/zh-CN/models/deepseek/deepseek-v4-pro) — DeepSeek
- [deepseek-v4-flash-vision-exp](https://www.moleapi.com/zh-CN/models/deepseek/deepseek-v4-flash-vision-exp) — DeepSeek
- [gpt-5.6-luna](https://www.moleapi.com/zh-CN/models/openai/gpt-5.6-luna) — OpenAI
- [gpt-5.6-sol](https://www.moleapi.com/zh-CN/models/openai/gpt-5.6-sol) — OpenAI
- [gpt-5.6-terra](https://www.moleapi.com/zh-CN/models/openai/gpt-5.6-terra) — OpenAI

## 常见问题

### deepseek-v4-flash-260425 怎么计费？

本页价格从 MoleAPI 控制台接口动态读取，并随模型价格、上下文档位和账户分组更新。

### deepseek-v4-flash-260425 支持哪些接入方式？

当前目录列出的协议是 openai、openai-response、anthropic、gemini。

### 如何在现有项目中切换到 deepseek-v4-flash-260425？

保留 MoleAPI 的 API 地址和密钥，替换 model 参数，再检查所用协议的参数差异。

### deepseek-v4-flash-260425 的资料来自哪里？

模型能力与限制根据 DeepSeek 等列明页面核验；价格与协议来自 MoleAPI 控制台。
