DeepSeek

deepseek-v4-flash-260425

模型 IDdeepseek-v4-flash-260425

接入文档Markdown

模型简介

DeepSeek V4-Flash 是 V4 系列的快速经济型开放权重模型,支持 1M 上下文、思考与非思考模式,以及 OpenAI 和 Anthropic 兼容接口。

模型能力

规格来自已列明的模型资料;目录标签用于快速判断接入能力,精确限制以来源文档为准。

OpenAI 兼容Responses APIAnthropic 兼容Gemini 兼容提示词缓存推理

已核验规格

官方定位
快速、高效、经济型 V4 模型
上下文窗口
1,000,000 tokens
最大输出
384,000 tokens
模型规模
284B 总参数 / 13B 激活参数

资料来源: DeepSeek 模型与价格文档

模型价格和接入方式

价格直接读取 MoleAPI 控制台目录,并按当前计费分组与上下文档位展示。

实际结算价格以控制台中的账户分组为准。
实时价格来源

价格表

USD / 1M tokens
标准x1default输入 $0.22 · 输出 $0.67

输入

$0.22 / 1M tokens

输出

$0.67 / 1M tokens

缓存读取

$0.0075 / 1M tokens

缓存写入

$0.275 / 1M tokens

特价x0.8discount输入 $0.176 · 输出 $0.536

输入

$0.176 / 1M tokens

输出

$0.536 / 1M tokens

缓存读取

$0.006 / 1M tokens

缓存写入

$0.22 / 1M tokens

转接x0.3relay输入 $0.066 · 输出 $0.201

输入

$0.066 / 1M tokens

输出

$0.201 / 1M tokens

缓存读取

$0.0023 / 1M tokens

缓存写入

$0.0825 / 1M tokens

接入协议

可用计费分组: 标准, 特价, 转接

openai
POST
/v1/chat/completions
openai-response
POST
/v1/responses
anthropic
POST
/v1/messages
gemini
POST
/v1beta/models/{model}:generateContent

deepseek-v4-flash-260425 模型介绍

以下介绍经过重新组织与本地化表达,并与所列模型资料交叉核验。

DeepSeek V4-Flash 是 V4 系列的快速经济型开放权重模型,支持 1M 上下文、思考与非思考模式,以及 OpenAI 和 Anthropic 兼容接口。

核心优势

  • 独立测评中的输出速度明显高于 V4-Pro,同时保持较强开放权重能力。
  • 1M 上下文、最高 384K 输出,适合长输入和长结果。
  • 284B 总参数、13B 激活参数,官方 API 价格较低。

使用限制

  • 综合能力低于 V4-Pro,更适合吞吐优先而非追求系列最高质量。
  • 最大推理档位可能非常冗长,实际成本仍取决于输出 token 数。

选型与上线评估

选择 deepseek-v4-flash-260425 时,先把官方定位映射到真实任务:高并发代码、代理子任务、长文档处理和成本敏感的推理工作负载。 第一轮评测应同时覆盖它的主要优势“独立测评中的输出速度明显高于 V4-Pro,同时保持较强开放权重能力。”和已知限制“综合能力低于 V4-Pro,更适合吞吐优先而非追求系列最高质量。”,而不是只比较一次通用问答的主观观感。

接入层面,MoleAPI 当前为这款 DeepSeek 模型列出 openai, openai-response, anthropic, gemini 协议和 标准, 特价, 转接 计费分组;默认价格摘要为 输入 $0.22 / 1M tokens · 输出 $0.67 / 1M tokens。价格、协议与可用分组来自实时目录,正式上线前仍应按自己的上下文长度、输出规模和缓存命中率计算代表性请求成本。

目前没有展示与该精确模型 ID 和推理档位完全匹配的独立排名,因此不使用相近型号推断分数。上线前应固定模型 ID、提示词和样本集,记录正确率、结构化输出合格率、工具调用成功率与超时率,再与候选模型做同条件比较。

本页模型资料最近核验于 2026-07-23。当上游模型卡、上下文限制或工具支持发生变化时,应先更新来源与双语事实,再调整推荐结论;MoleAPI 的实时价格变化则由目录自动同步,不与静态能力描述混在一起。

代码示例

示例使用 MoleAPI 的 Responses API 地址;替换 API Key 后即可运行。

curl https://api.moleapi.com/v1/responses \
  -H "Authorization: Bearer $MOLEAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash-260425",
    "input": "Explain this problem step by step."
  }'

常见问题

deepseek-v4-flash-260425 怎么计费?

本页价格从 MoleAPI 控制台接口动态读取,并随模型价格、上下文档位和账户分组更新。

deepseek-v4-flash-260425 支持哪些接入方式?

本页协议和接口来自 MoleAPI 模型目录的 supported_endpoint_types 字段。

如何在现有项目中切换到 deepseek-v4-flash-260425?

保留 MoleAPI 的 API 地址和密钥,把请求中的 model 参数替换为本页模型 ID;再按照对应协议检查参数差异。

deepseek-v4-flash-260425 的模型资料来自哪里?

模型能力与限制已根据 DeepSeek 等页面核验;价格和可用协议只采用 MoleAPI 控制台数据。