DeepSeek-V4分为deepseek-v4-flash和deepseek-v4-pro两个版本,TokCost以Pro版本为例百万tokens输入(缓存命中)价格是0.025元,缓存未命的输入价格是3元,百万tokens输出费用是6元,详细DeepSeek-V4版本收费标准及支持功能对照表如下:

DeepSeek-V4模型费用及区别对比(flash和pro)

DeepSeek-V4的Flash和Pro有什么区别?顾名思义,Pro是具有极致性能的旗舰款模型,Flash是具有高性价比、低延迟的经济款模型。

  • 1、Pro模型参数支持1.6万亿、激活参数490亿;Flash模型参数2840亿,激活参数仅130亿。
  • 2、Pro拥有顶级的世界知识储备和推理性能,Flash和Pro的推理能力差不多,但是世界知识储备要差很多。
  • 3、Agent任务方面,简单任务二者的表现是差不多,但是如果遇到复杂任务,则Pro更出色。
  • 4、推理成本与效率方面,在1M上下文下,Pro的推理FLOPs是V3.2的27%,KV Cache是其10%;而Flash则分别优化到了10%和7%。
  • 5、二者均为MoE架构,都支持100万token的超长上下文,并且均提供思考(thinking)和非思考(non-thinking) 两种模式。

flash和pro输入/输出费用价格表:

以下是以百万tokens为单位,输入分为缓存命中和未命中,以及不同版本的输出价格表:

DeepSeek-V4计费项 DeepSeek-V4-Flash DeepSeek-V4-Pro
百万tokens输入(缓存命中) 0.02元 0.025元
百万tokens输入(缓存未命中) 1元 3元
百万tokens输出 2元 6元

扣费规则:扣减费用 = token 消耗量 × 模型单价

另外,也可以在阿里云、腾讯云等云厂商通过API调用DeepSeek模型,阿里云百炼TokenPlan和腾讯云TokenPlan让token使用更省钱,并且还提供DeepSeek免费100万Tokens额度:

BASE URL

DeepSeek-V4-Flash和DeepSeek-V4-Pro的BASE URL链接如下:

  • BASE URL (OpenAI 格式):https://api.deepseek.com
  • BASE URL (Anthropic 格式):https://api.deepseek.com/anthropic

参数及功能对照表

参数及功能支持 DeepSeek-V4-Flash DeepSeek-V4-Pro
思考模式 支持非思考与思考模式(默认) 支持非思考与思考模式(默认)
上下文长度 1M 1M
输出长度 最大 384K 最大 384K
Json Output 支持 支持
Tool Calls 支持 支持
对话前缀续写(Beta) 支持 支持
FIM 补全(Beta) 仅非思考模式支持 仅非思考模式支持
并发限制 2500 500