DeepSeek-V4分为deepseek-v4-flash和deepseek-v4-pro两个版本,TokCost以Pro版本为例百万tokens输入(缓存命中)价格是0.025元,缓存未命的输入价格是3元,百万tokens输出费用是6元,详细DeepSeek-V4版本收费标准及支持功能对照表如下:

DeepSeek-V4模型费用及区别对比(flash和pro)
DeepSeek-V4的Flash和Pro有什么区别?顾名思义,Pro是具有极致性能的旗舰款模型,Flash是具有高性价比、低延迟的经济款模型。
- 1、Pro模型参数支持1.6万亿、激活参数490亿;Flash模型参数2840亿,激活参数仅130亿。
- 2、Pro拥有顶级的世界知识储备和推理性能,Flash和Pro的推理能力差不多,但是世界知识储备要差很多。
- 3、Agent任务方面,简单任务二者的表现是差不多,但是如果遇到复杂任务,则Pro更出色。
- 4、推理成本与效率方面,在1M上下文下,Pro的推理FLOPs是V3.2的27%,KV Cache是其10%;而Flash则分别优化到了10%和7%。
- 5、二者均为MoE架构,都支持100万token的超长上下文,并且均提供思考(thinking)和非思考(non-thinking) 两种模式。
flash和pro输入/输出费用价格表:
以下是以百万tokens为单位,输入分为缓存命中和未命中,以及不同版本的输出价格表:
| DeepSeek-V4计费项 | DeepSeek-V4-Flash | DeepSeek-V4-Pro |
|---|---|---|
| 百万tokens输入(缓存命中) | 0.02元 | 0.025元 |
| 百万tokens输入(缓存未命中) | 1元 | 3元 |
| 百万tokens输出 | 2元 | 6元 |
扣费规则:扣减费用 = token 消耗量 × 模型单价
另外,也可以在阿里云、腾讯云等云厂商通过API调用DeepSeek模型,阿里云百炼TokenPlan和腾讯云TokenPlan让token使用更省钱,并且还提供DeepSeek免费100万Tokens额度:
- 阿里云百炼AI模型平台:https://t.aliyun.com/U/fPVHqY
- 腾讯云TokenHub模型平台:https://curl.qcloud.com/AqxTFnlv
BASE URL
DeepSeek-V4-Flash和DeepSeek-V4-Pro的BASE URL链接如下:
- BASE URL (OpenAI 格式):https://api.deepseek.com
- BASE URL (Anthropic 格式):https://api.deepseek.com/anthropic
参数及功能对照表
| 参数及功能支持 | DeepSeek-V4-Flash | DeepSeek-V4-Pro |
|---|---|---|
| 思考模式 | 支持非思考与思考模式(默认) | 支持非思考与思考模式(默认) |
| 上下文长度 | 1M | 1M |
| 输出长度 | 最大 384K | 最大 384K |
| Json Output | 支持 | 支持 |
| Tool Calls | 支持 | 支持 |
| 对话前缀续写(Beta) | 支持 | 支持 |
| FIM 补全(Beta) | 仅非思考模式支持 | 仅非思考模式支持 |
| 并发限制 | 2500 | 500 |