DeepSeek API 价格
按型号、缓存和时段算清一次 API 调用的费用。
DeepSeek API 费用由型号、输入是否命中缓存、输出 token 和适用时段共同决定。 2026 年 9 月 28 日核验时,官方直连接口列出的主要型号是 deepseek-flash 和 deepseek-v4-pro。Flash 单价较低;选择 Pro 应由具体任务的收益来支持。
本文表格是 DeepSeek 官方直连 API 的美元/百万 tokens 价格,核验日期为 2026 年 9 月 28 日,不是 OmniaKey 报价。成本示例是计算结果,不是实测账单或模型能力证明。
DeepSeek API 当前价格表
| API 型号 | 未命中缓存的输入:非高峰 / 高峰 | 命中缓存的输入:非高峰 / 高峰 | 输出:非高峰 / 高峰 |
|---|---|---|---|
deepseek-flash | $0.15 / $0.30 | $0.003 / $0.006 | $0.60 / $1.20 |
deepseek-v4-pro | $0.66 / $1.32 | $0.022 / $0.044 | $1.98 / $3.96 |
来源是官方模型与价格页。缓存命中是一类输入 token 的价格,不能把这个折扣套到整个请求或输出上。
官方 deepseek-flash 当前对应 DeepSeek-V4.1-Flash,deepseek-v4-pro 对应 DeepSeek-V4-Pro-0813。官方说明旧名称 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 仍可接受,但实际已由 V4.1 Flash 服务并按 Flash 计费。不能由此推断所有网关都有相同映射。
模型能力和迁移细节见 V4.1 Flash 评测;Pro 的历史与专项案例见 V4 Pro 价格指南。
峰谷时段按 UTC 判断
官方当前高峰窗口是 周一至周五的 UTC 01:00–04:00、06:00–10:00,中国公共假期除外。其余时段为非高峰,周末和中国公共假期全天均为非高峰。非高峰单价是对应高峰价的一半。
排期时使用带时区的时间转换,不要把 UTC 当北京时间或浏览器所在时区。UTC 的周一可能仍是某地周日晚上,夏令时也会影响换算。临近边界时核对官方日历和实际账单;本文不猜测跨越边界的长请求按哪个时点定价。
一次 API 调用怎么计算费用
选择正确型号和时段后,分别计算三类 token:
费用 = 未命中缓存的输入tokens / 1,000,000 × 对应输入单价
+ 命中缓存的输入tokens / 1,000,000 × 对应缓存单价
+ 计费输出tokens / 1,000,000 × 对应输出单价
计费输出还要包含推理输出,而不只是最后可见的答案。应读取 API 用量字段,不能用字符数或答案长度代替账单口径。
| 相同 token 工作量 | Flash 非高峰 | Flash 高峰 | Pro 非高峰 | Pro 高峰 |
|---|---|---|---|---|
| 100K 未缓存输入+20K 输出 | $0.027 | $0.054 | $0.1056 | $0.2112 |
| 90K 缓存输入+10K 未缓存输入+20K 输出 | $0.01377 | $0.02754 | $0.04818 | $0.09636 |
第一行 Flash 非高峰费用为 0.1 × $0.15 + 0.02 × $0.60 = $0.027;第二行则为 0.09 × $0.003 + 0.01 × $0.15 + 0.02 × $0.60 = $0.01377。两行是不同工作量情景,不是一次请求要同时支付两笔。
例子不含重试、额外工具或供应商费用、汇率换算。它假设两个模型使用相同 token 数,并且缓存命中已经在用量中得到确认。真实任务的 token 消耗和尝试次数可能不同。
缓存命中需要可复用的前缀
DeepSeek 上下文缓存复用匹配前缀。应用允许时,把稳定的指令和资料放前面,把变化的问题放后面。主题相近或文字大致相同,不等于已经命中缓存。
查看 prompt_cache_hit_tokens 和 prompt_cache_miss_tokens。首个请求若没有返回命中证据,就按未命中估算。缓存也不等于永久应用记忆,不能保证下一次一定命中。
优化缓存前,先减少无关输入、控制输出长度并测量重试。缓存一个根本不需要的大提示词,仍可能比发送更短的输入更贵。
Flash 和 Pro 应按完成任务的成本比较
官方非高峰价中,Pro 的未缓存输入是 Flash 的 4.4 倍,输出是 3.3 倍,缓存输入约 7.33 倍。不同 token 混合比例没有统一的费用倍数。
使用相同工具、验收标准和时间预算,对代表性任务记录总费用、重试、耗时和人工修正,再计算“总计费金额 ÷ 通过验收的任务数”。低单价可能被多次失败抵消,高价也不自动代表更适合。需要图片输入时,当前官方价格表标记 Flash 支持视觉、Pro 不支持,应先判断能力是否符合需求。
官方账单与 OmniaKey 账单分别看
OmniaKey 请求使用 OmniaKey Key 和 快速开始中的接口,不会扣除一个独立 DeepSeek 账号的余额。DeepSeek Key 则用于官方服务。
比较实际调用的模型 ID、输入/输出报价、缓存处理和用量记录。官方峰谷规则、别名和赠送余额不自动适用于中间服务。查看 OmniaKey 当前报价与 Dashboard,不按想象中的固定折扣换算官方表格。
常见问题
DeepSeek API 免费吗?
API 按量计费。官方说明:账号同时有充值余额和赠送余额时,优先扣赠送余额。这不等于每个账号都有免费额度。免费聊天网页、活动和 API 余额是不同产品或条件。
是月费还是按 token 收费?
这里是官方 API token 价格。聊天订阅或第三方“Premium”套餐不能替代这张表,单独购买的套餐应看各自条款。
输入命中缓存后,输出也打折吗?
不会。缓存命中只改变对应输入费用;输出使用自己的单价,包括按输出计费的推理 tokens。
周末一定是低价吗?
核验时的官方规则把周末列为非高峰。注意 UTC 和最新官方规则,这不保证网关采取相同时段,也不等于所在地区的周末边界。
还能用旧 Flash 名称吗?
官方保留兼容别名,但直连时已指向 V4.1 Flash。优先使用当前文档 ID,模型变化后重新评估;网关可用名称另外看目录。