GPT-6 Sol、Claude Opus 5.5 已上线GPT-6 Sol 价格仅为 5.6 Sol 的一半
博客
成本控制

DeepSeek API 价格

按型号、缓存和时段算清一次 API 调用的费用。

9 分钟阅读OmniaKey
DeepSeek API 价格计费上下文缓存DeepSeek FlashDeepSeek V4 Pro

DeepSeek API 费用由型号、输入是否命中缓存、输出 token 和适用时段共同决定。 2026 年 9 月 28 日核验时,官方直连接口列出的主要型号是 deepseek-flash 和 deepseek-v4-pro。Flash 单价较低;选择 Pro 应由具体任务的收益来支持。

本文表格是 DeepSeek 官方直连 API 的美元/百万 tokens 价格,核验日期为 2026 年 9 月 28 日,不是 OmniaKey 报价。成本示例是计算结果,不是实测账单或模型能力证明。

DeepSeek API 当前价格表

API 型号未命中缓存的输入:非高峰 / 高峰命中缓存的输入:非高峰 / 高峰输出:非高峰 / 高峰
deepseek-flash$0.15 / $0.30$0.003 / $0.006$0.60 / $1.20
deepseek-v4-pro$0.66 / $1.32$0.022 / $0.044$1.98 / $3.96

来源是官方模型与价格页。缓存命中是一类输入 token 的价格,不能把这个折扣套到整个请求或输出上。

官方 deepseek-flash 当前对应 DeepSeek-V4.1-Flash,deepseek-v4-pro 对应 DeepSeek-V4-Pro-0813。官方说明旧名称 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 仍可接受,但实际已由 V4.1 Flash 服务并按 Flash 计费。不能由此推断所有网关都有相同映射。

模型能力和迁移细节见 V4.1 Flash 评测;Pro 的历史与专项案例见 V4 Pro 价格指南。

峰谷时段按 UTC 判断

官方当前高峰窗口是 周一至周五的 UTC 01:00–04:00、06:00–10:00,中国公共假期除外。其余时段为非高峰,周末和中国公共假期全天均为非高峰。非高峰单价是对应高峰价的一半。

排期时使用带时区的时间转换,不要把 UTC 当北京时间或浏览器所在时区。UTC 的周一可能仍是某地周日晚上,夏令时也会影响换算。临近边界时核对官方日历和实际账单;本文不猜测跨越边界的长请求按哪个时点定价。

一次 API 调用怎么计算费用

选择正确型号和时段后,分别计算三类 token:

text
费用 = 未命中缓存的输入tokens / 1,000,000 × 对应输入单价
     + 命中缓存的输入tokens   / 1,000,000 × 对应缓存单价
     + 计费输出tokens        / 1,000,000 × 对应输出单价

计费输出还要包含推理输出,而不只是最后可见的答案。应读取 API 用量字段,不能用字符数或答案长度代替账单口径。

相同 token 工作量Flash 非高峰Flash 高峰Pro 非高峰Pro 高峰
100K 未缓存输入+20K 输出$0.027$0.054$0.1056$0.2112
90K 缓存输入+10K 未缓存输入+20K 输出$0.01377$0.02754$0.04818$0.09636

第一行 Flash 非高峰费用为 0.1 × $0.15 + 0.02 × $0.60 = $0.027;第二行则为 0.09 × $0.003 + 0.01 × $0.15 + 0.02 × $0.60 = $0.01377。两行是不同工作量情景,不是一次请求要同时支付两笔。

例子不含重试、额外工具或供应商费用、汇率换算。它假设两个模型使用相同 token 数,并且缓存命中已经在用量中得到确认。真实任务的 token 消耗和尝试次数可能不同。

缓存命中需要可复用的前缀

DeepSeek 上下文缓存复用匹配前缀。应用允许时,把稳定的指令和资料放前面,把变化的问题放后面。主题相近或文字大致相同,不等于已经命中缓存。

查看 prompt_cache_hit_tokens 和 prompt_cache_miss_tokens。首个请求若没有返回命中证据,就按未命中估算。缓存也不等于永久应用记忆,不能保证下一次一定命中。

优化缓存前,先减少无关输入、控制输出长度并测量重试。缓存一个根本不需要的大提示词,仍可能比发送更短的输入更贵。

Flash 和 Pro 应按完成任务的成本比较

官方非高峰价中,Pro 的未缓存输入是 Flash 的 4.4 倍,输出是 3.3 倍,缓存输入约 7.33 倍。不同 token 混合比例没有统一的费用倍数。

使用相同工具、验收标准和时间预算,对代表性任务记录总费用、重试、耗时和人工修正,再计算“总计费金额 ÷ 通过验收的任务数”。低单价可能被多次失败抵消,高价也不自动代表更适合。需要图片输入时,当前官方价格表标记 Flash 支持视觉、Pro 不支持,应先判断能力是否符合需求。

官方账单与 OmniaKey 账单分别看

OmniaKey 请求使用 OmniaKey Key 和 快速开始中的接口,不会扣除一个独立 DeepSeek 账号的余额。DeepSeek Key 则用于官方服务。

比较实际调用的模型 ID、输入/输出报价、缓存处理和用量记录。官方峰谷规则、别名和赠送余额不自动适用于中间服务。查看 OmniaKey 当前报价与 Dashboard,不按想象中的固定折扣换算官方表格。

常见问题

DeepSeek API 免费吗?

API 按量计费。官方说明:账号同时有充值余额和赠送余额时,优先扣赠送余额。这不等于每个账号都有免费额度。免费聊天网页、活动和 API 余额是不同产品或条件。

是月费还是按 token 收费?

这里是官方 API token 价格。聊天订阅或第三方“Premium”套餐不能替代这张表,单独购买的套餐应看各自条款。

输入命中缓存后,输出也打折吗?

不会。缓存命中只改变对应输入费用;输出使用自己的单价,包括按输出计费的推理 tokens。

周末一定是低价吗?

核验时的官方规则把周末列为非高峰。注意 UTC 和最新官方规则,这不保证网关采取相同时段,也不等于所在地区的周末边界。

还能用旧 Flash 名称吗?

官方保留兼容别名,但直连时已指向 V4.1 Flash。优先使用当前文档 ID,模型变化后重新评估;网关可用名称另外看目录。

资料来源