DeepSeek V4 Flash 上线 · 我们的 GLM-5.2 价格本次下调至 5折
博客
成本控制

Claude API 和 OpenAI API 价格对比

OpenAI 的低价档更便宜;Claude 在对应的日常档和旗舰档拥有更低输出价,而长上下文规则往往比标价差异更重要。

12 分钟阅读OmniaKey
Claude APIOpenAI APIAPI pricingcoding cost

Claude API 和 OpenAI API 价格对比没有一个适用于所有任务的赢家。在低价档,OpenAI 的 GPT-5.6 Luna 明显低于 Claude Haiku 4.5;到了均衡档和旗舰档,Claude Sonnet 5、Opus 5 的标准输出价又低于 GPT-5.6 Terra、Sol。输入超过 272K 后,OpenAI 的长上下文倍率还会再次改变结果。

这些结论比较的是开发者 API 价目表,不是模型能力。便宜模型若需要重试、漏掉约束或输出更多 token,完成一个合格编程任务的总成本反而可能更高。正确顺序是先定义工作负载,再比较实际账单和验收结果。

事实核验于 2026 年 8 月 16 日。 价格和计费规则来自当前 Anthropic、OpenAI 官方价格页。实时 SERP 中仍有显眼结果引用已经作废的 Sonnet $3 / $15 价格;Search Console 最近热门查询中没有出现这个精确对比词,因此本文不声称搜索量。我们也没有进行私有跨厂商跑分。

Claude API 与 OpenAI API 价格速览

决策Claude APIOpenAI API
最便宜的低成本编程档Haiku 4.5:输入 $1 / 输出 $5GPT-5.6 Luna:$0.20 / $1.20
均衡档标准输入Sonnet 5:$2Terra:$2
均衡档标准输出Sonnet 5:$10Terra:$12
旗舰档标准输入Opus 5:$5Sol:$5
旗舰档标准输出Opus 5:$25Sol:$30
缓存读取折扣比基础输入低 90%比基础输入低 90%
异步 Batch输入、输出均减 50%输入、输出均减 50%
原生长上下文Claude 4.6+ 的 1M 窗口全程标准价输入超过 272K 后整次请求升价
永远更便宜的厂商不成立不成立

直接价目表在小而明确的工作上偏向 OpenAI;在两个相近的编程档位,Claude 有小幅输出价优势。但同一行的模型也不能被当作能力完全相同。

当前标准 token 价格

下面的顺序都是输入 / 缓存读取 / 输出,单位为每百万 token 美元。

编程档位Claude 模型Claude 价格OpenAI 模型OpenAI 价格
低成本Claude Haiku 4.5$1 / $0.10 / $5GPT-5.6 Luna$0.20 / $0.02 / $1.20
均衡Claude Sonnet 5$2 / $0.20 / $10GPT-5.6 Terra$2 / $0.20 / $12
旗舰Claude Opus 5$5 / $0.50 / $25GPT-5.6 Sol$5 / $0.50 / $30

Haiku 和 Luna 同在低成本一行,不代表它们能力相等;Sonnet 与 Terra、Opus 与 Sol 也是如此。这里按购买位置配对,是为了制定预算,不是因为某个基准证明了它们等价。

实时模型目录会把 OmniaKey 当前报价与厂商直连价格分开显示。确定生产预算前应再次检查。

缓存写入和缓存命中不是同一种费用

两家都把缓存命中定为基础输入价的十分之一,但创建缓存的规则不同。

缓存事件Claude APIOpenAI API
命中或刷新基础输入的 0.1x基础输入的 0.1x
短缓存写入5 分钟缓存为基础输入的 1.25x基础输入的 1.25x
更长缓存写入1 小时缓存为基础输入的 2x当前价目表没有对应第二时长

例如,Sonnet 5 和 Terra 的短缓存写入都是每百万 token $2.50;Sonnet 一小时写入为 $4.00。Sol 与 Opus 的短缓存写入都是 $6.25,而 Opus 一小时写入为 $10.00。

只有稳定前缀被重复利用足够多次,缓存读取折扣才能覆盖写入成本。应分别统计写入、读取和未命中 token。若每轮都在提示词开头改内容,可能永远拿不到宣传中的读取折扣。

Batch 与 Flex 价格

Anthropic Batch API 对输入、输出 token 都打 50% 折扣。OpenAI 的 GPT-5.6 Batch 表同样把输入、缓存、缓存写入和输出价减半。OpenAI 当前 Flex 显示相同 token 价格,但以更慢速度和更低可用性换取成本。

Batch 适合评测集、离线分类、批量代码审查等不要求立即响应的工作。交互式编程 agent 必须等本轮结果才能继续调用工具,通常不能直接换成 Batch。

厂商托管工具还可能单独收费。若所用 API surface 对网页搜索、代码执行或其它托管工具收费,这部分必须加在模型 token 之外。

对于 2026 年 3 月 5 日及之后发布、且支持数据驻留的合资格模型,OpenAI 区域处理端点还会加收 10%。上表使用全球标准价;若工作负载必须限定处理区域,应先把这项加价计入比较。

长上下文会改变答案

Anthropic 说明 Claude 4.6 及之后模型在原生 1M 上下文窗口内都使用标准 token 单价。900K 请求和 9K 请求的每 token 单价相同,当然前者仍会产生远多于后者的计费 token。

OpenAI 的 GPT-5.6 价目表则有独立长上下文栏。输入超过 272K 后,更高价格会作用于整次请求:

  • 输入和缓存输入变为短上下文的 2x;
  • 缓存写入变为短上下文的 2x;
  • 输出变为短上下文的 1.5x。

因此 Terra 会变成输入 $4、输出 $18;Sol 是输入 $10、输出 $45;Luna 则是输入 $0.40、输出 $1.80。

所以“1M 上下文”不是成本估算。检索、压缩和只发送相关证据,通常比单纯换厂商更省钱。

一个短编程任务要多少钱

假设一次未缓存请求使用 100,000 输入 token 和 20,000 输出 token,不含工具、重试、区域溢价与网关价格。

档位Claude 直连成本OpenAI 直连成本价目表更低者
Haiku 4.5 对 Luna$0.20$0.044OpenAI Luna
Sonnet 5 对 Terra$0.40$0.44Claude Sonnet
Opus 5 对 Sol$1.00$1.10Claude Opus

公式可以直接复算:

text
成本 = 输入百万 token x 输入单价
     + 输出百万 token x 输出单价

Luna 的差距很大。均衡档和旗舰档的差距则很小,一次重试、更长输出或 tokenizer 差异都可能让结果反转。

重复缓存任务要多少钱

再假设同样的 100,000 输入 token 已经命中热缓存,输出仍为 20,000 token,且不把前一次缓存写入费算进本轮。

档位Claude 缓存本轮OpenAI 缓存本轮
Haiku 4.5 对 Luna$0.11$0.026
Sonnet 5 对 Terra$0.22$0.26
Opus 5 对 Sol$0.55$0.65

由于两家缓存读取都优惠 90%,相对结果与未缓存任务接近。真实节省仍取决于前缀稳定性和成功复用次数。

300K 输入会得到另一种答案

考虑 300,000 未缓存输入 token 和 40,000 输出 token。它超过 OpenAI 的 272K 门槛,但仍在 Claude 5 原生上下文内。

配对Claude 算式OpenAI 算式
Sonnet 对 Terra0.3 x $2 + 0.04 x $10 = $1.000.3 x $4 + 0.04 x $18 = $1.92
Opus 对 Sol0.3 x $5 + 0.04 x $25 = $2.500.3 x $10 + 0.04 x $45 = $4.80

这不能证明 Claude 的长上下文能力更好,只能证明按相同账单 token 计算,当前厂商直连规则产生不同价格。模型质量、tokenizer、检索方式和任务通过率仍然重要。

OmniaKey 当前价格是另一条购买路径

OmniaKey 用一个预付余额提供两家模型。当前目录报价不等于 Anthropic 或 OpenAI 直连价,也可以独立变化。

模型OmniaKey 每百万输入 / 缓存 / 输出
Claude Haiku 4.5$0.20 / $0.02 / $1.00
GPT-5.6 Luna$0.10 / $0.01 / $0.60
Claude Sonnet 5$0.60 / $0.06 / $3.00
GPT-5.6 Terra$0.175 / $0.0175 / $1.05
Claude Opus 5$1.00 / $0.10 / $5.00
GPT-5.6 Sol$0.35 / $0.035 / $2.10

当前网关报价在三组配对里都偏向 GPT。这是购买路径差异,并不表示厂商直连标价发生了同样变化。做长期预算时应读取实时目录和自己的使用台账,而不是永久复制本文表格。

余额与用量指南说明如何检查消费。Claude Code 价格指南负责订阅与 API 的另一类决策。

按工作负载选,不要按厂商 Logo 选

任务窄、重复度高、易验证且量大时,先试 Luna。它是本文直连价最明确的低成本赢家。

日常仓库工作在 Sonnet 与 Terra 之间选择。短上下文直连价非常接近,此时协议适配和完成任务成本比算例里四美分的差距更重要。模型决策详见 Sonnet 5 与 Terra 对比

问题含糊、错误代价高时再用 Opus 或 Sol。Opus 直连输出价更低;Sol 更适合 OpenAI Responses 和 Codex 原生流程。能力边界详见 Opus 5 与 Sol 对比

若要比较更多厂商和模型家族,请看编程模型指南。本文只负责价格机制。

比较完成任务成本

token 价格只是总成本的一项:

text
完成任务成本 = 通过验收的运行
             + 失败尝试与重试
             + 厂商托管工具费用
             + 开发者修正时间

至少记录模型 ID、协议、effort、输入、缓存写入、缓存读取、输出、工具调用、重试、耗时和验收结果。两边必须从同一个仓库 commit 出发并运行同一条验收命令,否则便宜 transcript 可能只是一次昂贵失败。

最终结论

在低成本编程档,OpenAI API 更便宜,因为 GPT-5.6 Luna 的价格远低于 Claude Haiku 4.5。在对应的 Sonnet/Terra 和 Opus/Sol 档位,Claude API 的标准输出价更低。Claude 当前长上下文规则也更简单,而 OpenAI 输入超过 272K 后的整次请求倍率会显著增加大型任务成本。

不存在永远更便宜的厂商。按工作负载匹配模型,把缓存写入和工具费用算进去,再比较实际购买路径上的任务通过成本。

常见问题

Claude API 还是 OpenAI API 更便宜?

取决于模型档位和工作负载。GPT-5.6 Luna 比 Haiku 4.5 便宜很多;Sonnet 5、Opus 5 的标准输出价则低于 Terra、Sol,而后两组输入价相同。

Claude 与 OpenAI API 计费最大的区别是什么?

Claude 提供 5 分钟和 1 小时缓存写入价,并在 Claude 4.6+ 原生 1M 上下文中保持标准价。OpenAI 只有一档缓存写入价,GPT-5.6 输入超过 272K 后整次请求升价。两家都有 90% 缓存读取优惠和 50% Batch 价格。

长上下文用哪个 API 更便宜?

在相同账单 token 且输入超过 272K 时,当前直连价偏向 Claude Sonnet 5 或 Opus 5,而不是 Terra 或 Sol。由于 tokenizer 和结果不同,应根据实际账单而不是字符数验证。

这些价格包含 Claude 或 ChatGPT 订阅吗?

不包含。本文是开发者 API token 价格。Claude、ChatGPT 订阅有各自额度和条款,不能把月费计划直接等同于一百万 API token。

一个 API Key 能同时使用 Claude 和 GPT 吗?

OmniaKey 账户可以用一个预付余额访问已支持的 Claude、GPT 模型,但仍需明确使用文档规定的 Anthropic 兼容或 OpenAI 兼容路径,以及精确模型 ID。

Batch 折扣能直接用于交互式编程 agent 吗?

通常不能。Batch 是异步流程,更适合离线工作。交互式 agent 要等本轮结果才能继续调用工具,因此一般需要标准或其它同步服务档位。

已核对来源

信息核验于 2026 年 8 月 16 日。厂商单价、区域溢价、服务档位、工具费用和网关报价都可能变化,上生产前请重新检查两家官方价格页和实时目录。