Claude API 和 OpenAI API 价格对比
OpenAI 的低价档更便宜;Claude 在对应的日常档和旗舰档拥有更低输出价,而长上下文规则往往比标价差异更重要。
Claude API 和 OpenAI API 价格对比没有一个适用于所有任务的赢家。在低价档,OpenAI 的 GPT-5.6 Luna 明显低于 Claude Haiku 4.5;到了均衡档和旗舰档,Claude Sonnet 5、Opus 5 的标准输出价又低于 GPT-5.6 Terra、Sol。输入超过 272K 后,OpenAI 的长上下文倍率还会再次改变结果。
这些结论比较的是开发者 API 价目表,不是模型能力。便宜模型若需要重试、漏掉约束或输出更多 token,完成一个合格编程任务的总成本反而可能更高。正确顺序是先定义工作负载,再比较实际账单和验收结果。
事实核验于 2026 年 8 月 16 日。 价格和计费规则来自当前 Anthropic、OpenAI 官方价格页。实时 SERP 中仍有显眼结果引用已经作废的 Sonnet $3 / $15 价格;Search Console 最近热门查询中没有出现这个精确对比词,因此本文不声称搜索量。我们也没有进行私有跨厂商跑分。
Claude API 与 OpenAI API 价格速览
| 决策 | Claude API | OpenAI API |
|---|---|---|
| 最便宜的低成本编程档 | Haiku 4.5:输入 $1 / 输出 $5 | GPT-5.6 Luna:$0.20 / $1.20 |
| 均衡档标准输入 | Sonnet 5:$2 | Terra:$2 |
| 均衡档标准输出 | Sonnet 5:$10 | Terra:$12 |
| 旗舰档标准输入 | Opus 5:$5 | Sol:$5 |
| 旗舰档标准输出 | Opus 5:$25 | Sol:$30 |
| 缓存读取折扣 | 比基础输入低 90% | 比基础输入低 90% |
| 异步 Batch | 输入、输出均减 50% | 输入、输出均减 50% |
| 原生长上下文 | Claude 4.6+ 的 1M 窗口全程标准价 | 输入超过 272K 后整次请求升价 |
| 永远更便宜的厂商 | 不成立 | 不成立 |
直接价目表在小而明确的工作上偏向 OpenAI;在两个相近的编程档位,Claude 有小幅输出价优势。但同一行的模型也不能被当作能力完全相同。
当前标准 token 价格
下面的顺序都是输入 / 缓存读取 / 输出,单位为每百万 token 美元。
| 编程档位 | Claude 模型 | Claude 价格 | OpenAI 模型 | OpenAI 价格 |
|---|---|---|---|---|
| 低成本 | Claude Haiku 4.5 | $1 / $0.10 / $5 | GPT-5.6 Luna | $0.20 / $0.02 / $1.20 |
| 均衡 | Claude Sonnet 5 | $2 / $0.20 / $10 | GPT-5.6 Terra | $2 / $0.20 / $12 |
| 旗舰 | Claude Opus 5 | $5 / $0.50 / $25 | GPT-5.6 Sol | $5 / $0.50 / $30 |
Haiku 和 Luna 同在低成本一行,不代表它们能力相等;Sonnet 与 Terra、Opus 与 Sol 也是如此。这里按购买位置配对,是为了制定预算,不是因为某个基准证明了它们等价。
实时模型目录会把 OmniaKey 当前报价与厂商直连价格分开显示。确定生产预算前应再次检查。
缓存写入和缓存命中不是同一种费用
两家都把缓存命中定为基础输入价的十分之一,但创建缓存的规则不同。
| 缓存事件 | Claude API | OpenAI API |
|---|---|---|
| 命中或刷新 | 基础输入的 0.1x | 基础输入的 0.1x |
| 短缓存写入 | 5 分钟缓存为基础输入的 1.25x | 基础输入的 1.25x |
| 更长缓存写入 | 1 小时缓存为基础输入的 2x | 当前价目表没有对应第二时长 |
例如,Sonnet 5 和 Terra 的短缓存写入都是每百万 token $2.50;Sonnet 一小时写入为 $4.00。Sol 与 Opus 的短缓存写入都是 $6.25,而 Opus 一小时写入为 $10.00。
只有稳定前缀被重复利用足够多次,缓存读取折扣才能覆盖写入成本。应分别统计写入、读取和未命中 token。若每轮都在提示词开头改内容,可能永远拿不到宣传中的读取折扣。
Batch 与 Flex 价格
Anthropic Batch API 对输入、输出 token 都打 50% 折扣。OpenAI 的 GPT-5.6 Batch 表同样把输入、缓存、缓存写入和输出价减半。OpenAI 当前 Flex 显示相同 token 价格,但以更慢速度和更低可用性换取成本。
Batch 适合评测集、离线分类、批量代码审查等不要求立即响应的工作。交互式编程 agent 必须等本轮结果才能继续调用工具,通常不能直接换成 Batch。
厂商托管工具还可能单独收费。若所用 API surface 对网页搜索、代码执行或其它托管工具收费,这部分必须加在模型 token 之外。
对于 2026 年 3 月 5 日及之后发布、且支持数据驻留的合资格模型,OpenAI 区域处理端点还会加收 10%。上表使用全球标准价;若工作负载必须限定处理区域,应先把这项加价计入比较。
长上下文会改变答案
Anthropic 说明 Claude 4.6 及之后模型在原生 1M 上下文窗口内都使用标准 token 单价。900K 请求和 9K 请求的每 token 单价相同,当然前者仍会产生远多于后者的计费 token。
OpenAI 的 GPT-5.6 价目表则有独立长上下文栏。输入超过 272K 后,更高价格会作用于整次请求:
- 输入和缓存输入变为短上下文的 2x;
- 缓存写入变为短上下文的 2x;
- 输出变为短上下文的 1.5x。
因此 Terra 会变成输入 $4、输出 $18;Sol 是输入 $10、输出 $45;Luna 则是输入 $0.40、输出 $1.80。
所以“1M 上下文”不是成本估算。检索、压缩和只发送相关证据,通常比单纯换厂商更省钱。
一个短编程任务要多少钱
假设一次未缓存请求使用 100,000 输入 token 和 20,000 输出 token,不含工具、重试、区域溢价与网关价格。
| 档位 | Claude 直连成本 | OpenAI 直连成本 | 价目表更低者 |
|---|---|---|---|
| Haiku 4.5 对 Luna | $0.20 | $0.044 | OpenAI Luna |
| Sonnet 5 对 Terra | $0.40 | $0.44 | Claude Sonnet |
| Opus 5 对 Sol | $1.00 | $1.10 | Claude Opus |
公式可以直接复算:
成本 = 输入百万 token x 输入单价
+ 输出百万 token x 输出单价
Luna 的差距很大。均衡档和旗舰档的差距则很小,一次重试、更长输出或 tokenizer 差异都可能让结果反转。
重复缓存任务要多少钱
再假设同样的 100,000 输入 token 已经命中热缓存,输出仍为 20,000 token,且不把前一次缓存写入费算进本轮。
| 档位 | Claude 缓存本轮 | OpenAI 缓存本轮 |
|---|---|---|
| Haiku 4.5 对 Luna | $0.11 | $0.026 |
| Sonnet 5 对 Terra | $0.22 | $0.26 |
| Opus 5 对 Sol | $0.55 | $0.65 |
由于两家缓存读取都优惠 90%,相对结果与未缓存任务接近。真实节省仍取决于前缀稳定性和成功复用次数。
300K 输入会得到另一种答案
考虑 300,000 未缓存输入 token 和 40,000 输出 token。它超过 OpenAI 的 272K 门槛,但仍在 Claude 5 原生上下文内。
| 配对 | Claude 算式 | OpenAI 算式 |
|---|---|---|
| Sonnet 对 Terra | 0.3 x $2 + 0.04 x $10 = $1.00 | 0.3 x $4 + 0.04 x $18 = $1.92 |
| Opus 对 Sol | 0.3 x $5 + 0.04 x $25 = $2.50 | 0.3 x $10 + 0.04 x $45 = $4.80 |
这不能证明 Claude 的长上下文能力更好,只能证明按相同账单 token 计算,当前厂商直连规则产生不同价格。模型质量、tokenizer、检索方式和任务通过率仍然重要。
OmniaKey 当前价格是另一条购买路径
OmniaKey 用一个预付余额提供两家模型。当前目录报价不等于 Anthropic 或 OpenAI 直连价,也可以独立变化。
| 模型 | OmniaKey 每百万输入 / 缓存 / 输出 |
|---|---|
| Claude Haiku 4.5 | $0.20 / $0.02 / $1.00 |
| GPT-5.6 Luna | $0.10 / $0.01 / $0.60 |
| Claude Sonnet 5 | $0.60 / $0.06 / $3.00 |
| GPT-5.6 Terra | $0.175 / $0.0175 / $1.05 |
| Claude Opus 5 | $1.00 / $0.10 / $5.00 |
| GPT-5.6 Sol | $0.35 / $0.035 / $2.10 |
当前网关报价在三组配对里都偏向 GPT。这是购买路径差异,并不表示厂商直连标价发生了同样变化。做长期预算时应读取实时目录和自己的使用台账,而不是永久复制本文表格。
余额与用量指南说明如何检查消费。Claude Code 价格指南负责订阅与 API 的另一类决策。
按工作负载选,不要按厂商 Logo 选
任务窄、重复度高、易验证且量大时,先试 Luna。它是本文直连价最明确的低成本赢家。
日常仓库工作在 Sonnet 与 Terra 之间选择。短上下文直连价非常接近,此时协议适配和完成任务成本比算例里四美分的差距更重要。模型决策详见 Sonnet 5 与 Terra 对比。
问题含糊、错误代价高时再用 Opus 或 Sol。Opus 直连输出价更低;Sol 更适合 OpenAI Responses 和 Codex 原生流程。能力边界详见 Opus 5 与 Sol 对比。
若要比较更多厂商和模型家族,请看编程模型指南。本文只负责价格机制。
比较完成任务成本
token 价格只是总成本的一项:
完成任务成本 = 通过验收的运行
+ 失败尝试与重试
+ 厂商托管工具费用
+ 开发者修正时间
至少记录模型 ID、协议、effort、输入、缓存写入、缓存读取、输出、工具调用、重试、耗时和验收结果。两边必须从同一个仓库 commit 出发并运行同一条验收命令,否则便宜 transcript 可能只是一次昂贵失败。
最终结论
在低成本编程档,OpenAI API 更便宜,因为 GPT-5.6 Luna 的价格远低于 Claude Haiku 4.5。在对应的 Sonnet/Terra 和 Opus/Sol 档位,Claude API 的标准输出价更低。Claude 当前长上下文规则也更简单,而 OpenAI 输入超过 272K 后的整次请求倍率会显著增加大型任务成本。
不存在永远更便宜的厂商。按工作负载匹配模型,把缓存写入和工具费用算进去,再比较实际购买路径上的任务通过成本。
常见问题
Claude API 还是 OpenAI API 更便宜?
取决于模型档位和工作负载。GPT-5.6 Luna 比 Haiku 4.5 便宜很多;Sonnet 5、Opus 5 的标准输出价则低于 Terra、Sol,而后两组输入价相同。
Claude 与 OpenAI API 计费最大的区别是什么?
Claude 提供 5 分钟和 1 小时缓存写入价,并在 Claude 4.6+ 原生 1M 上下文中保持标准价。OpenAI 只有一档缓存写入价,GPT-5.6 输入超过 272K 后整次请求升价。两家都有 90% 缓存读取优惠和 50% Batch 价格。
长上下文用哪个 API 更便宜?
在相同账单 token 且输入超过 272K 时,当前直连价偏向 Claude Sonnet 5 或 Opus 5,而不是 Terra 或 Sol。由于 tokenizer 和结果不同,应根据实际账单而不是字符数验证。
这些价格包含 Claude 或 ChatGPT 订阅吗?
不包含。本文是开发者 API token 价格。Claude、ChatGPT 订阅有各自额度和条款,不能把月费计划直接等同于一百万 API token。
一个 API Key 能同时使用 Claude 和 GPT 吗?
OmniaKey 账户可以用一个预付余额访问已支持的 Claude、GPT 模型,但仍需明确使用文档规定的 Anthropic 兼容或 OpenAI 兼容路径,以及精确模型 ID。
Batch 折扣能直接用于交互式编程 agent 吗?
通常不能。Batch 是异步流程,更适合离线工作。交互式 agent 要等本轮结果才能继续调用工具,因此一般需要标准或其它同步服务档位。
已核对来源
- Anthropic API 价格
- OpenAI API 价格
- OpenAI GPT-5.6 Sol
- OpenAI GPT-5.6 Terra
- OpenAI GPT-5.6 Luna
- Anthropic 模型概览
信息核验于 2026 年 8 月 16 日。厂商单价、区域溢价、服务档位、工具费用和网关报价都可能变化,上生产前请重新检查两家官方价格页和实时目录。