DeepSeek V4 Flash 上线 · 我们的 GLM-5.2 价格本次下调至 5折
博客
成本控制

Claude Fable 5 API 价格与接入

Anthropic 官方价为每百万 token 输入 $10、cache read $1、输出 $50;OmniaKey 当前对应费率为 $2、$0.20 和 $10。

11 分钟阅读OmniaKey
Claude Fable 5API pricingAPI accesscost control

Claude Fable 5 API 价格按 Anthropic 标准费率计算,是每百万 token 输入 $10.00cache read $1.00输出 $50.00。OmniaKey 当前平台费率分别是输入 $2.00cache read $0.20输出 $10.00

OmniaKey 上准确的模型 ID 是 claude-fable-5。Fable 5 支持 1M token 上下文,并且始终启用 adaptive thinking。但上下文容量不是赠送额度:发送、从缓存读取和生成的 token 都按各自类别计费。

价格与接入信息核对于 2026 年 8 月 12 日。 Anthropic 一栏是官方标价;OmniaKey 一栏是当前平台费率,不代表 Anthropic 调整了官方价格,也不是永久折扣承诺。确定生产预算前请重新核对两个实时来源。

Claude Fable 5 API 价格速查

下表单位均为美元/百万 token。

使用类型Anthropic 标准价OmniaKey 当前价当前差异
未缓存输入$10.00$2.00低 80%
Cache read$1.00$0.20低 80%
输出$50.00$10.00低 80%

Claude Fable 5 模型页负责实时平台报价、规格、计算器和请求示例;本文只负责价格计算与接入决策。部署前请通过模型目录确认当前可用性。

基础公式是:

text
费用 = 未缓存输入百万数 × 输入费率
     + cache read 百万数 × cache read 费率
     + 输出百万数 × 输出费率

Cache write、工具、税费、区域倍率、重试和特殊服务模式可能产生额外费用。只有在这些项目不存在或单独测量时,上述简化公式才完整。

Fable 5 各项费用代表什么

未缓存输入

输入包括指令、对话历史、仓库文件、工具定义,以及没有被计为 cache hit 的其它请求上下文。发送 100 万个未缓存输入 token,在 Fable 返回任何内容前,就会按 Anthropic 官方价产生 $10.00,或按 OmniaKey 当前价产生 $2.00。

Cache read

符合条件且被供应商记录为 cache hit 的重复上下文,Anthropic 每百万 token 收取 $1.00,OmniaKey 当前收取 $0.20。看起来重复的 prompt 不会自动成为 cache hit;请求结构、缓存创建、有效期和供应商记录共同决定计费类别。

Anthropic 对 cache write 另行定价。不要把 $1.00 的读取价格套用到首次写入的新上下文,也不要假设全部对话历史会永久命中缓存。

输出与 adaptive thinking

输出是最昂贵的一项:Anthropic 每百万 token $50.00,OmniaKey 当前 $10.00。Fable 5 的 adaptive thinking 始终开启;只要供应商把推理 token 记录为输出,即使用户看到的最终回答很短,它们也会计费。

给出清晰的目标和验收标准。把输出上限压得过低,可能让有价值的调查在验证前中断;说明模糊则可能引发昂贵的工具循环和返工。

三个可复算的 Fable 5 成本示例

下面直接使用表中的 token 分类和费率,不包含 cache write、付费工具、税费、重试和区域倍率。

示例 1:一次困难调查

假设使用 100 万个未缓存输入 token,并生成 10 万个输出 token。

text
Anthropic:1 × $10.00 + 0.1 × $50.00 = $15.00
OmniaKey: 1 × $2.00  + 0.1 × $10.00 = $3.00

1M 上下文表示一次请求可以容纳这么多上下文,并不表示第一个 100 万输入 token 免费。

示例 2:长时间自主任务

假设多次调用总共使用 1,000 万未缓存输入 token 和 200 万输出 token。

text
Anthropic:10 × $10.00 + 2 × $50.00 = $200.00
OmniaKey: 10 × $2.00  + 2 × $10.00 = $40.00

这只是费用算术,不是对仓库任务 token 数量的预测。设置周期预算前,应先测量一次具有代表性的真实任务。

示例 3:重复上下文命中缓存

假设 1,000 万 token 被记录为 cache read,同时模型生成 100 万输出 token。

text
Anthropic:10 × $1.00 + 1 × $50.00 = $60.00
OmniaKey: 10 × $0.20 + 1 × $10.00 = $12.00

这个示例只适用于供应商实际记录的 cache hit。Cache creation 属于独立类别,会影响第一次调用的经济性。

Fable 5 与 Opus 5 成本对比

按 Anthropic 标准价,Fable 的输入、cache read 和输出单价都是 Claude Opus 5 对应费率的两倍。OmniaKey 当前费率也保持相同的二比一关系。

模型输入Cache read输出建议起点
Fable 5,Anthropic$10.00$1.00$50.00最难、持续最久的自主任务
Opus 5,Anthropic$5.00$0.50$25.00复杂推理和错误代价高的任务
Fable 5,OmniaKey$2.00$0.20$10.00当前平台价下仍保持专家型边界
Opus 5,OmniaKey$1.00$0.10$5.00困难任务的强力起点

两个模型都有机会通过时,先用 Opus。只有受控评测证明 Fable 能解决 Opus 无法稳定完成的高度模糊、长周期或工具密集任务时,它的溢价才合理。

不要只比较 token 单价,还要比较每个验收任务的成本:

text
验收任务成本 = 成功调用费用
             + 失败重跑费用
             + 人工修正时间
             + 缺陷补救风险

Claude Code 模型选择指南负责 Fable、Opus、Sonnet 的整体路由决策;Opus 5 评测负责 Opus 证据;Claude Code 价格指南负责比较订阅与 API 计费。

如何通过 API 接入 Claude Fable 5

  1. 确认当前路由的实时目录中存在 claude-fable-5
  2. API token 页面创建一把独立且有限额的 key,不要复用权限过大的生产 key。
  3. 把值保存到 OMNIAKEY_API_KEY,绝不能把真实 key 写进源码。
  4. 使用 Anthropic 兼容 base URL:https://api.omniakey.com
  5. 请求准确模型 ID claude-fable-5

完整配置由本地化的 API 快速开始负责。最小直接请求如下:

bash
curl https://api.omniakey.com/v1/messages \
  -H "x-api-key: $OMNIAKEY_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-fable-5",
    "max_tokens": 1024,
    "messages": [
      {"role": "user", "content": "找出这份迁移计划中风险最高的假设。"}
    ]
  }'

在 Claude Code 中使用 Fable,需要 2.1.170 或更高版本。Anthropic 直连时,可用性还可能取决于组织资格和 usage credits。已配置的网关有自己的模型目录和计费边界,因此必须确认当前供应商,不能假定所有接入路径规则相同。

常见接入与计费错误

API key 无效或返回 HTTP 401

确认启动客户端的 shell 中确实存在环境变量、key 没有被撤销,并且复制的值没有多余引号或空格。Key 一旦泄露就应轮换,不要把它贴进公开日志排错。

模型未知或不可用

使用准确 ID claude-fable-5,并核对实时目录和客户端 base URL。不可用模型应返回错误;OmniaKey 不会静默替换成另一个模型。

安全拒绝以 HTTP 200 返回

Fable 5 的安全分类器可能拒绝特定请求。在 Anthropic Messages API 中,这会返回成功的 HTTP 200,并带有 stop_reason: "refusal",不是传输故障。客户端必须显式处理这个响应。Anthropic 说明,生成任何输出前被拒绝的请求不会计费,并提供 fallback 方案;不要无上限盲目重试。

Claude Code 里看不到 Fable

升级到 Claude Code 2.1.170 或更高版本。Anthropic 直连时,模型选择器还可能受组织权限、零数据保留限制或 usage-credit 资格影响;通过网关时,模型名和可用性由网关决定。

把 1M 上下文当成赠送额度

不是。1M 只表示请求容量。占用这个窗口的输入和 cache token 仍按对应费率计费。

估算低于实际账单

检查 cache write、按输出计费的推理、工具费用、重试、区域设置与税费。应以供应商 usage 记录对账,而不是只按可见回答文本估算。

不破坏正常工作的预算控制

  • 每个人、环境或自动化职责使用独立 key;
  • 按一个代表性任务设置较小的初始限额;
  • 记录请求模型和实际未缓存、缓存及输出 token;
  • 对循环、重复失败和意外模型 ID 告警;
  • 审查验收任务成本后再提高限额;
  • 普通任务交给 Opus 或 Sonnet,Fable 只处理定义清晰的升级任务。

预算太低可能让 Fable 在最终验证前中断;没有任务边界的预算则可能资助无效循环。应以成功任务校准,并为正常波动保留余量。

常见问题

Claude Fable 5 API 价格是多少?

Anthropic 官方价为每百万 token 输入 $10.00、cache read $1.00、输出 $50.00。OmniaKey 当前分别是 $2.00、$0.20 和 $10.00,核对日期为 2026 年 8 月 12 日。

Claude Fable 5 的 API 模型 ID 是什么?

使用 claude-fable-5。固定准确 ID 比依赖可能变化的家族 alias 更容易复现实验和预算。

Fable 5 是否赠送 100 万 token?

不赠送。1M 是上下文容量,不是 token 额度。使用量仍按未缓存输入、缓存活动和输出计费。

Fable 5 一定比 Opus 5 好吗?

不一定。Fable 面向最难、最长的任务,token 单价是 Opus 的两倍。Opus 通常是更经济的起点;只有完成质量数据证明有必要时才升级 Fable。

Fable 5 能否用于 Claude Code?

可以,前提是当前供应商提供该模型。Claude Code 必须为 2.1.170 或更高版本;Anthropic 直连接入还可能受组织和 usage-credit 规则影响。

如果关注的是跨厂商模型选择而不是价格,请阅读 Claude Fable 5 和 GPT-5.6 Sol 编程对比

已核对来源

事实核对日期:2026 年 8 月 12 日。模型权限、平台费率、缓存行为与产品规则可能变化;确定生产采购前请核对上述第一方页面和实时目录。