Claude Fable 5 API 价格与接入
Anthropic 官方价为每百万 token 输入 $10、cache read $1、输出 $50;OmniaKey 当前对应费率为 $2、$0.20 和 $10。
Claude Fable 5 API 价格按 Anthropic 标准费率计算,是每百万 token 输入 $10.00、cache read $1.00、输出 $50.00。OmniaKey 当前平台费率分别是输入 $2.00、cache read $0.20、输出 $10.00。
OmniaKey 上准确的模型 ID 是 claude-fable-5。Fable 5 支持 1M token 上下文,并且始终启用 adaptive thinking。但上下文容量不是赠送额度:发送、从缓存读取和生成的 token 都按各自类别计费。
价格与接入信息核对于 2026 年 8 月 12 日。 Anthropic 一栏是官方标价;OmniaKey 一栏是当前平台费率,不代表 Anthropic 调整了官方价格,也不是永久折扣承诺。确定生产预算前请重新核对两个实时来源。
Claude Fable 5 API 价格速查
下表单位均为美元/百万 token。
| 使用类型 | Anthropic 标准价 | OmniaKey 当前价 | 当前差异 |
|---|---|---|---|
| 未缓存输入 | $10.00 | $2.00 | 低 80% |
| Cache read | $1.00 | $0.20 | 低 80% |
| 输出 | $50.00 | $10.00 | 低 80% |
Claude Fable 5 模型页负责实时平台报价、规格、计算器和请求示例;本文只负责价格计算与接入决策。部署前请通过模型目录确认当前可用性。
基础公式是:
费用 = 未缓存输入百万数 × 输入费率
+ cache read 百万数 × cache read 费率
+ 输出百万数 × 输出费率
Cache write、工具、税费、区域倍率、重试和特殊服务模式可能产生额外费用。只有在这些项目不存在或单独测量时,上述简化公式才完整。
Fable 5 各项费用代表什么
未缓存输入
输入包括指令、对话历史、仓库文件、工具定义,以及没有被计为 cache hit 的其它请求上下文。发送 100 万个未缓存输入 token,在 Fable 返回任何内容前,就会按 Anthropic 官方价产生 $10.00,或按 OmniaKey 当前价产生 $2.00。
Cache read
符合条件且被供应商记录为 cache hit 的重复上下文,Anthropic 每百万 token 收取 $1.00,OmniaKey 当前收取 $0.20。看起来重复的 prompt 不会自动成为 cache hit;请求结构、缓存创建、有效期和供应商记录共同决定计费类别。
Anthropic 对 cache write 另行定价。不要把 $1.00 的读取价格套用到首次写入的新上下文,也不要假设全部对话历史会永久命中缓存。
输出与 adaptive thinking
输出是最昂贵的一项:Anthropic 每百万 token $50.00,OmniaKey 当前 $10.00。Fable 5 的 adaptive thinking 始终开启;只要供应商把推理 token 记录为输出,即使用户看到的最终回答很短,它们也会计费。
给出清晰的目标和验收标准。把输出上限压得过低,可能让有价值的调查在验证前中断;说明模糊则可能引发昂贵的工具循环和返工。
三个可复算的 Fable 5 成本示例
下面直接使用表中的 token 分类和费率,不包含 cache write、付费工具、税费、重试和区域倍率。
示例 1:一次困难调查
假设使用 100 万个未缓存输入 token,并生成 10 万个输出 token。
Anthropic:1 × $10.00 + 0.1 × $50.00 = $15.00
OmniaKey: 1 × $2.00 + 0.1 × $10.00 = $3.00
1M 上下文表示一次请求可以容纳这么多上下文,并不表示第一个 100 万输入 token 免费。
示例 2:长时间自主任务
假设多次调用总共使用 1,000 万未缓存输入 token 和 200 万输出 token。
Anthropic:10 × $10.00 + 2 × $50.00 = $200.00
OmniaKey: 10 × $2.00 + 2 × $10.00 = $40.00
这只是费用算术,不是对仓库任务 token 数量的预测。设置周期预算前,应先测量一次具有代表性的真实任务。
示例 3:重复上下文命中缓存
假设 1,000 万 token 被记录为 cache read,同时模型生成 100 万输出 token。
Anthropic:10 × $1.00 + 1 × $50.00 = $60.00
OmniaKey: 10 × $0.20 + 1 × $10.00 = $12.00
这个示例只适用于供应商实际记录的 cache hit。Cache creation 属于独立类别,会影响第一次调用的经济性。
Fable 5 与 Opus 5 成本对比
按 Anthropic 标准价,Fable 的输入、cache read 和输出单价都是 Claude Opus 5 对应费率的两倍。OmniaKey 当前费率也保持相同的二比一关系。
| 模型 | 输入 | Cache read | 输出 | 建议起点 |
|---|---|---|---|---|
| Fable 5,Anthropic | $10.00 | $1.00 | $50.00 | 最难、持续最久的自主任务 |
| Opus 5,Anthropic | $5.00 | $0.50 | $25.00 | 复杂推理和错误代价高的任务 |
| Fable 5,OmniaKey | $2.00 | $0.20 | $10.00 | 当前平台价下仍保持专家型边界 |
| Opus 5,OmniaKey | $1.00 | $0.10 | $5.00 | 困难任务的强力起点 |
两个模型都有机会通过时,先用 Opus。只有受控评测证明 Fable 能解决 Opus 无法稳定完成的高度模糊、长周期或工具密集任务时,它的溢价才合理。
不要只比较 token 单价,还要比较每个验收任务的成本:
验收任务成本 = 成功调用费用
+ 失败重跑费用
+ 人工修正时间
+ 缺陷补救风险
Claude Code 模型选择指南负责 Fable、Opus、Sonnet 的整体路由决策;Opus 5 评测负责 Opus 证据;Claude Code 价格指南负责比较订阅与 API 计费。
如何通过 API 接入 Claude Fable 5
- 确认当前路由的实时目录中存在
claude-fable-5。 - 在 API token 页面创建一把独立且有限额的 key,不要复用权限过大的生产 key。
- 把值保存到
OMNIAKEY_API_KEY,绝不能把真实 key 写进源码。 - 使用 Anthropic 兼容 base URL:
https://api.omniakey.com。 - 请求准确模型 ID
claude-fable-5。
完整配置由本地化的 API 快速开始负责。最小直接请求如下:
curl https://api.omniakey.com/v1/messages \
-H "x-api-key: $OMNIAKEY_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-fable-5",
"max_tokens": 1024,
"messages": [
{"role": "user", "content": "找出这份迁移计划中风险最高的假设。"}
]
}'
在 Claude Code 中使用 Fable,需要 2.1.170 或更高版本。Anthropic 直连时,可用性还可能取决于组织资格和 usage credits。已配置的网关有自己的模型目录和计费边界,因此必须确认当前供应商,不能假定所有接入路径规则相同。
常见接入与计费错误
API key 无效或返回 HTTP 401
确认启动客户端的 shell 中确实存在环境变量、key 没有被撤销,并且复制的值没有多余引号或空格。Key 一旦泄露就应轮换,不要把它贴进公开日志排错。
模型未知或不可用
使用准确 ID claude-fable-5,并核对实时目录和客户端 base URL。不可用模型应返回错误;OmniaKey 不会静默替换成另一个模型。
安全拒绝以 HTTP 200 返回
Fable 5 的安全分类器可能拒绝特定请求。在 Anthropic Messages API 中,这会返回成功的 HTTP 200,并带有 stop_reason: "refusal",不是传输故障。客户端必须显式处理这个响应。Anthropic 说明,生成任何输出前被拒绝的请求不会计费,并提供 fallback 方案;不要无上限盲目重试。
Claude Code 里看不到 Fable
升级到 Claude Code 2.1.170 或更高版本。Anthropic 直连时,模型选择器还可能受组织权限、零数据保留限制或 usage-credit 资格影响;通过网关时,模型名和可用性由网关决定。
把 1M 上下文当成赠送额度
不是。1M 只表示请求容量。占用这个窗口的输入和 cache token 仍按对应费率计费。
估算低于实际账单
检查 cache write、按输出计费的推理、工具费用、重试、区域设置与税费。应以供应商 usage 记录对账,而不是只按可见回答文本估算。
不破坏正常工作的预算控制
- 每个人、环境或自动化职责使用独立 key;
- 按一个代表性任务设置较小的初始限额;
- 记录请求模型和实际未缓存、缓存及输出 token;
- 对循环、重复失败和意外模型 ID 告警;
- 审查验收任务成本后再提高限额;
- 普通任务交给 Opus 或 Sonnet,Fable 只处理定义清晰的升级任务。
预算太低可能让 Fable 在最终验证前中断;没有任务边界的预算则可能资助无效循环。应以成功任务校准,并为正常波动保留余量。
常见问题
Claude Fable 5 API 价格是多少?
Anthropic 官方价为每百万 token 输入 $10.00、cache read $1.00、输出 $50.00。OmniaKey 当前分别是 $2.00、$0.20 和 $10.00,核对日期为 2026 年 8 月 12 日。
Claude Fable 5 的 API 模型 ID 是什么?
使用 claude-fable-5。固定准确 ID 比依赖可能变化的家族 alias 更容易复现实验和预算。
Fable 5 是否赠送 100 万 token?
不赠送。1M 是上下文容量,不是 token 额度。使用量仍按未缓存输入、缓存活动和输出计费。
Fable 5 一定比 Opus 5 好吗?
不一定。Fable 面向最难、最长的任务,token 单价是 Opus 的两倍。Opus 通常是更经济的起点;只有完成质量数据证明有必要时才升级 Fable。
Fable 5 能否用于 Claude Code?
可以,前提是当前供应商提供该模型。Claude Code 必须为 2.1.170 或更高版本;Anthropic 直连接入还可能受组织和 usage-credit 规则影响。
如果关注的是跨厂商模型选择而不是价格,请阅读 Claude Fable 5 和 GPT-5.6 Sol 编程对比。
已核对来源
- Anthropic:Claude Fable 5 与 Claude Mythos 5 介绍
- Anthropic API 定价
- Claude Code 模型配置
- OmniaKey Claude Fable 5 实时模型页
- OmniaKey API 快速开始
事实核对日期:2026 年 8 月 12 日。模型权限、平台费率、缓存行为与产品规则可能变化;确定生产采购前请核对上述第一方页面和实时目录。