Claude Fable 5.1 是什么?
Claude Fable 5.1 是 Anthropic 面向长程 Agent 的新型号。本文解释它更新了什么、价格如何、和 Fable 5 有何区别,以及怎么接入。
**Claude Fable 5.1 是什么?**它是 Anthropic 面向长时间 Agent 编程、多步研究和知识工作的最新 Claude 型号。本文先解释它有哪些变化、是否值得从 Fable 5 升级,再给出 API 价格、缓存算例和接入注意事项。
先说结论:对最难、运行时间最长,而且会反复读取大段缓存前缀的任务,Fable 5.1 是有意义的更新;但它不该自动成为日常编码默认模型。Anthropic 仍建议多数任务先用 Opus 5,只有实际评测证明有必要时再升级到 Fable。
**事实核验于 2026 年 9 月 4 日。**发布日期、规格、价格和迁移行为来自 Anthropic 当前官方文档。本文没有运行独立受控 benchmark,因此能力提升均明确归因于 Anthropic。OmniaKey 当前已上架 claude-fable-5-1,网关价格仍以实时目录为准。
Claude Fable 5.1 是什么?
Claude Fable 5.1 是为长程任务设计的专业型号,适合多文件编码、长时间问题调查、需要反复检索的研究,以及文档、表格和幻灯片工作。它支持 1M token 上下文、最高 128K 输出 token,并且 adaptive thinking 始终开启。
| 快速了解 | Claude Fable 5.1 |
|---|---|
| 发布日期 | 2026 年 9 月 1 日 |
| 适合任务 | 高难度长程 Agent、研究和知识工作 |
| API 模型 ID | claude-fable-5-1 |
| 上下文 / 最大输出 | 1M / 128K token |
| Thinking | Adaptive,始终开启;默认 effort 为 high |
| 知识截止日期 | 2026 年 6 月 |
| Anthropic 基础价格 | 每百万 token 输入 $10 / cache read $0.25 / 输出 $50 |
它是 Claude Fable 5 的后继版本,不是另一个 Claude Code 产品。Anthropic API 和合作云平台使用准确模型 ID claude-fable-5-1;OmniaKey 当前也已上架该路由,可在在线模型目录查看当前网关价格。
这是信息型评测,不是“所有 benchmark 都第一”的宣传。Anthropic 公开说明了长程编程、研究、视觉、电脑操作和办公文档能力的改进,但实际结果还取决于 Agent、工具、权限、prompt 和验收标准。
Claude Fable 5.1 有哪些新特性?
值得先记住的更新包括:
- 基础输入、缓存写入和输出价格不变,但 cache read 更便宜;
- Anthropic 描述长时间 Agent 编程、多步研究、视觉和电脑操作能力有所提升;
- 支持 beta 版的逐消息
effort调整和按轮次生效的 system message; - beta 版可在工具调用之间返回可读进度更新;
- 生成文本和支持的媒体带有内容来源标记。
同时存在三个升级雷区:强制工具选择可能返回 400,旧版 Claude 无法读取 Fable 5.1 的 thinking block,修改会话前缀可能让后续 thinking block 失效。自己维护 Messages API 客户端时,这些兼容性比版本号更重要。
Claude Fable 5.1 API 价格
下表单位均为美元/百万 token(MTok)。
| 使用类型 | Anthropic 标准价 | 含义 |
|---|---|---|
| 未缓存输入 | $10.00 | 新 prompt、历史、文件或工具上下文 |
| 5m cache write | $12.50 | 把可缓存前缀保存 5 分钟 |
| 1h cache write | $20.00 | 把可缓存前缀保存 1 小时 |
| Cache read | $0.25 | 读取供应商实际报告的缓存前缀 |
| 输出 | $50.00 | 可见输出以及供应商计入输出的 thinking |
Fable 5.1 的输入、cache write 和输出价格与 Fable 5 相同。真正的价格变化是 cache read:从 Fable 5 的 $1.00/MTok 降到 $0.25/MTok,也就是基础输入价格的 0.025 倍。
完整费用可以写成:
费用 = 未缓存输入百万数 × 10.00
+ 5m cache write 百万数 × 12.50
+ 1h cache write 百万数 × 20.00
+ cache read 百万数 × 0.25
+ 输出百万数 × 50.00
付费工具、税费、区域路由、重试和网关自己的计价规则可能产生其它账单行。不要只用最终可见回答的长度估算,应以 usage 字段对账。
Claude Fable 5.1 和 Fable 5 有什么区别
版本号容易让人误以为是全面降价。Fable 5.1 的核心变化是更低的缓存读取价格和 API/Agent 行为更新,输入与输出没有降价。
| 项目 | Claude Fable 5 | Claude Fable 5.1 | 升级影响 |
|---|---|---|---|
| 基础输入 | $10/MTok | $10/MTok | 不变 |
| 5m cache write | $12.50/MTok | $12.50/MTok | 不变 |
| 1h cache write | $20/MTok | $20/MTok | 不变 |
| Cache read | $1/MTok | $0.25/MTok | 重复上下文更便宜 |
| 输出 | $50/MTok | $50/MTok | 不变 |
| 上下文窗口 | 1M | 1M | 容量不变 |
| 最大输出 | 128K | 128K | 容量不变 |
强制 tool_choice | 支持 auto、none、any 或指定工具 | 只支持 auto 或 none | any 和指定工具会返回 400 |
| Thinking block 方向 | 生成旧版 block | 能读旧 block;旧模型不能读 5.1 block | 降级模型时可能丢弃推理 block |
| 会话中调整 effort | 请求级变化可能失去缓存复用 | 支持逐消息调整(beta) | 困难轮次和常规轮次可用不同 effort |
| 工具间进度 | 沿用 Fable 5 的文本行为 | 可返回可读更新 block(beta) | UI 可展示进度而不暴露原始推理 |
| 内容来源 | 旧版行为 | 文本统计水印及部分媒体 C2PA | 无需修改请求格式 |
Anthropic 还把 Fable 5.1 描述为长时间 Agent 编程、多步研究、文档、表格、幻灯片、视觉和电脑操作能力的更新。这些是供应商定位,不是独立 benchmark;上线前应在自己的 Agent 和验收命令上测量。
Claude Fable 5.1 和 Opus 5 怎么选?
多数复杂编程和推理任务应先用 Claude Opus 5。Anthropic 标价是每百万 token 输入 $5、输出 $25,只有 Fable 5.1 基础价格的一半,先测试它更容易判断专业顶级档是否真的必要。
当 Opus 5 在合适 effort 下仍不能稳定通过验收、任务必须连续推进数小时,或 Agent 会在很多轮中反复读取同一个大前缀时,再测试 Fable 5.1。不要只因为版本更新就切换;应比较验收通过率、重试、延迟和人工修正时间。
三个 Fable 5.1 费用示例
以下算例只使用官方 token 分类,不包含付费工具、税费、重试和网关费用。
示例 1:第一次未缓存调查
假设使用 100 万未缓存输入 token,生成 10 万输出 token:
1 × $10.00 + 0.1 × $50.00 = $15.00
1M 上下文表示请求可以容纳很多内容,并不表示这 100 万输入 token 免费。
示例 2:5 分钟缓存前缀
假设 10 万 token 写入 5 分钟缓存,之后读取 50 万 cache read token,并生成 2 万输出 token:
0.1 × $12.50 + 0.5 × $0.25 + 0.02 × $50.00 = $2.375
首次写入仍然收费。只有供应商把 token 报告在对应 bucket 中,这个算式才成立。
示例 3:1 小时缓存前缀
假设 100 万 token 写入 1 小时缓存,之后读取 800 万 cache read token,并生成 50 万输出 token:
1 × $20.00 + 8 × $0.25 + 0.5 × $50.00 = $47.00
这里输出费用占主导。长上下文和始终开启的 adaptive thinking 都不等于低输出成本。
Prompt caching 什么时候划算
Fable 5.1 沿用 Fable 5 的缓存写入倍率:
- 5 分钟 cache write 是基础输入价格的 1.25 倍;
- 1 小时 cache write 是基础输入价格的 2 倍;
- Fable 5.1 的 cache read 是基础输入价格的 0.025 倍;
- 可缓存 prompt 的最小长度是 512 token。
重复前缀通常在第一次 5 分钟 cache read 后就开始回本。1 小时写入通常需要两次 cache read 才会优于每次都发送同样的未缓存前缀。这是算术上的 break-even,不是保证每个客户端都命中缓存。
把稳定的 system 指令、工具定义和大段参考资料放在可缓存前缀,把变化的任务细节放在后面。看起来相同的 prompt 不一定命中缓存;请检查响应中的 cache_read_input_tokens 和 cache_creation_input_tokens。
模型 ID 与 API 接入
为了让评测可以复现,请使用准确模型 ID:
| 平台 | 模型 ID |
|---|---|
| Anthropic Claude API | claude-fable-5-1 |
| Amazon Bedrock | anthropic.claude-fable-5-1 |
| Google Cloud | claude-fable-5-1 |
| Microsoft Foundry | claude-fable-5-1 |
| Claude Platform on AWS | claude-fable-5-1 |
Claude Code 的 fable alias 会在账号和供应商支持时指向最新 Fable。需要稳定对比时,应在配置和日志中固定 claude-fable-5-1。
OmniaKey 当前已通过自己的模型目录和计费边界提供 claude-fable-5-1。先在在线目录查看当前网关价格,再在API token 页面创建有限额 key,并通过本地化的 API 快速开始确认配置。
目录确认存在该路由后,Anthropic 兼容 smoke 请求可以这样写:
curl https://api.omniakey.com/v1/messages \
-H "x-api-key: $OMNIAKEY_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-fable-5-1",
"max_tokens": 1024,
"messages": [
{"role": "user", "content": "找出这份迁移计划中风险最高的假设。"}
]
}'
如果模型发现接口暂时没有这个 ID,应停止请求并检查服务状态。网关应该返回不可用错误,而不是悄悄替换模型。
从 Claude Fable 5 升级
模型名只改一行,但下面几个 API 模式必须重新检查。
1. 更换模型 ID
model = "claude-fable-5" # 升级前
model = "claude-fable-5-1" # 升级后
2. 保持 adaptive thinking
Fable 5.1 只能使用 adaptive thinking。下面两种配置会返回 400:
{"type": "disabled"}
{"type": "enabled", "budget_tokens": 16000}
省略 thinking,或发送 {"type": "adaptive"}。用 effort 在推理深度、延迟和 token 用量之间取舍。默认值是 high;应在自己的验收任务上比较 medium、high、xhigh 和 max。
3. 替换强制工具选择
Fable 5.1 不支持 tool_choice 的 {"type": "any"} 或 {"type": "tool", "name": "..."},会返回 400 invalid_request_error。
改用 auto,并在当前指令中说明要调用哪个工具。需要结构化参数时,使用 strict tool 或 structured outputs:
{
"tool_choice": {"type": "auto"},
"tools": [
{
"name": "record_summary",
"strict": true,
"input_schema": {
"type": "object",
"properties": {"summary": {"type": "string"}},
"required": ["summary"],
"additionalProperties": false
}
}
]
}
如果应用要求当前轮必须调用某个工具,添加一条会话中的 system message,不要重建顶层 prompt,也不要再强制 tool_choice。
4. 保留 thinking block 和历史前缀
Fable 5.1 可以读取早期 Claude 模型生成的 thinking block,但旧模型不能读取 Fable 5.1 的 block。路由或 fallback 切换模型时可能丢弃这些 block,这是模型绑定行为,不代表原推理状态被完整延续。
如果客户端自己组装 messages,请让历史只追加、不改写。修改旧 user turn、重建 system 或 tools、改变图片/文档字节,或从中间删除 turn,都可能让后续 thinking block 失效并触发 400。应使用服务端 compaction/context editing,或者在有意创建新的客户端摘要时去掉旧 thinking block。
Claude Code 和 Claude Agent SDK 会管理其中一部分历史细节。自定义客户端上线前,应使用 Anthropic 的 thinking-binding-controls-2026-08-01 beta header 测试,并记录 input_transformations。
5. 重新测试 refusal 和 fallback
Fable 5.1 可能返回 HTTP 200、stop_reason: "refusal" 和 stop_details。这不是有效文本,也不是传输失败。配置有界 fallback 到批准的 Claude 模型,或交给人工处理;不要使用无限重试。
6. 检查客户端版本
OmniaKey 的兼容路径目前使用不低于 Fable 5.1 客户端门槛的 Claude Code 身份,即 2.1.251。如果模型选择器看不到 Fable 5.1,或请求还没到供应商就被拒绝,请先升级客户端并检查 base URL。客户端升级不会自动授予 Anthropic 组织权限,网关也有自己的可用性列表。
常见 Fable 5.1 报错
tool_choice 返回 HTTP 400
删除 any 和命名 tool 选择,保留 auto,在指令中明确要求,并用 strict tool 或 structured outputs 控制 schema。
thinking 返回 HTTP 400
删除手动 enabled/disabled 配置。Fable 5.1 只支持 adaptive thinking。需要省钱时降低 effort 或缩小任务范围。
Invalid signature 或 block is bound to a different conversation
thinking block 之前的内容发生了变化。恢复完全相同的 system、tools 和消息前缀,或者不带旧 block 开始新会话。不要反复重试同一个无效请求体。
Unknown model
使用 claude-fable-5-1,不要使用显示名称或旧 alias。检查当前供应商是否支持它;在 OmniaKey 上先查实时目录和 base URL。
账单高于可见回答
分别检查未缓存输入、5m/1h cache write、cache read、thinking 计入的输出、工具、重试、税费和路由倍率。可见文字不是完整 usage 报告。
数据保留政策不允许使用 Fable 5.1
Anthropic 为 Fable 5.1 说明了 30 天数据保留,并表示 zero data retention 需要明确授权。发送敏感源码前,检查准确 provider 和网关的政策。
Claude Fable 5.1 值得升级吗?
任务异常漫长、含糊、工具密集,或者走错一步后修复成本很高时,值得测试 Fable 5.1。稳定的大前缀在多轮复用时更能体现低 cache read 价格的价值。但它不是日常编码的自动默认选择:基础输入和输出价格仍然与 Fable 5 相同。
普通任务如果 Claude Opus 5 或 Sonnet 已经能通过同一验收标准,先使用更低成本的型号。当前路由可查看 Claude Fable 5.1 模型页,对比上一版本时再看 Fable 5 模型页。Claude Code 模型选择指南负责系列路由,现有的 Fable 5 价格指南负责旧版价格和接入;跨厂商选择则阅读 Fable 5 与 GPT-5.6 Sol 对比。
真正应比较的是验收任务成本:
验收任务成本 = 成功调用费用
+ 失败重试费用
+ 人工修正时间
+ 缺陷补救风险
固定同一个仓库 commit、prompt、工具、权限、effort 和验收命令,再比较不同模型。模型名称不是 benchmark 结果。
常见问题
Claude Fable 5.1 是什么?
Claude Fable 5.1 是 Anthropic 面向长程 Agent 编程、研究和知识工作的最新 Claude 型号,支持 1M token 上下文、128K 最大输出和始终开启的 adaptive thinking。
Claude Fable 5.1 相比 Fable 5 更新了什么?
输入、cache write 和输出价格不变,但 cache read 降至 $0.25/MTok。它还加入 beta 版 effort 与进度控制,同时强制工具选择和部分会话历史修改可能返回 400 错误。
Claude Fable 5.1 API 多少钱?
Anthropic 官方价为每百万输入 $10.00、5 分钟 cache write $12.50、1 小时 cache write $20.00、cache read $0.25、输出 $50.00。OmniaKey 网关费率若已上架,以实时目录为准。
Claude Fable 5.1 的 API 模型 ID 是什么?
Anthropic API、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS 使用 claude-fable-5-1;Amazon Bedrock 使用 anthropic.claude-fable-5-1。
Fable 5.1 比 Fable 5 便宜吗?
输入、cache write 和输出价格不变。cache read 从 Fable 5 的 $1/MTok 降到 Fable 5.1 的 $0.25/MTok。完整任务成本仍取决于 token 比例、重试、工具和验收通过率。
1M 上下文包含免费 token 吗?
不包含。1M 是请求容量;放入窗口的 token 仍按输入、cache write、cache read 或输出计费。
Fable 5.1 可以强制调用工具吗?
不可以。tool_choice 的 any 和命名 tool 会返回 400。保留 auto,在指令中说明要求,并使用 strict tool 或 structured outputs。
可以关闭 Fable 5.1 的 thinking 吗?
不可以。adaptive thinking 始终开启。用 effort 和经过测量的 max_tokens 控制取舍。
Claude Code 能用 Fable 5.1 吗?
当当前供应商暴露该模型且客户端版本支持时可以。OmniaKey 兼容路径使用不低于 2.1.251 的 Claude Code 身份;升级旧客户端后,还要检查实际供应商目录。
OmniaKey 已经提供 Fable 5.1 了吗?
已经提供。OmniaKey 当前已上架 claude-fable-5-1;请在实时模型目录查看当前可用性和网关价格。
Fable 5.1 适合 zero data retention 场景吗?
Anthropic 文档说明它要求 30 天保留,zero-data-retention 需要明确授权。发送敏感数据前,确认准确 provider 和 route 的政策。
核验来源
- Anthropic:Claude Fable 5.1 概览
- Anthropic:Claude Fable 5.1 新变化
- Anthropic:迁移到 Claude Fable 5.1
- Anthropic API 价格
- Claude Code 模型配置
- OmniaKey 在线模型目录
- OmniaKey API 快速开始
事实核验于 2026 年 9 月 4 日。供应商费率、alias、模型可用性、缓存行为、数据条款和网关规则都可能变化。投入生产流量或预算前,请重新检查官方文档和实时目录。