DeepSeek V4 Flash 上线 · 我们的 GLM-5.2 价格本次下调至 5折
博客
指南

Claude Fable 5.1 是什么?

Claude Fable 5.1 是 Anthropic 面向长程 Agent 的新型号。本文解释它更新了什么、价格如何、和 Fable 5 有何区别,以及怎么接入。

13 分钟阅读OmniaKey
Claude Fable 5.1model reviewwhat's newAPI pricingClaude Code

**Claude Fable 5.1 是什么?**它是 Anthropic 面向长时间 Agent 编程、多步研究和知识工作的最新 Claude 型号。本文先解释它有哪些变化、是否值得从 Fable 5 升级,再给出 API 价格、缓存算例和接入注意事项。

先说结论:对最难、运行时间最长,而且会反复读取大段缓存前缀的任务,Fable 5.1 是有意义的更新;但它不该自动成为日常编码默认模型。Anthropic 仍建议多数任务先用 Opus 5,只有实际评测证明有必要时再升级到 Fable。

**事实核验于 2026 年 9 月 4 日。**发布日期、规格、价格和迁移行为来自 Anthropic 当前官方文档。本文没有运行独立受控 benchmark,因此能力提升均明确归因于 Anthropic。OmniaKey 当前已上架 claude-fable-5-1,网关价格仍以实时目录为准。

Claude Fable 5.1 是什么?

Claude Fable 5.1 是为长程任务设计的专业型号,适合多文件编码、长时间问题调查、需要反复检索的研究,以及文档、表格和幻灯片工作。它支持 1M token 上下文、最高 128K 输出 token,并且 adaptive thinking 始终开启

快速了解Claude Fable 5.1
发布日期2026 年 9 月 1 日
适合任务高难度长程 Agent、研究和知识工作
API 模型 IDclaude-fable-5-1
上下文 / 最大输出1M / 128K token
ThinkingAdaptive,始终开启;默认 effort 为 high
知识截止日期2026 年 6 月
Anthropic 基础价格每百万 token 输入 $10 / cache read $0.25 / 输出 $50

它是 Claude Fable 5 的后继版本,不是另一个 Claude Code 产品。Anthropic API 和合作云平台使用准确模型 ID claude-fable-5-1;OmniaKey 当前也已上架该路由,可在在线模型目录查看当前网关价格。

这是信息型评测,不是“所有 benchmark 都第一”的宣传。Anthropic 公开说明了长程编程、研究、视觉、电脑操作和办公文档能力的改进,但实际结果还取决于 Agent、工具、权限、prompt 和验收标准。

Claude Fable 5.1 有哪些新特性?

值得先记住的更新包括:

  • 基础输入、缓存写入和输出价格不变,但 cache read 更便宜;
  • Anthropic 描述长时间 Agent 编程、多步研究、视觉和电脑操作能力有所提升;
  • 支持 beta 版的逐消息 effort 调整和按轮次生效的 system message;
  • beta 版可在工具调用之间返回可读进度更新;
  • 生成文本和支持的媒体带有内容来源标记。

同时存在三个升级雷区:强制工具选择可能返回 400,旧版 Claude 无法读取 Fable 5.1 的 thinking block,修改会话前缀可能让后续 thinking block 失效。自己维护 Messages API 客户端时,这些兼容性比版本号更重要。

Claude Fable 5.1 API 价格

下表单位均为美元/百万 token(MTok)。

使用类型Anthropic 标准价含义
未缓存输入$10.00新 prompt、历史、文件或工具上下文
5m cache write$12.50把可缓存前缀保存 5 分钟
1h cache write$20.00把可缓存前缀保存 1 小时
Cache read$0.25读取供应商实际报告的缓存前缀
输出$50.00可见输出以及供应商计入输出的 thinking

Fable 5.1 的输入、cache write 和输出价格与 Fable 5 相同。真正的价格变化是 cache read:从 Fable 5 的 $1.00/MTok 降到 $0.25/MTok,也就是基础输入价格的 0.025 倍。

完整费用可以写成:

text
费用 = 未缓存输入百万数 × 10.00
     + 5m cache write 百万数 × 12.50
     + 1h cache write 百万数 × 20.00
     + cache read 百万数 × 0.25
     + 输出百万数 × 50.00

付费工具、税费、区域路由、重试和网关自己的计价规则可能产生其它账单行。不要只用最终可见回答的长度估算,应以 usage 字段对账。

Claude Fable 5.1 和 Fable 5 有什么区别

版本号容易让人误以为是全面降价。Fable 5.1 的核心变化是更低的缓存读取价格和 API/Agent 行为更新,输入与输出没有降价。

项目Claude Fable 5Claude Fable 5.1升级影响
基础输入$10/MTok$10/MTok不变
5m cache write$12.50/MTok$12.50/MTok不变
1h cache write$20/MTok$20/MTok不变
Cache read$1/MTok$0.25/MTok重复上下文更便宜
输出$50/MTok$50/MTok不变
上下文窗口1M1M容量不变
最大输出128K128K容量不变
强制 tool_choice支持 autononeany 或指定工具只支持 autononeany 和指定工具会返回 400
Thinking block 方向生成旧版 block能读旧 block;旧模型不能读 5.1 block降级模型时可能丢弃推理 block
会话中调整 effort请求级变化可能失去缓存复用支持逐消息调整(beta)困难轮次和常规轮次可用不同 effort
工具间进度沿用 Fable 5 的文本行为可返回可读更新 block(beta)UI 可展示进度而不暴露原始推理
内容来源旧版行为文本统计水印及部分媒体 C2PA无需修改请求格式

Anthropic 还把 Fable 5.1 描述为长时间 Agent 编程、多步研究、文档、表格、幻灯片、视觉和电脑操作能力的更新。这些是供应商定位,不是独立 benchmark;上线前应在自己的 Agent 和验收命令上测量。

Claude Fable 5.1 和 Opus 5 怎么选?

多数复杂编程和推理任务应先用 Claude Opus 5。Anthropic 标价是每百万 token 输入 $5、输出 $25,只有 Fable 5.1 基础价格的一半,先测试它更容易判断专业顶级档是否真的必要。

当 Opus 5 在合适 effort 下仍不能稳定通过验收、任务必须连续推进数小时,或 Agent 会在很多轮中反复读取同一个大前缀时,再测试 Fable 5.1。不要只因为版本更新就切换;应比较验收通过率、重试、延迟和人工修正时间。

三个 Fable 5.1 费用示例

以下算例只使用官方 token 分类,不包含付费工具、税费、重试和网关费用。

示例 1:第一次未缓存调查

假设使用 100 万未缓存输入 token,生成 10 万输出 token:

text
1 × $10.00 + 0.1 × $50.00 = $15.00

1M 上下文表示请求可以容纳很多内容,并不表示这 100 万输入 token 免费。

示例 2:5 分钟缓存前缀

假设 10 万 token 写入 5 分钟缓存,之后读取 50 万 cache read token,并生成 2 万输出 token:

text
0.1 × $12.50 + 0.5 × $0.25 + 0.02 × $50.00 = $2.375

首次写入仍然收费。只有供应商把 token 报告在对应 bucket 中,这个算式才成立。

示例 3:1 小时缓存前缀

假设 100 万 token 写入 1 小时缓存,之后读取 800 万 cache read token,并生成 50 万输出 token:

text
1 × $20.00 + 8 × $0.25 + 0.5 × $50.00 = $47.00

这里输出费用占主导。长上下文和始终开启的 adaptive thinking 都不等于低输出成本。

Prompt caching 什么时候划算

Fable 5.1 沿用 Fable 5 的缓存写入倍率:

  • 5 分钟 cache write 是基础输入价格的 1.25 倍;
  • 1 小时 cache write 是基础输入价格的 2 倍;
  • Fable 5.1 的 cache read 是基础输入价格的 0.025 倍;
  • 可缓存 prompt 的最小长度是 512 token。

重复前缀通常在第一次 5 分钟 cache read 后就开始回本。1 小时写入通常需要两次 cache read 才会优于每次都发送同样的未缓存前缀。这是算术上的 break-even,不是保证每个客户端都命中缓存。

把稳定的 system 指令、工具定义和大段参考资料放在可缓存前缀,把变化的任务细节放在后面。看起来相同的 prompt 不一定命中缓存;请检查响应中的 cache_read_input_tokenscache_creation_input_tokens

模型 ID 与 API 接入

为了让评测可以复现,请使用准确模型 ID:

平台模型 ID
Anthropic Claude APIclaude-fable-5-1
Amazon Bedrockanthropic.claude-fable-5-1
Google Cloudclaude-fable-5-1
Microsoft Foundryclaude-fable-5-1
Claude Platform on AWSclaude-fable-5-1

Claude Code 的 fable alias 会在账号和供应商支持时指向最新 Fable。需要稳定对比时,应在配置和日志中固定 claude-fable-5-1

OmniaKey 当前已通过自己的模型目录和计费边界提供 claude-fable-5-1。先在在线目录查看当前网关价格,再在API token 页面创建有限额 key,并通过本地化的 API 快速开始确认配置。

目录确认存在该路由后,Anthropic 兼容 smoke 请求可以这样写:

bash
curl https://api.omniakey.com/v1/messages \
  -H "x-api-key: $OMNIAKEY_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-fable-5-1",
    "max_tokens": 1024,
    "messages": [
      {"role": "user", "content": "找出这份迁移计划中风险最高的假设。"}
    ]
  }'

如果模型发现接口暂时没有这个 ID,应停止请求并检查服务状态。网关应该返回不可用错误,而不是悄悄替换模型。

从 Claude Fable 5 升级

模型名只改一行,但下面几个 API 模式必须重新检查。

1. 更换模型 ID

python
model = "claude-fable-5"    # 升级前
model = "claude-fable-5-1"  # 升级后

2. 保持 adaptive thinking

Fable 5.1 只能使用 adaptive thinking。下面两种配置会返回 400:

json
{"type": "disabled"}
{"type": "enabled", "budget_tokens": 16000}

省略 thinking,或发送 {"type": "adaptive"}。用 effort 在推理深度、延迟和 token 用量之间取舍。默认值是 high;应在自己的验收任务上比较 mediumhighxhighmax

3. 替换强制工具选择

Fable 5.1 不支持 tool_choice{"type": "any"}{"type": "tool", "name": "..."},会返回 400 invalid_request_error

改用 auto,并在当前指令中说明要调用哪个工具。需要结构化参数时,使用 strict tool 或 structured outputs:

json
{
  "tool_choice": {"type": "auto"},
  "tools": [
    {
      "name": "record_summary",
      "strict": true,
      "input_schema": {
        "type": "object",
        "properties": {"summary": {"type": "string"}},
        "required": ["summary"],
        "additionalProperties": false
      }
    }
  ]
}

如果应用要求当前轮必须调用某个工具,添加一条会话中的 system message,不要重建顶层 prompt,也不要再强制 tool_choice

4. 保留 thinking block 和历史前缀

Fable 5.1 可以读取早期 Claude 模型生成的 thinking block,但旧模型不能读取 Fable 5.1 的 block。路由或 fallback 切换模型时可能丢弃这些 block,这是模型绑定行为,不代表原推理状态被完整延续。

如果客户端自己组装 messages,请让历史只追加、不改写。修改旧 user turn、重建 systemtools、改变图片/文档字节,或从中间删除 turn,都可能让后续 thinking block 失效并触发 400。应使用服务端 compaction/context editing,或者在有意创建新的客户端摘要时去掉旧 thinking block。

Claude Code 和 Claude Agent SDK 会管理其中一部分历史细节。自定义客户端上线前,应使用 Anthropic 的 thinking-binding-controls-2026-08-01 beta header 测试,并记录 input_transformations

5. 重新测试 refusal 和 fallback

Fable 5.1 可能返回 HTTP 200、stop_reason: "refusal"stop_details。这不是有效文本,也不是传输失败。配置有界 fallback 到批准的 Claude 模型,或交给人工处理;不要使用无限重试。

6. 检查客户端版本

OmniaKey 的兼容路径目前使用不低于 Fable 5.1 客户端门槛的 Claude Code 身份,即 2.1.251。如果模型选择器看不到 Fable 5.1,或请求还没到供应商就被拒绝,请先升级客户端并检查 base URL。客户端升级不会自动授予 Anthropic 组织权限,网关也有自己的可用性列表。

常见 Fable 5.1 报错

tool_choice 返回 HTTP 400

删除 any 和命名 tool 选择,保留 auto,在指令中明确要求,并用 strict tool 或 structured outputs 控制 schema。

thinking 返回 HTTP 400

删除手动 enabled/disabled 配置。Fable 5.1 只支持 adaptive thinking。需要省钱时降低 effort 或缩小任务范围。

Invalid signatureblock is bound to a different conversation

thinking block 之前的内容发生了变化。恢复完全相同的 system、tools 和消息前缀,或者不带旧 block 开始新会话。不要反复重试同一个无效请求体。

Unknown model

使用 claude-fable-5-1,不要使用显示名称或旧 alias。检查当前供应商是否支持它;在 OmniaKey 上先查实时目录和 base URL。

账单高于可见回答

分别检查未缓存输入、5m/1h cache write、cache read、thinking 计入的输出、工具、重试、税费和路由倍率。可见文字不是完整 usage 报告。

数据保留政策不允许使用 Fable 5.1

Anthropic 为 Fable 5.1 说明了 30 天数据保留,并表示 zero data retention 需要明确授权。发送敏感源码前,检查准确 provider 和网关的政策。

Claude Fable 5.1 值得升级吗?

任务异常漫长、含糊、工具密集,或者走错一步后修复成本很高时,值得测试 Fable 5.1。稳定的大前缀在多轮复用时更能体现低 cache read 价格的价值。但它不是日常编码的自动默认选择:基础输入和输出价格仍然与 Fable 5 相同。

普通任务如果 Claude Opus 5 或 Sonnet 已经能通过同一验收标准,先使用更低成本的型号。当前路由可查看 Claude Fable 5.1 模型页,对比上一版本时再看 Fable 5 模型页Claude Code 模型选择指南负责系列路由,现有的 Fable 5 价格指南负责旧版价格和接入;跨厂商选择则阅读 Fable 5 与 GPT-5.6 Sol 对比

真正应比较的是验收任务成本:

text
验收任务成本 = 成功调用费用
             + 失败重试费用
             + 人工修正时间
             + 缺陷补救风险

固定同一个仓库 commit、prompt、工具、权限、effort 和验收命令,再比较不同模型。模型名称不是 benchmark 结果。

常见问题

Claude Fable 5.1 是什么?

Claude Fable 5.1 是 Anthropic 面向长程 Agent 编程、研究和知识工作的最新 Claude 型号,支持 1M token 上下文、128K 最大输出和始终开启的 adaptive thinking。

Claude Fable 5.1 相比 Fable 5 更新了什么?

输入、cache write 和输出价格不变,但 cache read 降至 $0.25/MTok。它还加入 beta 版 effort 与进度控制,同时强制工具选择和部分会话历史修改可能返回 400 错误。

Claude Fable 5.1 API 多少钱?

Anthropic 官方价为每百万输入 $10.00、5 分钟 cache write $12.50、1 小时 cache write $20.00、cache read $0.25、输出 $50.00。OmniaKey 网关费率若已上架,以实时目录为准。

Claude Fable 5.1 的 API 模型 ID 是什么?

Anthropic API、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS 使用 claude-fable-5-1;Amazon Bedrock 使用 anthropic.claude-fable-5-1

Fable 5.1 比 Fable 5 便宜吗?

输入、cache write 和输出价格不变。cache read 从 Fable 5 的 $1/MTok 降到 Fable 5.1 的 $0.25/MTok。完整任务成本仍取决于 token 比例、重试、工具和验收通过率。

1M 上下文包含免费 token 吗?

不包含。1M 是请求容量;放入窗口的 token 仍按输入、cache write、cache read 或输出计费。

Fable 5.1 可以强制调用工具吗?

不可以。tool_choiceany 和命名 tool 会返回 400。保留 auto,在指令中说明要求,并使用 strict tool 或 structured outputs。

可以关闭 Fable 5.1 的 thinking 吗?

不可以。adaptive thinking 始终开启。用 effort 和经过测量的 max_tokens 控制取舍。

Claude Code 能用 Fable 5.1 吗?

当当前供应商暴露该模型且客户端版本支持时可以。OmniaKey 兼容路径使用不低于 2.1.251 的 Claude Code 身份;升级旧客户端后,还要检查实际供应商目录。

OmniaKey 已经提供 Fable 5.1 了吗?

已经提供。OmniaKey 当前已上架 claude-fable-5-1;请在实时模型目录查看当前可用性和网关价格。

Fable 5.1 适合 zero data retention 场景吗?

Anthropic 文档说明它要求 30 天保留,zero-data-retention 需要明确授权。发送敏感数据前,确认准确 provider 和 route 的政策。

核验来源

事实核验于 2026 年 9 月 4 日。供应商费率、alias、模型可用性、缓存行为、数据条款和网关规则都可能变化。投入生产流量或预算前,请重新检查官方文档和实时目录。