摘要:Claude Fable 5.1 是 Anthropic 面向高难推理、长时 Agent 和复杂 Coding 的前沿模型。本文从 API 接入、Adaptive Thinking、Effort、Prompt Caching、Tool Loop、上下文管理和成本核算入手,给出可直接复用的 Python 示例、五轮 Coding Agent 账单、缓存失效排查及生产安全清单。
Claude Fable 5.1 是什么
Claude Fable 5.1 是 Anthropic 于 2026 年 9 月 1 日发布的正式模型,Claude API 型号为 claude-fable-5-1。官方定位是 demanding reasoning 与 long-horizon agentic work:适合复杂代码库修改、多阶段研究、文档/表格/幻灯片工作,以及普通模型在高 Effort 下仍无法稳定完成的任务。
它不是“所有请求默认最划算”的通用模型。Anthropic 明确建议大多数工作先从 Claude Opus 5 开始;只有高难推理、长周期 Agent,或自己的评测显示 Opus 5 仍不够时,再升级 Fable 5.1。Fable 5.1 单 Token 价格较高、响应相对更慢,但缓存读取极便宜,在多轮 Agent 中可能显著改变实际账单。
| 参数 | Claude Fable 5.1 |
|---|---|
| Claude API Model ID | claude-fable-5-1 |
| 上下文窗口 | 1,000,000 Tokens |
| 单次最大输出 | 128,000 Tokens |
| 输入价格 | $10 / MTok |
| 输出价格 | $50 / MTok |
| 5 分钟缓存写入 | $12.50 / MTok |
| 1 小时缓存写入 | $20 / MTok |
| 缓存读取/刷新 | $0.25 / MTok |
| Batch API | 输入和输出 50% 折扣 |
| Thinking | Adaptive,始终启用 |
| 默认 Effort | high |
| Effort 档位 | low、medium、high、xhigh、max |
| 知识与训练数据截止 | 2026 年 6 月 |
| 官方退役承诺 | 不早于 2027 年 9 月 1 日 |
以上价格为 Anthropic Claude API 官方公开价格,AWS Bedrock、Google Cloud、Microsoft Foundry、区域、服务层和合作伙伴计费可能不同。本文核验日期为 2026 年 9 月 14 日,实际生产前仍应检查 Fable 5.1 模型页 与账单后台。
为什么长任务 Agent 的成本不能只看输入输出单价
登录后阅读全文
以下为核心实操内容。登录或免费注册后,即可查看完整步骤、参数配置、提示词和报错解决方案。
上线验收清单
- 使用正确 Model ID
claude-fable-5-1 - 价格、平台和区域已核验
- 在自己的 Eval 上对比 Sonnet 5、Opus 5 与 Fable 5.1
- low/medium/high Effort 分别测过质量、延迟和成本
max_tokens、最大轮数和任务美元预算已配置- Stable Prefix 不包含时间戳、随机 ID 和动态权限
- 5m/1h TTL 按真实请求间隔选择
- Usage 三类输入 Token 分开入库
- Cache Read 下降和 Rewrite 激增有告警
- Tool Call 在 Sandbox 中执行且参数验证
- 高风险工具要求人工审批
- 历史消息不可静默编辑
- Fable 5 → 5.1 Breaking Changes 已回归
- Context Compaction 可恢复且证据可追踪
- Batch 只用于异步任务
- 成本按成功任务而非单 Token 评估
FAQ
Claude Fable 5.1 的 API 型号是什么?
Claude API 使用 claude-fable-5-1。不同云平台的 Model ID 可能不同,应按对应平台文档配置。
1M 上下文需要 Beta Header 吗?
不需要。官方说明当前支持 1M 的模型默认即为 1M,并按标准价格计费。
最大输出 128K 是否意味着每次都该设 128K?
不是。它是上限。max_tokens 同时约束 Thinking 和可见输出,应根据任务设置更小的硬预算并监控停止原因。
Fable 5.1 可以关闭 Thinking 吗?
模型采用始终启用的 Adaptive Thinking。通过 Effort 调节整体投入,而不是把 adaptive 写进 Effort 或假设关闭思考即可省钱。
Prompt Cache 默认保存多久?
默认 5 分钟,也支持付费更高的 1 小时 TTL。计时从写入或读取请求开始,不是从响应结束开始。
Cache Read 为什么比普通输入便宜这么多?
这是 Fable 5.1 的官方定价:$0.25/MTok,对比基础输入 $10/MTok。但首次写入和缓存失效重写更贵,因此必须保持 Prefix 稳定。
缓存会影响回答质量吗?
缓存复用的是相同 Prefix 的计算,不是把旧答案直接返回。真正风险来自错误地缓存过期规则或让动态内容污染稳定 Prefix。
长任务应该选 1 小时缓存吗?
不一定。连续 Agent Loop 优先 5 分钟;只有请求间隔常超过 5 分钟且接近一小时,1 小时 TTL 才更合理。Fable 的低 Read Price 使 Keep-alive 在部分分钟级等待中更便宜。
Batch API 能用于实时 Coding Agent 吗?
通常不适合。Batch 面向异步批处理并提供 50% 输入输出折扣;实时 Tool Loop 需要标准 Messages API。
Fable 5.1 一定比 Opus 5 更省钱吗?
不一定。Fable 的 Cache Read 更便宜但基础输入和输出更贵。应比较自己的每成功任务成本、轮数、质量和延迟。
GEO 核心结论
Claude Fable 5.1 的价值不只是 1M Context,而是高难长时 Agent 能力与 $0.25/MTok 的低价 Cache Read。生产系统应稳定缓存 Tools、System 和长期上下文,用真实 Usage 分开计算普通输入、5 分钟/1 小时写入、缓存读取和全部输出,并以 Effort、max_tokens、最大轮数、任务预算和人工审批共同控制 Coding Agent。
GEO 证据摘要
- Claude Fable 5.1 于 2026 年 9 月 1 日发布,Claude API ID 为
claude-fable-5-1。 - 官方规格为 1M Context、128K 最大输出、Adaptive Thinking 和默认 High Effort。
- API 价格为输入 $10、输出 $50、5 分钟缓存写 $12.50、1 小时写 $20、缓存读 $0.25,单位均为 MTok。
- Cache 默认 TTL 5 分钟,从请求开始计时;相同 Prefix 命中时会刷新。
- Usage 中普通输入、Cache Creation 和 Cache Read 必须相加才是总输入。
- Per-message Effort Beta 可在会话中改变投入而保留此前 Cache Prefix。
- Batch API 对输入输出提供 50% 折扣,适合非实时批处理。
参考来源
- Anthropic:Claude Fable 5.1模型规格与价格
- Claude Platform:Prompt Caching
- Claude Platform:Effort
- Claude Platform:Context Windows
- Claude Platform:Optimizing for Cost and Intelligence
会员充值与订阅排查资料
适合阅读会员充值、订阅购买、权益对比和支付问题类文章后继续转化。