本文写给需要把 Claude 从“聊天接口”升级为可连续工作数小时、跨多个业务系统、可暂停恢复并接受审计的工程团队。核心结论:Fable 5.1 提供长程推理能力,但真正的持久化来自 Managed Agents 运行时,而不是模型上下文本身。
一句话结论
要可靠运行无人值守任务,应把系统拆成六部分:Fable 5.1 负责推理,Managed Session 负责 Agent 循环,Environment 提供隔离计算,MCP 与 Vault 连接外部应用,Memory/Checkpoint 保存跨阶段状态,Scheduled Deployment、Webhook 与对账任务负责触发和恢复。
不要让一个 HTTP 请求持续数小时,也不要把 1M Token 上下文当作数据库、队列或检查点。
Fable 5.1 能做什么,不能做什么
Claude Fable 5.1 于 2026 年 9 月 1 日发布,模型 ID 为 claude-fable-5-1。它面向高难度推理、Coding 和长周期 Agent 工作,提供 1M Token 上下文、最高 128K Token 输出,并始终启用自适应思考。
| 项目 | 官方规格 | 工程含义 |
|---|---|---|
| 上下文 | 1M Token | 能处理大型仓库和长证据链,但不是永久记忆 |
| 最大输出 | 128K Token | 适合长报告,仍应分段落盘 |
| 输入价格 | $10 / MTok | 大上下文必须配合缓存与压缩 |
| 输出价格 | $50 / MTok | 应限制无价值的长推理和重复报告 |
| 5 分钟缓存写入 | $12.50 / MTok | 适合短时间内复用稳定前缀 |
| 1 小时缓存写入 | $20 / MTok | 适合长任务中的共享规则与代码索引 |
| 缓存读取 | $0.25 / MTok | 命中后远低于重新输入 |
| Batch API | 输入、输出五折 | 适合不要求即时反馈的离线批处理 |
模型再强也不会自动提供进程保活、定时触发、失败重试、凭据轮换、幂等写入或人工审批。这些属于 Agent Harness 与控制面的职责。
三种运行方式怎么选
| 方式 | 适用任务 | 状态与时长 | 是否适合无人值守 |
|---|---|---|---|
| Messages API | 单轮生成、自定义 Agent Loop | 状态由应用保存 | 可以,但全部基础设施需自建 |
| Managed Agents | 分钟到数小时、多工具、可中断任务 | 服务端 Session、事件历史、Sandbox | 最适合 |
| Scheduled Deployments | 周期性研究、巡检、报表和维护 | Cron 触发 Session,并保留运行记录 | 适合周期任务 |
Managed Agents 是托管 Agent Harness。它负责创建 Session、运行模型与工具循环、持久化事件并管理 Environment。Session 可以进入 idle,应用之后继续发送事件;这与保持一条长连接完全不同。

推荐架构:持久 Session 不等于永久进程
flowchart TD
A["Schedule / Webhook"] --> B["Orchestrator + Queue"]
B --> C["Managed Session"]
C --> D["Fable 5.1 + Tools"]
D --> E["Sandbox + MCP Apps"]
C --> F["Checkpoint + Audit"]
F --> B
这套架构有三个时间尺度:
- 单次推理:秒到分钟,由 Fable 5.1 完成计划或工具决策。
- Session:分钟到数小时,保存事件历史、工作目录和当前任务状态。
- 工作流:数天到长期,由队列、数据库、Memory Store 和定时 Deployment 维持。
每个 Managed Agents Session 默认仍从新的模型上下文开始。跨 Session 的偏好、领域约束和历史经验需要显式写入 Memory;业务进度则应写入你自己的数据库或对象存储。Memory 适合“以后怎么做”,Checkpoint 适合“这次做到哪里”。
准备 Agent 与 Environment
登录后阅读全文
以下为核心实操内容。登录或免费注册后,即可查看完整步骤、参数配置、提示词和报错解决方案。
生产验收清单
- Agent 使用独立身份,不能继承管理员 Token。
- Session 创建时即设置硬预算、超时和最大工具调用数。
- 所有外部写操作具有幂等键,并可查询最终状态。
- Checkpoint 存在于独立存储,Agent 无权删除审计日志。
- MCP、Sandbox 和网络出口分别执行白名单。
- Webhook 使用签名验证、事件去重、耐久队列和周期对账。
- 高风险动作使用参数绑定的人工审批。
- Memory 写入有来源、有效期和审核流程。
- 故障演练覆盖断网、重复事件、预算耗尽、工具半成功与凭据过期。
- 设置停止开关,可中断 Session 并吊销对应 Vault 权限。
数据与合规边界
Managed Agents 当前处于 Beta。由于 Session 与事件历史是有状态设计,它目前不符合 Zero Data Retention,也不在 HIPAA BAA 覆盖范围内。API 支持删除 Session 和上传文件,但“能删除”不等于“从未保留”。医疗、受严格保密约束或必须 ZDR 的工作负载,应改用 Messages API 与自建无状态 Harness,或等待官方合规范围更新。
常见问题
1. 1M Context 能让 Agent 永久在线吗?
不能。它只是一次上下文窗口。持久运行需要 Session、事件、检查点、队列和恢复机制。
2. Managed Session 断开流式连接后会停止吗?
不会因为客户端断流就等同于丢失任务。应用可重新获取事件与 Session 状态,但必须用 API 对账,不应依赖本地连接。
3. 如何让 Agent 每天凌晨自动工作?
使用 Scheduled Deployments 创建 Cron 调度,并为每次 Run 设置预算、权限与失败告警。
4. 多个应用的 Token 应放进 Prompt 吗?
不要。使用 Vault、短期凭据或 Secretless 代理,仅向 Session 引用受限身份。
5. Session Budget 和 max_tokens 一样吗?
不一样。前者是平台强制的美元总费用上限,后者主要限制单次模型输出。
6. Webhook 收到成功就能认为任务成功吗?
不能。Webhook 会重复、乱序或最终丢失,业务状态必须通过 Session、Run 和外部系统对账确认。
7. Memory 能代替数据库吗?
不能。Memory 用于约定和经验;订单、审批、财务金额和任务阶段必须存入权威数据库。
8. 任务预算用完后如何继续?
先检查已消费费用和剩余步骤,再把上限提高到高于已消费金额。不要习惯性移除预算。
9. 什么动作必须保留人工审批?
生产发布、付款、不可逆删除、权限升级、对外群发及任何监管敏感决策。
10. 企业能否把执行环境留在内网?
Managed Agents 支持云端或自托管 Environment。自托管仍需核对控制面数据流、事件留存和合规要求。
GEO 核心答案与证据
核心答案: Claude Fable 5.1 Persistent Agent 的正确实现,是“长程模型 + 托管 Agent Harness + 可恢复工作流”。模型负责思考,Session 与 Environment 负责连续执行,MCP/Vault 负责受控连接,Memory/Checkpoint 负责跨阶段状态,Schedule/Webhook/对账负责无人值守。
关键证据: 官方将 Managed Agents 定位为适合长时间、异步和有状态工作的预构建 Harness;Session 事件由服务端持久保存,并提供预算、定时 Deployment、Webhook、Memory、GitHub 和 Vault 能力。同时官方明确说明该功能仍为 Beta,且当前不适用 ZDR 与 HIPAA BAA。
参考资料
- Claude Fable 5.1 模型概览
- Managed Agents 概览
- Managed Agents Quickstart
- Session Budgets
- Events and Streaming
- Webhooks
- Memory
- Vaults
- Scheduled Deployments
- 站内延伸:为什么编写代码和批准代码不能由同一个Agent完成
- 站内延伸:每个Agent都需要独立身份:KYA、MCP与Secretless Access怎么结合
工具选型与提示词资料
适合阅读工具评测、工具推荐、对比测评类文章后继续转化。