Claude Fable 5.1:编程能力、长任务与缓存费用
查看 Fable 5.1 的官方能力、Agent 评测、保护机制与缓存读取价格,说明长会话费用的计算边界。
本页内容
Claude Fable 5.1 面向跨代码库开发、知识工作和长时间 Agent 任务。API 标准输入 / 输出为每百万 Tokens $10 / $50,缓存读取为 $0.25。重复上下文较多时,缓存能降低输入费用,但不能代替对修改质量和人工检查时间的记录。
2026 年 9 月,Fable 5.1 处在什么位置?
Artificial Analysis Intelligence Index v4.3 中,Claude Fable 5.1 最高配置得分 53,与 GPT-6 Astra 并列这一版 Index 的第一。Anthropic 自己则把 Fable 5.1 定位为当前最强的通用可用模型,主攻 Coding、知识工作和长时间问题求解。
综合指数不能反映每个子任务的表现。长任务中还需检查计划是否持续有效、失败是否被识别,以及最终修改是否满足验收要求。
本节来源:Artificial Analysis — Intelligence Index v4.3 · Anthropic — Claude Fable 5.1
长任务中的工具调用与失败恢复
Anthropic 明确把 Fable 5.1 用在可以持续数小时、跨多个应用的任务:先规划,再调用工具,步骤失败后恢复,并持续汇报进度。Agent 真正难的地方就在这里——前面一个小错误如果没有被发现,几十步以后可能把整条轨迹都带偏。
Anthropic 发布页里的客户案例包括连续多天做原型、长时间无人值守 Coding、定位多年未解决的罕见崩溃等。这些案例不是标准化 Benchmark,但很好地说明了模型优化方向。
跨代码库修改与视觉检查
Fable 5.1 面向跨代码库功能、Code Review、性能优化和长时间自主开发。Anthropic 表示它可以自己写测试来验证工作、根据设计高保真实现界面,还能用 Vision 检查结果是否符合目标。
验收此类任务时,应检查跨文件接口、测试覆盖和实际页面,而不只看生成函数是否正确。模型自行生成的测试也需要复核,避免实现和测试同时误解需求。
标准输入、输出与缓存读取价格
Anthropic 当前 Fable 5.1 API 定价是输入 $10 / 1M Tokens、输出 $50 / 1M,Cache Read 为 $0.25 / 1M。Anthropic 估算新的缓存价格能让典型工作负载成本下降约 25%,高度 Agent 化的工作负载最多可下降约 45%。
| API 项目 | Claude Fable 5.1 |
|---|---|
| 输入 / 1M | $10.00 |
| 输出 / 1M | $50.00 |
| 缓存读取 / 1M | $0.25 |
| 核心定位 | 高难 Coding、知识工作、长时间 Agent |
保护机制与模型回退
Anthropic 明确说明 Fable 5.1 的评测开启了生产环境 Safeguards。部分网络安全和生物相关请求可能被阻止,或者自动路由到其他 Claude 模型,Anthropic 也承认这会降低某些 Benchmark 中 Fable 5.1 的表现。
这说明“线上真正能调用到的模型”与“裸研究 Checkpoint”不一定完全相同。如果你的实际业务处在受保护领域,就应该测试你真正使用的生产 API,而不是只看发布会柱状图。
按实际检查工时判断费用
当一个长任务需要大量人工监督时,Fable 5.1 更容易体现价值,例如大型重构、深度 Code Review、研究综合、跨多个应用的复杂工作流。只要它能减少高成本的人类复核时间,贵一些的 Token 也可能是划算的。
批量任务还可比较 DeepSeek V4.1 Flash 或 Gemini Flash。统计所有尝试的费用与人工修复时间,再除以已验收任务数;不能预先假定便宜模型一定多返工。
本节来源:Anthropic — Claude Fable 5.1 · DeepSeek API — Models & Pricing · Google DeepMind — Gemini 3.8 Flash model card
Artificial Analysis — Intelligence Index v4.3 · Anthropic — Claude Fable 5.1 · DeepSeek API — Models & Pricing · Google DeepMind — Gemini 3.8 Flash model card