Anthropic 发布 Claude Fable 5.1:百万 token 上下文面向长程 Agent,缓存读取价格降至四分之一
Anthropic 在开发者文档中公布 Claude Fable 5.1 于 2026-09-01 发布,面向长时间运行的 Agent 编程与复杂多步骤任务,保留 100 万 token 上下文并默认开启自适应思考。基础输入/输出单价不变,但缓存读取价格降至四分之一;迁移则涉及工具调用、思考区块兼容和历史编辑等工程风险。
Anthropic 在开发者文档中公布 Claude Fable 5.1 于 2026-09-01 发布,面向长时间运行的 Agent 编程与复杂多步骤任务,保留 100 万 token 上下文并默认开启自适应思考。基础输入/输出单价不变,但缓存读取价格降至四分之一;迁移则涉及工具调用、思考区块兼容和历史编辑等工程风险。
Anthropic 的 Claude Platform 开发者文档显示,Claude Fable 5.1 已于 2026 年 9 月 1 日发布,面向高难度推理、长时间运行的 Agent 编程、多步骤研究,以及文档、表格和幻灯片处理。与它同时出现的 Claude Mythos 5.1 规格和价格相同,但目前仅向 Project Glasswing 的获邀参与者开放,并非面向公众全面上线。
这是 Anthropic 首次在开发者文档中明确列出 Fable 5.1 的发布日期、模型 ID、平台范围和迁移要求。与此前主要依靠 Bloomberg、9to5Mac 等媒体线索不同,此次信息来自 Claude Fable 5.1 官方模型文档 以及配套的 版本变化说明。
规格保持不变,重点转向长时间任务
Fable 5.1 的上下文窗口为 100 万 token,最大输出为 12.8 万 token。文档将它定位为更适合长程 Agent 编程、跨多步骤研究和复杂知识工作的模型;Anthropic 同时建议,普通工作负载可以优先考虑价格更低的 Claude Opus 5,只有在更高 effort 下仍无法满足评测要求时,再使用 Fable 5.1。
Fable 5.1 默认始终启用自适应思考,开发者可以通过 effort 参数控制思考深度。官方模型 ID 为 claude-fable-5-1,可通过 Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud 和 Microsoft Foundry 使用。
模型文档列出的生命周期信息显示,Fable 5.1 目前处于 Active 状态,退休时间“不早于 2027 年 9 月 1 日”。这代表的是最低承诺日期,而不是已经确定的下线时间。
基础单价不变,缓存读取成本大幅下降
Fable 5.1 的输入价格仍为每百万 token 10 美元,输出价格为每百万 token 50 美元,与 Fable 5 相同。变化最大的是缓存读取:价格降至每百万 token 0.25 美元,即此前价格的四分之一。
对于反复读取长上下文的 Agent,会话缓存可能比单次请求的输入量更能影响总成本。Anthropic 因此把价格变化与长时间运行的编码和研究任务联系起来。不过,实际节省幅度仍取决于缓存命中率、会话长度、输出规模以及工具调用次数,不能简单等同于所有应用的成本下降比例。
批量 API 的输入和输出价格另有 50% 折扣。官方文档还列出 5 分钟和 1 小时缓存写入价格分别为每百万 token 12.50 美元和 20 美元;这些写入价格并未随缓存读取价格一同调整。
工具调用和思考区块带来迁移风险
Fable 5.1 并不只是一次模型名称替换。Anthropic 的迁移说明列出了几项可能影响现有应用的兼容性变化。
首先,模型不支持强制工具调用。将 tool_choice 设置为 {"type":"any"},或指定某个工具,都会返回 400 错误;开发者需要使用默认的 auto,并通过提示词说明何时应调用工具,或改用严格工具调用和结构化输出来约束结果。
其次,旧模型不能读取 Fable 5.1 生成的 thinking blocks。相反,Fable 5.1 可以读取较早模型留下的思考区块。开发者如果在模型切换时保留对话历史,需要确认推理区块的方向性兼容。
第三,编辑思考区块之前的系统提示、工具列表或历史消息,可能导致后续请求报错,或者使思考区块被丢弃。官方建议把长会话视为追加式历史,使用按回合生效的系统消息处理临时提醒,并通过服务端上下文编辑或压缩来裁剪内容。
这些约束说明,长上下文并不等于可以随意修改长上下文。对于自行构建消息数组的应用,模型升级还涉及历史管理、回退模型、缓存和错误恢复等工程问题。AIFlux此前报道的 DeepSeek Harness 长会话更新 也反映出,Agent 产品的难点正从单轮回答转向长会话状态、工具链路和运行时可靠性。
新增 effort、进度更新和内容来源标记
在保持基础价格不变的同时,Anthropic为 5.1 版本增加了若干开发者能力,包括按消息设置 effort、按回合生效的系统消息,以及在工具调用之间显示可读的进度更新。后两项能力目前属于 beta 功能。
文档还列出内容来源标记(content provenance)等变化。对长程 Agent 而言,这些功能的意义在于把模型的内部工作状态转化为更容易观察和管理的运行过程:开发者可以在困难步骤提高思考投入,在例行步骤降低投入,也可以让用户看到工具调用之间的阶段性进展。
但进度更新并不等于结果验证。一个 Agent 是否真正完成了研究、代码迁移或文件制作,仍需要测试、引用核对、权限控制和人工验收。Anthropic的文档描述了接口行为和迁移边界,没有提供一项独立评测来证明这些功能在所有长任务中都能提高完成率。
Mythos 5.1 仍然限制在 Project Glasswing
Claude Mythos 5.1 与 Fable 5.1 共享上下文窗口、最大输出、思考方式和价格,但官方将其定位为 Project Glasswing 的邀请制版本。文档显示,访问需要联系 Anthropic、AWS 或 Google Cloud 的客户团队;它不应被写成与 Fable 5.1 一样向所有用户开放。
这一安排延续了 Anthropic 对 Mythos 级模型的分层策略:更强的能力可以先在经过筛选的机构和高风险研究场景中使用,而面向公众的 Fable 版本则配合安全分类器和其他防护措施。Anthropic此前也曾因模型能力和网络安全风险调整 Fable 与 Mythos 的访问范围,相关背景可参考其 Fable 5 和 Mythos 5 的产品说明。
截至目前,Anthropic 的 Claude Fable 产品页主要介绍 Fable 5 家族及其既有使用场景,Fable 5.1 的完整规格、发布日期、平台和兼容性变化则以 Claude Platform 开发者文档为准。Bloomberg 的 相关报道 提供了媒体侧的发布背景,但模型 ID、价格和可用范围仍应回到官方文档核对。
对开发者来说,这次更新的核心并不是单纯扩大上下文窗口,而是把模型能力、缓存成本和 Agent 运行时约束放在同一条迁移路径上。Fable 5.1 试图服务更长、更复杂的任务,同时要求应用在工具调用、思考区块、历史编辑和数据留存方面采用更严格的工程设计。它能否在真实工作负载中带来足够的性能和成本收益,仍需等待更多独立测试和用户使用数据。
来源: Anthropic Claude Fable 5.1 官方模型文档;What’s new in Claude Fable 5.1;Anthropic Claude 模型总览。
不错过任何一条 AI 大事
订阅 AIFlux 早报,每天 3 分钟看懂产业动态。

