Claude Fable 5.1 是 Anthropic 面向编程、知识工作、长期问题解决和科学研究推出的全新正式发布版本。. 该版本于2026年9月1日发布。最显著的变化并非API建议零售价的上涨:输入价格仍为每百万代币$10,输出价格仍为$50。 相反,Anthropic将缓存读取定价下调至每百万代币$0.25,并预计对于大量复用上下文的工作负载,其成本将进一步降低。.
因此,当您的工作依赖于长文档、重复出现的上下文或严格受限的分析时,Fable 5.1 值得认真考量。这并不意味着每条访问路径都完全相同,也不意味着供应商的基准测试结果就能成为独立的结论。 真正有意义的问题其实很简单:您计划采用的途径能否为您提供工作流程所需的上下文、控制措施、隐私条款以及模型行为?
对于需要在同一处比较多个车型系列的团队,, GlobalGPT的多模型工作区 这是除官方途径之外的一种实用选择。它有助于比较针对同一任务的可用模型;在将任何平台作为您的 Fable 5.1 访问路径之前,请先确认当前目录并规划覆盖范围。.
什么是 Claude Fable 5.1?
Anthropic 推出了 Fable 5.1 以及 Mythos 5.1。该公司将其描述为基于同一底层模型、但具有不同安全保障措施和访问规则的产品:Fable 面向大众开放,而 Mythos 则专用于网络安全和生命科学领域的可信访问计划。这一区别至关重要。 Mythos 的功能不应被理解为普通的 Fable 访问权限。.
Anthropic 将 Fable 5.1 定位于编码、知识工作、长期问题解决和科学研究领域。这些是产品宣称,并不意味着每个 API 平台都会提供相同的工具或限制。.
此次发布之所以比例行的模型重命名更具深远意义,在于它融合了功能、资源控制、缓存经济性以及更明确的部署边界。 对于开发人员而言,这意味着在重复性任务中,该模型更容易获得采用依据。对于研究团队而言,这意味着将一个受源数据严格限制的强答案,与仍需工具访问、人工审核以及路线特定保留条款的工作流区分开来。.
- 适用场景: 代码诊断、文档合成、约束密集型分析以及图像到文本的解读。.
- 请先核实: 您所选路径上的上下文限制、工具可用性、数据保留、区域以及套餐访问权限。.
- 请勿推断: Mythos 访问权限、某项云端专用规范或官方基准测试会自动应用于您的账户。.

身份信息一览
在哪里可以获取 Claude Fable 5.1?
Anthropic 表示 Fable 5.1 已在旗下各平台上线,并列举了 AWS、Google Cloud 和 Microsoft Azure。在 Anthropic 的 API 中,该模型的标识符为 克劳德寓言-5-1. 在 AWS Bedrock 路由中,文档中记载的上下文、输出、输入、缓存和保留规则均属于 AWS 文档的内容,不应将其视为其他所有路由的默认设置。.
- Anthropic API: 请使用文档中记载的模型标识符和当前平台的限制条件。.
- AWS Bedrock: AWS 在其文档中说明,该路由支持 100 万令牌的上下文窗口、最大 12.8 万的输出量、文本和图像输入,以及文本输出。.
- 其他云端路线: 在迁移之前,请确认区域、方案、工具支持及数据处理。.
前往路线:哪些需要换乘,哪些不需要
请将每项规格视为针对特定路线的说明。仅凭模型名称本身,并不能保证其限制条件、输入参数、工具或数据条款均相同。.
型号 ID:
克劳德寓言-5-1当前限制、地区及支持的控制措施。.
1M上下文,128K输出,文本/图像输入,文本输出。.
地区和账户资格。.
精确的模型 ID、结构化的 JSON 输出以及 PNG 图像输入。.
文件系统工具和代理程序的执行。.
Fable 5.1 的设计用途是什么?
官方定位较为宽泛,因此有必要区分已记录的内容与通过简单实践验证即可确定的内容。 在我们通过 Anywhere API 进行的闭式输入、首出测试中,Fable 5.1 生成了一个最简的 JavaScript 修复方案,该方案保留了零值,追踪到了文档集中的预算矛盾(但未通过臆测加以解决),保持了观察结果的非因果性,并从 PNG 图表中提取了标注值。 这些对于受限任务而言是有用的信号,而非对 Anthropic 长期运行的智能体基准测试的复现。.
该 API 路由并未提供文件系统或验证工具。因此,我们并未宣称其为真正的自主代理结果。.
能力图:主张、核查、边界
Claude Fable 5.1 定价与成本变动
Anthropic 列出的 Fable 5.1 每百万输入令牌消耗 $10,每百万输出令牌消耗 $50,其消耗率与 Fable 5 相同。缓存读取每百万令牌消耗 $0.25。 Anthropic 估计,对于典型工作负载,成本可降低约 25%;对于复杂且高度依赖上下文的代理型工作,成本降低幅度最高可达约 45%;这些是 Anthropic 基于其声明的工作负载假设得出的估计值,并非保证的折扣。.
关键因素在于重复使用。一次性提示语难以从缓存读取定价中获益,而反复发送大型简报、代码库摘要或策略包的工作流则能从中获益。关于旧版上下文,请参阅我们的 Claude Fable 5 定价指南. 如果您比较的是不同的订阅,而不是 API 令牌计费,, GlobalGPT 计划 提供一条独立的多模型订阅通道;这些并非 Anthropic API 定价的转换方案。.

官方API建议零售价
拖动滑块设置每月输入量。该估算基于以下假设:输出量等于输入量的20%,且50%的输入令牌为缓存读取。.
每月1000万个输入代币Claude Fable 5.1 与 Fable 5:这是一次有意义的升级吗?
在多项特定任务评估中,Anthropic 的 Fable 5.1 得分高于 Fable 5,例如在 Terminal-Bench-Science 任务上,其得分为 52.6%,而 Fable 5 为 24.7%, 在“终端-工作台”任务中,%得分为55.8%,而Fable 5为42.0%, 在 AutomationBench 测试中为 31.4% 对 17.1%,以及在 CursorBench 测试中为 73.4% 对 70.5%。 其GDPval-AA v2的测试结果为1853对1723。这些是Anthropic平台基于其自有测试框架和条件报告的数据,因此更多地作为参考背景,而非可独立复现的总体排名。.
我们并未在同一测试环境中直接进行Fable 5的基准测试。因此,关于升级效果的客观结论尚存保留:官方数据表明在特定任务上有所提升且缓存读取开销降低,但关于Fable 5.1与Fable 5的独立对比评估尚未完成。.
如果您考虑的范围不仅限于此次升级,我们的 Claude Fable 5 与 GPT 5.5 的对比 这比将单个基准测试行视为通用排名更值得作为下一步阅读内容。.

Anthropic报告的任务结果
实测:我们实际测试了什么
我们使用了 Anywhere API 的该路由 /v1/chat/completions 在验证退回的模型 ID 之后 克劳德寓言-5-1 以及一个小型结构化输出探针。下文中的每项结果均来自一个输入已关闭且状态已冻结的任务所产生的首个有效输出。在T05到达模型之前,SVG输入已被拒绝,因此将该相同的测试用例转换为PNG格式并运行了一次;未替换任何有效结果。.
首次产出证据
该回复指出了零值消失的原因,提出了一项微小的代码修改,并且明确表示并未进行测试运行。.
{
"root_cause": "scores.filter(Boolean) 会移除所有为假值的元素,包括数值 0,因此 normalize([0, 4, null, undefined]) 会剔除 0,并返回 [4] 而不是 [0, 4]。 该谓词范围过广;它应仅排除 null 和 undefined。",
"unified_diff": "--- a/normalize.js\n+++ b/normalize.js\n@@ -1,3 +1,3 @@\n function normalize(scores) {\n- return scores.filter(Boolean);\n+ return scores.filter((score) => score != null);\n }",
"预期测试结果": "normalize([0, 4, null, undefined]) 预期返回 [0, 4],因为 score != null 仅对 null 和 undefined 返回 false,因此 0 被保留。 normalize([7]) 预期返回 [7],保持不变。这些预期基于对代码的阅读;未实际运行测试。",
"remaining_risk": "此前被过滤掉的其他假值(NaN、空字符串、false)现在将被保留,这符合所述要求(仅移除 null/undefined),但如果调用方依赖于旧的过滤逻辑,这可能会表现为行为变更。 如果输入可能是非数组类型,该函数仍会像以前一样抛出异常。"
}该响应对提交的索赔进行了匹配,发现了$18,000/$20,000的冲突,并保留了未解决的原因,而非随意编造一个原因。.
{
"claims": [{"claim":"该试点项目于3月3日启动,共有120名学生报名参加。","source":"文件A","section":"A1","status":"已说明"},{"claim":"每周都会记录出勤情况。","source":"文件A","section":"A2","status":"已陈述"},{"claim":"在3月31日的检查点,120名注册学生中有96人至少参加了三次课程。","source":"文件B","section":"B1","status":"陈述"},{"claim":"该项目预算为$18,000。","source":"文件 B","section":"B2","status":"被反驳"},{"claim":"财务说明中列出的批准项目预算为 $20,000。","source":"文件C","section":"C1","status":"被反驳"},{"claim":"该说明未说明预算差额是反映了预算修订还是记账错误。","source":"文件C","section":"C2","status":"已说明"}],
"矛盾之处": [{"主题":"方案预算","来源":[{"来源":"文件 B","章节":"B2","数值":"$18,000"},{"source":"文件C","section":"C1","value":"$20,000"}],"description":"文件B指出计划预算为$18,000,而文件C列出的批准计划预算为$20,000。"}],
"未解决": [{"问题":"$18,000的预算(文件B,B2)与$20,000的批准预算 (文件C,C1)之间的$2,000差异是反映预算修订还是记录错误。","source":"文件C","section":"C2","reason":"文件C明确指出该注释并未阐明差异的原因,且未提供其他任何文件对此进行说明。"}]
}该经过验证的聊天端点未提供文件写入或验证工具。因此,该任务并非作为模型质量测试提交,且未声称产生任何输出或得分。.
该回应计算了观测到的差异,并驳斥了缺乏依据的因果结论。.
{
"mean_control": {"value": 10, "units": "点"},
"mean_treatment": {"value": 14, "units": "points"},
"difference": {"value": 4, "units": "points", "direction": "treatment minus control"},
"supported_conclusion": "在此数据集中,实验组的平均得分比对照组高4分(14分 vs. 10分)。",
"unsupported_conclusion": "无法证明这4分的得分差异是由干预措施造成的;由于组别分配并非随机,且未收集基线得分,因此该差异可能反映了组间原本就存在的差异。",
"局限性": ["非随机分组,因此无法排除选择偏倚", "未收集基线评分,因此无法评估组间既有的差异", "样本量极小(每组n=4)", "未进行推断统计分析; 该差异尚未经过统计显著性检验", "观察性研究设计无法支持因果关系的论断"]
}此次PNG运行返回了标注的4月份数值,区分了视觉估计值与标注值,并避免了无依据的外推。.
{
"april_alpha": 30,
"april_beta": 25,
"trend": "从1月到4月,Alpha和Beta每月均稳步上升,其中Alpha始终比Beta高出约5小时(目测估算:1月约15/10, 2月约20/15,3月约25/20,4月30/25,如图标注)。",
"unsupported": ["图表中明确标注了4月的数值; 1月、2月和3月的数值仅为目测估计值", "未显示4月之后或1月之前的数据,因此无法对其他月份作出任何推断", "单位标注为"学习小时’,但未提供数据来源、样本量或Alpha/Beta组的定义”]
}安全、数据和兼容性限制
Fable 5.1 可用于发现软件漏洞,但 Anthropic 指出该工具不适用于开发漏洞利用程序,且部分两用性质的工作可能会转交至 Opus 处理。 生命科学研究和 Mythos 访问各有不同的限制。数据保留要求因路径而异:例如,AWS 文档中的规定不应被泛化为适用于所有 Claude 或第三方 API 路径。.

Anthropic 还指出,在超长上下文、多智能体以及“不可能任务”等场景下,其对齐覆盖范围仍存在不足。这正是为何应在您自己的有限任务中对高风险部署进行验证的原因,而非忽视该模型已记录的改进之处。.
哪些人适合尝试 Claude Fable 5.1?
当您的工作需要细致的编码支持、源代码限定合成、文档矛盾检查或图像转文本提取时,不妨尝试一下。若您需要特定的区域部署、零保留条款、使用工具的代理,或直接的 Fable 5 比较,请先进行验证。 如果您选择的是通用 Claude 套餐而非 API 访问权限,则单独的 克劳德人工智能定价指南 解释了“计划”与“API”之间的区别。.
Claude Fable 5.1 常见问题解答
Claude Fable 5.1 和 Mythos 5.1 在实际使用上有什么区别?
Anthropic 将其描述为基于同一底层模型、但具有不同安全保障措施和访问规则的方案。Fable 5.1 即本文所讨论的通用可用性路径。Mythos 5.1 专用于网络安全和生命科学领域的可信访问项目,因此 Mythos 的功能并不意味着标准 Fable 账户具备这些能力。.
我可以在 Claude 应用中使用 Claude Fable 5.1 吗,还是它仅支持 API 接口?
请勿仅根据 API 或云服务公告推断消费者应用的访问权限。Anthropic 列出了其自有平台和主要云服务提供商作为访问途径,但具体方案、区域、配额和工具集均取决于所选途径。在针对相关工作流进行调整之前,请先确认您计划使用的具体账户范围。.
Claude Fable 5.1 的正确型号 ID 是什么?
Anthropic 列表 克劳德寓言-5-1 用于其 API。云服务提供商可能会使用特定于路由的标识符,因此请从提供商的文档中复制您实际调用的端点的模型 ID。.
Claude Fable 5.1 是否具有 1M 个令牌的上下文窗口?
AWS 在其文档中说明,Bedrock 路由的上下文窗口为 100 万个令牌,最大输出量为 128K。这对于 Bedrock 的规划很有帮助,但不应在未查阅相关文档的情况下,将其普遍适用于每个 Claude API、消费者或第三方路由。.
Fable 5.1 是否支持导入图像并生成图像?
AWS 的文档中记录了 Bedrock 路由支持文本和图像输入,并输出文本。这意味着该文档中记录了图像理解功能;但这并不意味着该模型是一个图像生成器,也不意味着每个路由都接受相同的格式。在我们进行的受限 API 测试中,当请求层拒绝了 SVG 格式后,PNG 输入能够正常工作。.
较低的缓存读取价格在什么情况下会产生影响?
当同一大段上下文在多个请求中被重复使用时,这一点就很重要:例如,一个持久的代码库简介、一个政策语料库或一份长篇研究资料包。对于孤立的短提示,正常的输入和输出量是费用主要来源。请将上面的计算器作为规划估算,然后将其与您路由的实际缓存行为进行对比。.
Fable 5.1 能否独立运行一个会使用工具的智能体?
这取决于模型所处的环境。一个聊天补全端点可以在不暴露文件写入、验证器、浏览功能或仓库沙箱的情况下,返回一个有力的文本答案。我们的测试路径并未暴露这些工具,因此并未将其用于宣称具备自主代理执行能力。.
Claude Fable 5.1 是否肯定比 Fable 5 更好?
Anthropic 报告了针对特定任务的性能提升以及更低的缓存读取成本。这为在与您工作场景相似的任务中评估此次升级提供了有力理由,但并不构成一项独立且放之四海皆准的“最佳选择”结论。本文未在同一测试环境中运行 Fable 5 基准测试。.




