Anthropic 发布了 Claude Fable 5.1,添加了一个新的普遍可用的 Claude 模型,其定价结构将缓存行为置于 API 成本规划的中心附近。该公司的模型文档列出了 2026 年 9 月 1 日发布的最新活跃 Claude Fable 5.1,其 Claude API 模型 ID claude-fable-5-1

标题价格很简单:每百万个输入代币 10 美元,每百万个输出代币 50 美元。操作上更重要的数字可能是缓存读取价格,标价为每百万代币 0.25 美元。 Anthropic 还记录了输入和输出令牌的 50% Batch API 折扣。

这种组合改变了将大量重复上下文发送到编码代理、支持副驾驶、合规审查系统或内部知识助理的团队的数学方式。如果应用程序可以保留跨回合和用户的缓存命中,《神鬼寓言 5.1》的成本可能会比简单的输入输出价格比较所显示的要低得多。如果不能,相同的工作负载可能在纸面上看起来很昂贵,在生产中看起来也很昂贵。

发生了什么变化

Fable 5.1 不仅仅是 Anthropic 目录中的一个新名称。 Anthropic 的文档列出了多个分发路径的标识符,包括 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 AWS 上的 Claude Platform。这很重要,因为许多企业买家不会直接从一个提供商端点使用前沿模型。它们通过云市场、内部网关、采购批准的平台或具有自己的策略层的开发人员工具进行路由。

可用性情况也是分层的。 Axios 报道称,Claude Fable 5.1 已普遍可用,而 Claude Mythos 5.1 仍仅限于网络安全和生命科学等领域经过审查的合作伙伴。对于管理员来说,这意味着 Anthropic 的 9 月份版本不应被视为一个简单的模型发布。一种型号已广泛使用;另一个似乎位于限制访问流程的后面。

这种区别在前沿人工智能中越来越常见。访问权限按模型、功能、部署渠道、数据控制和用例进行划分。对于需要解释为什么用户可以从一个环境调用一个 Claude SKU 但不能从另一个环境调用一个 Claude SKU 的团队来说,仅存储显示名称和提供商字段的模型目录是不够的。

为什么缓存定价很重要

过去,代币价格很容易在电子表格中进行比较:一侧输入,另一侧输出。代理工作负载使其不再那么有用。编码代理可以在多个回合的上下文中保存存储库摘要、系统指令、工具模式、对话历史和先前分析。支持工作流可以重复附加相同的策略文档或帐户状态。在这些情况下,缓存读取可以主导有效成本曲线。

《神鬼寓言 5.1》记录的每百万缓存读取价格为 0.25 美元,远低于每百万新输入 10 美元的价格。这产生了强烈的动机来保持重复的上下文稳定,一致地路由会话,并避免意外使提供者端缓存失效的应用程序模式。小的实现选择可能会导致巨大的计费差异:更改提示前缀、将时间戳注入稳定的指令或将用户会话分布在不共享缓存状态的路由上,这些都可以降低廉价缓存读取的价值。

Batch API 折扣增加了第二个杠杆。当后台分析、评估运行、文档审查和迁移任务可以安排为批处理作业而不是交互式调用时,它们可能会更便宜。对于企业来说,实际问题不仅仅是《神鬼寓言 5.1》是否“值得”。哪些工作负载应该交互式运行,哪些工作负载应该批量运行,哪些工作负载可以重新设计以保留可重用的上下文。

谁受到影响

维护 AI 网关的开发人员需要添加新的 Claude API 模型 ID 并更新定价表,包括缓存读取会计。最后一部分很容易被错过。仅对新输入和输出代币进行计费的网关要么会误报利润,要么向客户隐瞒节省的费用。使用情况分析应将缓存的输入与新的输入分开显示,特别是对于尝试调整代理工作负载的团队。

企业平台团队有一个不同的问题:可用性和治理。由于《神鬼寓言 5.1》是跨多个云和平台路线记录的,因此管理员可能需要决定是否允许在任何地方使用相同的模型,还是仅通过批准的渠道使用。云路线选择会影响采购、日志记录、区域控制和事件响应。受限神话 5.1 访问权限增加了另一层,因为资格可能取决于合作伙伴审查,而不是正常的模型切换工作流程。

对于模型门式平台,该版本提醒人们,多模型 API 现在是定价和政策抽象,而不仅仅是与 OpenAI 兼容的 API 外观。网关需要知道模型ID、提供商路由、缓存策略、批量折扣、客户可见价格和访问状态。当客户要求他们不允许使用的模型或功能时,它还需要明确的故障模式。

尚不清楚的内容

为此报告检索的公共文档确认了模型 ID、发布日期、活动状态、列出的价格和支持的分发标识符。它并不能完全解决每个发布细节问题。 Anthropic 的新闻编辑室索引显示了一个公开发布条目,但在本次研究中并未完全检索到详细页面。 Axios 还报告了普遍可用的 Fable 5.1 和有限的 Mythos 5.1 访问之间的可用性区别,但经过验证的材料中并未指定 Mythos 的确切资格流程。

还有每个平台必须自行回答的实施问题。缓存经济性取决于实际命中率,而不是标价。特定于云的标识符可能具有特定于路由的操作行为。批量工作负载可能很便宜,但不适合延迟敏感的产品。企业仍需要决定 Anthropic 的最新定价是否符合其治理、保留和审计要求。

立即采取的行动是具体的:在适当的情况下添加 claude-fable-5-1,将 Fable 5.1 与目录中受限制的 Mythos 5.1 分开,并使缓存读取在成本报告中可见。长期的教训更为广泛。前沿模型的发布正在成为控制平面事件。获胜者将是能够根据功能、价格、政策和工作负载形状进行路由的团队,而无需让开发人员记住提供商目录。