返回博客
·AI技术

Anthropic Claude Fable 5.1 发布,缓存读取价暴跌 75%:AI 智能体成本终于能算过来了

Anthropic 于 9 月 1 日发布 Claude Fable 5.1 与 Mythos 5.1 双模型,缓存读取价格暴跌 75% 至 $0.25/百万 token,典型 Agent 任务成本最高降低 45%,智能体落地成本门槛进一步下降。

#Anthropic#Claude#AI智能体#成本优化

# Anthropic Claude Fable 5.1 发布,缓存读取价暴跌 75%:AI 智能体成本终于能算过来了

**分类:AI技术 | 标签:Anthropic, Claude, AI智能体, 成本优化**

一句话前言

9 月 1 日,Anthropic 一口气发布了两款新模型——Fable 5.1 和 Mythos 5.1,更炸裂的是缓存读取价格从 $1/百万 token 直接砍到 $0.25,降幅高达 75%。对于每天跑 Agent 的开发者来说,这等于在省钱这件事上给了一记重拳。

Fable 5.1:智能体成本曲线终于被压下来了

先说价格。之前的 Claude 缓存读取价格是 $1/百万 token,这个价格对频繁调用的 Agent 场景来说并不算友好。这次直接降到 $0.25,意味着同样的工作负载成本能砍掉一大块。

Anthropic 自己算了一笔账:典型 Agent 任务的综合成本最高可降低 45%。这个数字不是拍脑袋——它来自对真实工作负载的测试,包括多轮对话、工具调用、代码生成等高频场景。

Fable 5.1 的定价保持不变:输入 $10/百万 token,输出 $50/百万 token。但这个「不变」背后其实是架构上的优化,真正省钱的点在于缓存读取。

Mythos 5.1:藏在白名单里的「终极版」

同日发布但不对公众开放的 Mythos 5.1,是 Anthropic 专门给网络安全和生命科学领域准备的版本。

两者共享同一个底层模型,区别在于安全策略的严格程度。Mythos 5.1 通过了更严格的审查,允许执行一些在 Fable 5.1 上会被拦截的高风险操作。目前只面向通过 Anthropic 验证计划的机构开放,个人开发者暂时用不上。

这有点像 Sonnet 和 Opus 的差距——同一个技术底座,不同安全阈值,满足从日常到高风险场景的全覆盖需求。

三个值得注意的 API 变化

这次更新不只是模型和价格,还有三个 breaking change 需要留意:

**强制工具调用被移除了。** 之前可以通过 tool_choice 参数强制模型使用某个工具,现在这个参数直接报错。Anthropic 的理由是:让模型自己判断是否需要调用工具,比强制它调用更可靠。

**自适应思考默认开启。** 之前需要手动开启的 adaptive thinking 现在成为默认行为。这意味着同样的 prompt 在不同版本间可能产生不同的输出深度,升级时需要注意。

**历史编辑会使思考块失效。** 如果你修改了对话历史中的消息,之前生成的思考内容会被清除。这个行为在 8 月 31 日之后创建的新账户上强制执行。

智能体时代的「成本账」终于能算清了

过去半年,AI 智能体(Agent)从概念验证走向生产部署,最大的拦路虎不是能力,而是成本。

一个典型的智能体工作流:用户下达指令 → 模型规划任务 → 调用多个工具 → 中间过程可能几十轮对话 → 最终交付结果。每一轮都在烧 token,再加上缓存读取的额外开销,跑一个复杂任务的成本经常超出预期。

Fable 5.1 这次的价格调整,直接把缓存读取这个成本黑洞堵上了一半。对于每天运行数百甚至数千次 Agent 任务的企业来说,这个降幅意味着每月能省下不少云费用。

当然,成本降低只是第一步。模型本身的能力提升同样重要——Fable 5.1 在 Terminal-Bench、OSWorld 等基准测试中都有进步,特别是在长程任务和代码工程场景下的表现。

竞品在做什么

Anthropic 这边降价的同时,其他玩家也在动作频繁:

  • OpenAI 正在为下一代模型 Astra 做安全评估,已经将其标记为「Critical」级别,但具体发布日期尚未确定。
  • Google 在 9 月 2 日发布了 Gemini 3.8 Flash,六周内第三款 Flash 版本迭代,速度相当快。
  • Meta 同期推出了 Muse Spark 1.3,编程场景中工具调用减少 20%、Token 消耗降低 25%。
  • 竞争格局很清晰:头部厂商都在往「智能体 + 低成本」的方向卷,Anthropic 这次降价,某种程度上是在用价格换市场份额。

    写在后面

    缓存读取价降 75%,这是一个明确的信号:AI 智能体从「能用」走向「用得起」的关键一步已经迈出。对于还在观望 Agent 落地价值的开发者来说,现在可能是测试和迁移的最佳窗口期。

    当然,降价不等于万事大吉——模型能力、安全性、生态兼容性同样重要。但至少在成本这件事上,Anthropic 给出了一个让人满意的交代。

    **本文参考来源:Anthropic 官方博客、The Verge、Geoffrey Chen AI Observations**