post cover

AI 热点快报:Claude Fable 5.1 发布——缓存读取降价 75%,Agent 长任务成本最高降 45%(2026-09-02)


事件与背景

北京时间 9 月 2 日凌晨(美东 9 月 1 日),Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1。两者是同一基座模型,差别在安全护栏:Fable 5.1 全平台可用;Mythos 5.1 仅通过可信访问计划(CVP 网络防御、LSVP 生命科学,与美国政府合作开发)向经过审查的机构开放。官方称其为「面向编程与知识工作最强的模型」,发布当天登上 Hacker News 首页(300+ 分、240+ 评论)。

这次发布最值得注意的不是跑分,而是三件事的组合:缓存读取(cache read)价格从 $1.00/M 直降到 $0.25/M(降 75%),输入 $10/M、输出 $50/M 不变;推出 Enterprise Frontier Safeguards(EFS)企业级零数据保留方案;安全护栏误报大幅减少(网络防御场景减少 60%)。官方给出的成本结论:典型负载比 Fable 5 便宜约 25%,高度 agentic(长上下文、多工具调用)任务最高便宜约 45%。性能上,官方数据显示 Fable 5.1 在 Terminal-Bench、Humanity’s Last Exam、CursorBench 3.2 等基准全面超过 Fable 5,且低/中 effort 档就能达到 Fable 5 高 effort 的水平;投资机构 Millennium 在测试中还让 Fable 5.1 定位到了一个工程师团队数年未能解释的罕见崩溃根因。

为什么现在重要

  1. Agent 的经济账被重写。 长任务 agent 的成本大头是反复读取上下文,缓存读取降价 75% 直接打在这个最痛的点上。官方测算是成本降 25%-45%,HN 上已有用户给出实测量级(有团队称真实任务成本降约 30%);Simon Willison 也指出,缓存降价对长运行 agent 的叠加收益最大,因为后续调用都在读已处理的上下文。影响判断:当「跑得久」变便宜,产品决策的天平会从「省 token 的短任务」转向「值得让 agent 干到底的长任务」。

  2. 企业采用的最大障碍——数据进模型厂商——出现首个系统性解法。 EFS 是 Anthropic 与 100+ 家企业客户联合开发的(覆盖金融、医疗、制造、电信等行业),把客户数据存放在客户自己的云基础设施上(AWS/Google Cloud/Azure),Anthropic 不持有数据,却仍能检测滥用;EFS 就绪前,符合条件的客户可直接使用零数据保留。影响判断:金融、医疗、制造这类被合规卡住的企业,有了「用前沿模型 + 不交出数据」的第三条路。

  3. 安全护栏从「一刀切」转向「精确制导」,防御性安全市场被打开。 Fable 5.1 现在允许用于发现软件漏洞(防御向),网络安全的误报减少 60%,生物安全误报减少 85%;但渗透测试、漏洞利用生成仍会被转给 Opus。影响判断:之前被护栏误伤的大量合法安全/医疗工作流可以回流,同时红线反而守得更严。

  4. 科学能力首次进入发布主叙事。 Mythos 5.1 在 12 个靶点上的蛋白结合物设计命中率接近 50%(行业典型 10-15%);给 7 个开源深度学习模型写的自定义 GPU kernel 提速最高 2.5 倍、GPU 成本降 30-60%;其生成的金星高分辨率地形图(分辨率从 10-20 公里提升到 2-3 公里)将按 CC 协议发布,供 NASA VERITAS 与 ESA EnVision 任务参考。影响判断:前沿模型正在从「写代码的助手」变成「有 bench 结果的科研协作者」,这可能改变生命科学工具链的采购逻辑。

  5. 监管合规被当作产品能力来卖。 按 EU AI Act 行为准则,8 月 2 日之后发布的模型输出自带不可见水印(不影响质量、不含用户信息),检测 API 以私有预览开放给监管、媒体、事实核查等机构。影响判断:水印从「被迫合规」变成可核查的供应链能力,做内容平台与合规产品的人需要跟进。

工程师/产品人今天能做什么

  1. 用真实负载重算成本:把缓存读取 $0.25/M 代入你最长会话的 token 分布,对比 Opus 5 与 Fable 5.1 的每任务成本——已有团队宣布发布日把 Opus 5 流量切到 Fable 5.1。
  2. 在 Claude Code 里直接试:Fable 5.1 默认 High effort,适合多轮工具调用与长时无人值守任务;把之前「贵到不敢跑」的长任务重新跑一遍,用新的缓存读取价格实测每任务成本。
  3. 重测被护栏挡过的合法工作流:如果你是安全/防御向用户,先确认任务属于「漏洞发现」而非「漏洞利用生成」,前者现在放行且误报减少 60%。
  4. 企业合规侧:把 EFS(秋季起分阶段推出,支持 Bedrock/Vertex/Foundry/Google Agent Platform)加入选型评估,需要零数据保留的团队现在就可以申请过渡方案。
  5. 关注 Mythos 5.1 的 CVP/LSVP 访问计划(目前仅限美国机构),做网络防御或生命科学研发的团队可提前注册兴趣。

待观察

  1. EFS 的具体时间表、定价与首批行业名单(官方目前只有「秋季分阶段」)。
  2. 社区焦点:Haiku 5 仍无消息,HN 讨论中多位用户吐槽其缺席已久,并指出竞品低价模型在批量任务上已成默认选择——Anthropic 是否会补齐低价位产品线值得关注。
  3. 订阅配额:HN 用户报告发布伴随配额回落(5 月临时 +50% 后回调约 17%),订阅侧是否跟进「更便宜」的承诺有待验证。