Featured image of post Fable 5.1 发布:Anthropic 不吹跑分了,开始卖「长跑」

Fable 5.1 发布:Anthropic 不吹跑分了,开始卖「长跑」

编码基准登顶、缓存读取降价 75%、护栏误报砍半,Anthropic 把模型升级讲成了一个可靠性工程的故事;而社区先看到的,是限速下调和一张 EU 水印合规账单。

9 月 1 日深夜,Anthropic 正式发布 Claude Fable 5.1 和 Claude Mythos 5.1。这次发布前还有些戏剧性:此前一天有用户发现 claude.ai 已经在悄悄把流量路由到 5.1,紧接着又赶上一场全球范围的 Claude 故障,灰度泄露加宕机,算是给这场发布会做了一次不太体面的预热(据 36Kr 报道)。

Anthropic 官方发布视频:Introducing Claude Fable 5.1

等官方公告落地,我在 HN 上看到的第一反应和以往不太一样。以往新模型发布,讨论区吵的是「跑分有没有注水」;这一次热度最高的帖子,一半在算钱,一半在翻水印。这正好说明 Fable 5.1 的发布有点不一样:Anthropic 这次讲的故事换了。

先交代一下来源:本文基于 Anthropic 官方公告、System Card、SiliconANGLE 等媒体报道,以及 r/ClaudeAI 的社区讨论写成。社区的数字断言我会标注「据发帖者描述」,实际政策以官方为准。

先搞清楚:这是两个模型,还是一个模型?

官方开篇就说得很直白:Fable 5.1 和 Mythos 5.1 是同一个模型,区别只在护栏级别。

Fable 5.1 面向公众,安全护栏会把敏感的网络安全和生物任务拦下来,转给 Opus 系列处理。Mythos 5.1 则拆掉了这些针对特定领域的限制,只对通过审查的机构开放,走两条信任访问计划:Cyber Verification Program(网络防御者)和 Life Sciences Verification Program(生命科学研究者,与美国政府合作筛选)。Anthropic 给 Mythos 5.1 的定语是「我们发布过的网络能力最强的模型」,官方代码扫描产品 Claude Security 也同步切到了它驱动。

同一个权重,两种发布方式。能力是能力,准入是准入,这条产品线从 Fable 5 开始就已经定型,5.1 把它执行得更彻底了。

公告翻完,篇幅都花在哪了

翻完公告你会发现,Anthropic 花在「跑分」上的篇幅远比想象中少,笔墨大头给了三件事。

讲得最重的,是长程委派(long-horizon delegation,长时程任务委派)。

官方视频演示的是 Fable 5.1「独自跑完一整夜的数据预测,边算边核对数字」。客户语录里这类例子密度极高:Ramp 的工程师让它在一次无人值守的运行里连续跑了 38 个小时,中途诊断出某个实验结果是数据标注伪影,自己修正,然后拉起六个并行实验过夜跑,早上交回结果和下一步计划;MongoDB 的工程师让它做一个复杂原型,「我醒来时下一阶段已经做完,附带完整的可视化演示和成功证据」;Shopify 的评价更直接:它可以长时间无人工作而「不丢失主线」,自己记笔记、自己重排优先级。

官方演示视频:Claude Fable 5.1 runs the forecast overnight(图:Anthropic 官方)

最生动的是 Millennium(投资机构)那个案例。一个百万分之一概率触发的崩溃,他们的工程师和此前所有模型都追了四五年没结果。Fable 5.1 把一个外部供应商库反编译,对着 core dump(核心转储文件)逐段比对,定位到库里的一个 bug。按那位高级投资组合经理的原话说,「这种分析要投入的工作量,人类团队很难说服自己去做」。

长程委派:38 小时无人值守,自动核对结果

案例看到这里,卖点已经不用再总结了:这个模型想让你「托付」活儿,而不只是「使用」它。

第二件讲得多的是价格,确切说是缓存读取(cache read)的价格。

单价没动,还是每百万输入 token 10 美元、输出 50 美元。动的是缓存读取:从 1 美元降到 0.25 美元,降幅 75%。按 Anthropic 用 8 月四周真实用量测算,典型工作负载总成本降约 25%;上下文重、工具多的智能体场景,缓存读取占大头,最多能省 45%。

这个数字怎么理解?跑过 Claude Code 或者长上下文 Agent 的人都知道,多轮任务里绝大部分开销是模型反复读取已经处理过的上下文,真正「新」的输入和输出只占小头。缓存读取打 2.5 折,等于给整个 agentic(智能体化)工作流的底盘降价。Cognition(Devin 的开发方)在发布当天就把 Opus 5 的流量迁了过来,理由是「缓存新价格之后,Fable 级模型第一次在我们一直留在 Opus 上的负载变得经济,从代码审查开始」。

缓存读取降价:-75%,典型负载 -25%,Agent 场景最高 -45%

第三件事是护栏。这次没有放宽限制,动的是误伤率。

网络安全护栏误报减少 60%,生物护栏误报减少 85%。伴随一个政策变化:Fable 5.1 现在允许用于发现软件漏洞(防御性工作),但开发 exploit(漏洞利用代码)仍然会被拦下转给 Opus。企业侧同步推出 EFS(Enterprise Frontier Safeguards,企业前沿护栏):数据存在客户自己的云设施里而不是 Anthropic 那里,人工审查默认由客户自己做,等效零数据留存(zero data retention),今秋分阶段上线。

误报下降 60% 对日常写代码的人不是抽象数字。护栏误触发意味着任务被中途打断、转交给更弱(或更贵)的模型,每个被误伤的会话都是真实的钱和耐心。

基准还是得看:这次确实强

跑分讲得少,不代表分数不好看。挑几个关键项(对照 Fable 5 / Opus 5 / GPT-5.6 Sol):

基准 Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol
Terminal-Bench-Science 0.1(科研智能体) 52.6% 24.7% 29.0% 22.4%
Terminal-Bench 4.0(终端智能体编码) 55.8%(Mythos 60.9%) 42.0% 52.3% 37.3%
CursorBench 3.2.0(Cursor 编码) 73.4% 70.5% 70.0% 67.2%
AutomationBench(业务流自动化) 31.4% 17.1% 26.9% 19.6%
Humanity’s Last Exam(无工具) 60.9% 57.8% 56.6%

科研智能体基准直接翻倍,终端编码提升近 14 个百分点,业务自动化接近翻倍。CursorBench 3.2 上 73.4% 的成绩,是「Claude Fable 5.1 进入 Cursor 且拿下最佳编码表现」这一传播点的出处。还有个细节:Fable 5.1 在 Claude Code 里默认 effort 是 High,在 Cowork 和网页端默认 Medium,同样的模型,不同产品里的出厂档位不一样。

Claude 设计的蛋白质结合体(橙色),12 个靶点全部经实验证实可结合(图:Anthropic 官方公告)

社区的三盆冷水

官方公告发出几小时内,r/ClaudeAI 的热榜被另外几件事占掉了。

第一盆:限速又降了。 一个「Prepare for a decrease of about 20% of current rate」的帖子冲到 1647 赞、317 条评论,按发帖者贴出的截图描述,当前速率即将下调约两成。发布史上最强编码模型的同时给订阅用户降限速,这两件事出现在同一个 48 小时里,评论区自然不缺火药味。需要说明:该截图我没能在官方渠道交叉验证,具体范围和生效时间待确认。

第二盆:DeepSWE 分数争议。 有用户指出 Fable 5.1 在 DeepSWE 这个编码基准上的分数反而低于 Fable 5。这里有个基准口径的老问题:官方公告脚注里其实自己承认了,Terminal-Bench-Science 的公开榜单数字与官方复测结果对不上,差异来自测试 harness(测试支架)不同。同一模型在不同脚手架下分数能差出好几个点,所以「某个基准降了」到底是能力回退还是口径漂移,建议让子弹飞一会儿。

第三盆:水印,这次官方自己承认了。 发布当天有 Reddit 用户发现 Claude 输出疑似带 fingerprinting(指纹标记),讨论一度往「暗中标记」的方向跑。但翻公告会发现,水印是官方主动写进发布文档的:Anthropic 今年 7 月签署了 EU AI Act 的 AI 生成内容透明度实践准则,按该法案要求,8 月 2 日之后发布的模型输出必须带水印,一种判定「这段文字是否由 Claude 参与写作」的数值标记。水印本身不可见,检测走单独的 API,目前对监管、执法、媒体、事实核查机构等开放私测。换言之,这是欧洲法律压出来的行业义务(7 月那批签署方有 190 多家),Anthropic 只是照章办事,顺手把话说明白了。

三盆冷水浇完,你会发现一个有意思的错位:厂商在讲「可靠性工程」,用户在算「性价比和信任账」。双方都没说错。

一条容易被略过的条款:反蒸馏

公告里还有一段对多数读者无关、但对做 Agent 数据管线的人影响很大的改动。

从 9 月 1 日起新注册的 API 账户,不能再在多轮对话里手动编辑 Claude 此前的上下文、同时保留 Claude 之前输出的思考记录(thinking transcript)。官方说明这封堵的是一种「公开文档化的蒸馏(distillation,模型能力提取)手法」:通过篡改上下文诱导模型重新输出思考过程,工业级蒸馏往往用几千个假账号这么干。现有账户暂时不受影响,但 future releases 会全面适用。

如果你在做数据合成、评测回放或者任何需要「改历史再重放」的管线,这一条值得记下来:官方把这条路点名封了。

钱的另一面:一边降价,一边买下半个数据中心

用户侧降价 25% 的同一个月,Anthropic 在基建侧签了两张天价单。

据 Wall Street Journal 报道,发布前一天,Anthropic 与云厂商 Lambda 敲定 350 亿美元的基础设施租约,机房位于德州 Nueces County 一个在建的 1GW(吉瓦)园区,园区由 Hut 8 建设、Nvidia 持有租约,预计 2027 年一季度并网。这之前不到一周,CNBC 报道它与英国 Nscale 签了更大的 450 亿美元合同,在西弗吉尼亚租约 460MW 容量,配备 Nvidia 最新的 Rubin GPU 和 Vera CPU。

按黄仁勋「1GW AI 基建即将造价 800 至 1000 亿美元」的说法折算,这两笔合同大约对应 800 至 900MW 算力。降价让利是真的,为下一波训练和推理烧钱也是真的,两件事互为因果:缓存价格能降,前提是先有足够多的机器把缓存摊薄。

给开发者的实际建议

热闹看完,落到实际使用上,我的判断是这样的。

值得尽快切的场景:代码审查(缓存读取占比高,降价红利最直接)、上下文重的长任务委派(官方和 Cognition 的数据都指向 45% 级别节省)、以及你本来就在排队等 Opus 档位能力的场景,5.1 在多数基准上已经明显超过 Opus 5,价格还是 Opus 的。Every 的 Dan Shipper 那句总结挺传神:「Fable 级的智力,Opus 级的价格,Sonnet 级的速度」。

建议观望的场景:重度订阅用户(Pro/Max)。API 侧的降价红利和订阅侧的限速政策是两条线,限速下调若落地,5.1 的实际可用额度未必比现在宽裕,等政策明朗再迁移不迟。

需要留意的合规项:欧盟业务相关的文本生成会带水印(法定义务);新开 API 账户做不了「改历史保思考」的管线;把模型用于渗透测试、exploit 生成这类双用途安全任务,仍会被转给 Opus 或需要走 CVP 审核。

结尾:能力、价格、信任,三角各归各位

发布看完,Fable 5.1 值得记下来的变化,我拆成三层。

最实在的是能力。长程委派这次有了 38 小时的运行记录,不再是发布稿里的展望;科研基准翻倍也佐证,这个卖点靠数据站得住。价格在第二层。缓存读取降价,说白了是给「委派」定价——任务越长、上下文越重,省得越多,补贴的恰恰是那些把整块工作交给模型的人。剩下的是信任,一层看不见的地基。水印、反蒸馏、更准的护栏、EFS,没有一样提升智商,却决定了模型能被谁、在多大范围内放心托付。

这三层是咬在一起的。没有能力,委派不值得;价格降不下来,委派不划算;信任跟不上,企业不敢把真活儿交出去,缺了任何一层,「托付」都停在嘴上。Anthropic 把一次模型升级讲成可靠性工程,等于承认了一件事——跑分竞赛的上半场结束了,下半场比的是谁家的模型能被企业真正「放养」。至于社区那三盆冷水,限速、基准口径、水印,恰好说明用户也成熟了:大家已经不再问「模型有多聪明」,开始问「聪明之外的账单有多少」。这大概才是这场发布最有信息量的地方。

参考来源

以上来源用于核对发布口径与社区反馈,其中 Reddit 帖子的数字断言(限速幅度、DeepSWE 分数)未经独立复测,不等同于官方基准结论。

RSS Feed 使用 Hugo 构建
主题 StackJimmy 设计