Skip to content
模型更新2026 · 07 · 02

Fable 5 重新上线:一场为期十八天的出口管制风波始末

Fable 5 因 jailbreak 报告和出口管制停服 18 天后恢复上线,事件暴露前沿模型的监管性断供风险,也让企业的 model-agnostic 架构、模型回退和动态切换变得更重要。

7 月 1 日,Anthropic 宣布旗下最强的公开发布模型 Claude Fable 5 在全球范围重新恢复访问。此前,因美国商务部的一纸出口管制令,这款模型连同它的姊妹模型 Mythos 5 一起,被下线了将近十八天。这也是近年来一次颇具标志性的事件——一个已经商业化上市的前沿模型,因国家安全审查被临时叫停,又在监管方撤销管制后重新回归。下面把整件事的来龙去脉和 Anthropic 在其中做的事情梳理一遍。

要理解这次风波,得先从两款模型说起。6 月 9 日,Anthropic 发布了 Fable 5 与 Mythos 5。两者共享同一套底层模型:Fable 5 是面向大众、加装了安全护栏的通用版本,能力据称超过 Anthropic 以往任何公开发布的模型,任务越长、越复杂,它相对其他模型的领先幅度就越大;Mythos 5 则是护栏更少、专供网络安全防御者和基础设施方的受限版本,通过 Project Glasswing 与美国政府合作部署。发布之初就有客户案例流出——比如 Stripe 称 Fable 5 把一次涉及五千万行 Ruby 代码库的全量迁移压缩到了一天完成,而人工估算需要两个多月。风波的导火索是一份越狱(jailbreak)报告。亚马逊的研究人员发现了一种绕过 Fable 5 安全护栏的方法:通过特定提示词,让模型识别出若干软件漏洞,并在其中一个案例里生成了演示如何利用该漏洞的代码。这份报告被上报给了美国政府。

时间线

6 月 2 日——在这一切之前,特朗普签署了一项行政令,为前沿模型建立了一条"自愿"的发布前审查通道,并设立了一套用于判定哪些模型属于"受控"范围的机密基准,但明确没有设定强制性的发布许可。值得注意的是,Fable 5 从未走过这条通道。

6 月 9 日——Fable 5 与 Mythos 5 正式发布。

6 月 12 日(周五)——美国商务部对两款模型实施出口管制。管制令要求 Anthropic 切断所有外国公民的访问权限,不论其身在美国境内还是境外,甚至包括 Anthropic 自己的非美籍员工。由于命令即刻生效,而公司无法实时核验每一位用户的国籍,Anthropic 索性对所有用户全面暂停了两款模型的访问。

6 月 13 日至 25 日——这段时间里,已经把 Fable 5 或 Mythos 5 接入工作流的企业和开发者被迫回退到 Opus 4.8 等旧模型。Anthropic 公开表达了异议,主张仅凭一个范围狭窄的越狱发现就下架一款重要的商业模型,可能"实质上会让所有前沿模型厂商的所有新模型部署都陷入停滞"。与此同时,Anthropic 与美国政府、亚马逊等各方一起复核了这份报告和相关证据。

6 月 26 日——美国政府允许 Anthropic 向大约 100 家受信任的美国机构(网络防御方、基础设施提供商和联邦机构)恢复 Mythos 5 的访问,部分撤销了 6 月 12 日的命令。

6 月 30 日——商务部长 Howard Lutnick 致函撤销针对两款模型的出口管制许可要求。在此之前,商务部下属的 AI 标准与创新中心(CAISI)对 Anthropic 的安全措施进行了审查。

7 月 1 日——Fable 5 在全球范围恢复上线,覆盖 Claude.ai、Claude Platform、Claude Code 和 Claude Cowork。Anthropic 官方账号在美东时间下午 3:31 宣布了这一消息。AWS、Google Cloud 与 Microsoft Foundry 上的访问也将"尽快"重新开放。

Anthropic 在这段时间里做了什么

把 Anthropic 的动作单独拎出来看,大致可以分成几件事。

第一,合规下线并公开申辩。 面对无法实时核验国籍的现实,Anthropic 选择了对所有人暂停访问以满足管制要求;同时它并没有沉默接受,而是公开质疑此次管制的依据过于狭窄,可能对整个行业的模型部署节奏造成外溢影响。

第二,用测试证据反驳"独有能力"的说法。 Anthropic 与政府、亚马逊一起复核证据后,做了一轮对照测试,结论是:包括 Opus 4.8、GPT-5.5、Kimi K2.7 在内的多款能力更弱的模型,都能识别出报告中提到的同样漏洞;而在演示如何利用那个漏洞这一环节,它测试过的每一款模型都能给出与 Fable 5 相同的结果。换言之,报告里涉及的并不是 Mythos 级别独有的能力,而更像是常规的防御性安全工作。

第三,训练了一个针对性的安全分类器。 与政府密切配合下,Anthropic 训练出一个新的安全过滤器(classifier),专门识别并拦截报告中描述的那一种技术。按 6 月 30 日的说法,它对该技术的拦截成功率超过 99%。被拦截的请求会被转交给能力更弱的 Opus 4.8 处理,用户会收到通知,并且不会按 Fable 的价格计费。代价是:在正常的编程和调试任务上,误报会变多。

第四,接受官方审查并做出一系列制度性承诺。 管制撤销前,CAISI 审查了这套安全措施。Anthropic 还开设了一个 HackerOne 项目,供研究人员上报新的 Fable 5 越狱;承诺给指定的政府伙伴更早的机会去测试未来的前沿模型;并组建一支 7×24 小时的团队盯守越狱报告,对于最严重的情形(例如可能危及电网或银行的越狱),一旦确认严重性就立刻部署修复。此外,它还联合亚马逊、微软、谷歌等 Glasswing 伙伴,提议建立一套全行业通用的越狱严重性评分框架。

回归后的 Fable 5 是什么样

需要留意的是,重新上线的并不完全是原来那个 Fable 5,而是一个"出于审慎"收紧过的版本。安全分类器变得更严格,这意味着在编程、调试等日常任务里,用户更有可能遇到模型自行判定风险、回退到 Opus 4.8 的情况。对绝大多数任务而言这不会发生,但触发概率确实比以前高了。

访问与计费方面:Fable 5 的价格为每百万输入 token 10 美元、每百万输出 token 50 美元,提示词缓存仍享 90% 的输入折扣;需要在美国境内推理的工作负载,可按 1.1 倍价格使用美国专属推理。对 Pro、Max、Team 及部分 Enterprise 计划,7 月 7 日之前 Fable 5 计入每周用量上限的至多 50%,此后转为按用量额度(usage credits)付费;标准 Enterprise 席位则没有包含额度,需启用额度才能使用。

前沿模型的发布,正在从一次普通的产品上线,越来越像一场受美国国家安全审查影响的"谈判式部署"。一个耐人寻味的细节是,6 月 2 日的行政令本已搭起一条自愿审查通道,但政府这次动用的是出口管制这个更重的工具,而非那条通道。对企业技术负责人而言,这轮过山车式的监管周期也在推动一种趋势:转向模型无关(model-agnostic)的回退架构,用代理层在必要时把关键生产链路从专有 API 动态切换到本地部署的开放权重替代方案,以对冲未来可能的监管性断供。