Statement on the US government directive to suspend access to Fable 5 and Mythos 5
TL;DR · AI 摘要
美国政府要求暂停访问Fable 5和Mythos 5模型,Anthropic将据此关闭所有客户对这两款模型的访问。
核心要点
- 美国政府基于国家安全考虑,要求暂停所有外国用户访问Fable 5和Mythos 5。
- Anthropic将关闭这两款模型的访问,以确保合规。
- 目前尚无发现对Fable 5的普遍越狱方法。
结构提纲
按章节快速跳转。
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- 美国政府暂停Fable 5和Mythos 5访问
- 指令背景
- 基于国家安全考虑
- 影响所有外国用户
- Anthropic的回应
- 关闭模型访问
- 确保合规
- Fable 5的安全机制
- 多轮测试
- 未发现普遍越狱方法
金句 / Highlights
值得收藏与分享的关键句。
美国政府基于国家安全考虑,要求暂停所有外国用户访问Fable 5和Mythos 5模型。
Anthropic将关闭这两款模型的访问,以确保符合政府指令。
目前尚无发现对Fable 5的普遍越狱方法。
关于美国政府要求暂停访问Fable 5和Mythos 5的声明 \ Anthropic
公告
关于美国政府要求暂停访问Fable 5和Mythos 5的声明
2026年6月12日
美国政府援引国家安全授权,发布了一项出口管制指令,要求任何外国国民(无论是否在美国境内,包括Anthropic的外国员工)暂停访问Fable 5和Mythos 5。该指令的净效果是,我们必须立即为所有客户停用Fable 5和Mythos 5,以确保合规。所有其他Anthropic模型的访问不会受到影响。
我们今天下午5:21(东部时间)收到了政府的这一指令。信中并未提供其国家安全担忧的具体细节。我们的理解是,政府认为它已经发现了一种绕过Fable 5的方法,或称“越狱”Fable 5的方法。我们审查了该特定技术的演示,发现其用于识别少量已知的、次要的漏洞。这些漏洞看起来相对简单,我们发现其他公开可用的模型在无需绕过的情况下也能发现这些漏洞。
关于Fable的安全保障措施,Anthropic在我们的发布博客文章中已明确表示如下:
- 我们已实施了强有力的安全保障措施,大大降低了Fable被滥用于与网络安全相关的任务(以及其他任务)的可能性。事实上,我们的安全措施如此强大,以至于许多用户抱怨它们过于广泛。
- 在Fable发布前的几周里,Anthropic与美国政府、英国AISI、多个私人第三方组织和内部团队合作,对Fable的安全保障措施进行了数千小时的红队测试。
- 这些测试表明,Fable的安全保障措施比任何之前部署的模型都更加有效。
- 到目前为止,没有任何测试人员能够找到一种通用的越狱方法——一种可以广泛绕过模型安全措施、解锁广泛网络能力的越狱方法。
- 我们认为,目前对于任何模型提供商来说,实现完美的越狱防御是不可能的。行业中使用的每一种安全措施都可能受到非通用越狱的攻击(在特定情况下可以获取一些网络信息),而且未来很可能会发现通用越狱方法。我们在发布Fable 5时已明确表达了这一点。
- 鉴于目前似乎无法实现完美的越狱防御,Anthropic为Fable 5采用了纵深防御策略。我们的目标是使越狱要么范围狭窄(在非通用越狱的情况下),要么制造成本非常高(在通用越狱的情况下),并结合全面的监控,以快速检测和关闭任何成功的攻击。这也是为什么Anthropic要求使用Fable时保留30天的客户数据——这一政策变更对我们客户来说确实有实际成本,但它使我们能够研究和缓解越狱问题。
- 我们坚持这一纵深防御策略。它降低了Fable带来的风险,使其与行业中已部署模型的风险相当。
- 我们甚至尚未收到有关可能导致有害结果的潜在非普遍性越狱方法的披露。我们所收到的披露信息中,潜在越狱要么是完全无害的响应,要么是仅具有轻微影响的发现,无法为 Mythos 提供特定的提升。
截至目前,政府仅向我们提供了潜在的狭窄且非普遍性的越狱的口头证据,这实际上包括让模型阅读特定的代码库并修复任何软件缺陷。我们的理解是,有一个潜在的越狱方法已与政府共享。我们审查了一份我们认为是政府指令基础的报告,并验证了其中展示的能力水平在其他模型(包括 OpenAI 的 GPT-5.5)中广泛存在,并且每天都被那些负责保持系统安全的防御者所使用。我们将在接下来的 24 小时内分享更多细节。
我们正在遵守政府的法律指令,并将为所有用户移除对 Fable 5 和 Mythos 5 的访问权限。然而,我们认为,发现一个狭窄的潜在越狱不应成为召回部署给数亿用户的商业模型的理由。如果该标准在整个行业中被应用,我们认为这将实质上阻止所有前沿模型提供商部署新模型。
正如我们公开表示的那样,我们相信政府应具备通过一个透明、公正、明确且基于技术事实的法定程序来阻止不安全部署的能力。此次行动并未遵循这些原则。
我们为给客户带来的中断表示歉意。我们认为这是一次误解,并正在努力尽快恢复访问权限。
相关内容
首个 Anthropic 公共记录的结果
阅读更多
TCS 与 Anthropic 合作将 Claude 带入受监管行业
我们宣布与塔塔咨询服务公司(TCS)建立合作伙伴关系。TCS 将向其分布在 56 个国家的 50,000 名员工提供 Claude;为客户在金融服务、医疗保健、公共部门和其他受监管行业构建基于 Claude 的产品;并加入 Claude 合作伙伴网络。
DXC 将将 Claude 集成到银行、航空公司和其他受监管行业依赖的系统中
我们宣布与 DXC Technology 建立为期多年的全球联盟,DXC Technology 是全球最大的 IT 服务公司之一。