Anthropic最强AI被美国政府紧急叫停:安全警告反噬了自己
6月12日周五下午5点21分,美国商务部向Anthropic发出紧急指令,要求立即关闭Claude Fable 5和Mythos 5两个模型的访问权限,理由是国家安全风险。Anthropic在90分钟内执行了命令,全球用户瞬间失去了这两个最强AI的使用权。
事情是怎么发生的?
Mythos是Anthropic在4月预览的顶级AI模型,专门用于网络安全领域。Anthropic声称Mythos能发现所有主流操作系统和浏览器的安全漏洞,能力强大到不能公开发布。他们只通过Project Glasswing项目,把Mythos分享给了约50家经过严格审查的机构,包括Amazon、Apple、Google、Microsoft和CrowdStrike,用于防御性网络安全工作。
Fable 5则是三天前刚发布的版本,在Mythos基础上加装了安全护栏,屏蔽了网络安全和生物学等高风险领域的响应,Anthropic认为它已经安全到可以公开发布了。根据Vals AI的基准测试,Fable 5是当时公开可用的最强AI模型。
然后美国政府出手了。
政府的理由是什么?
官方说法是出口管制——限制外国公民访问这两个模型。但实际效果是所有用户(包括美国本土用户)都被切断了访问。
Anthropic在博客中透露,政府的核心关切是一个所谓的Fable 5"越狱"漏洞。但Anthropic的描述是:这只是一个"狭窄的、非通用的潜在越狱",本质上是让模型读取特定代码库并识别软件缺陷——这种能力在其他公开模型(包括OpenAI的GPT-5.5)中已经广泛存在,网络安全专业人士也每天都在用。
Anthropic的辩护逻辑是:他们最强的安全防护通过独立分类器系统实现,与模型本身分离。即使有人诱导Fable绕过拒绝响应,底层对最危险输出的保护仍然有效。
但政府显然不买账。
为什么说Anthropic被自己的安全叙事反噬了?
Anthropic从成立起就把自己定位为"安全优先的AI公司",与OpenAI的激进路线形成对比。在Mythos的营销中,他们反复强调这个模型"危险到不能公开发布"——这种叙事在商业上很聪明,制造了稀缺性和神秘感。
但当你花几个月时间告诉全世界你的AI"独特地危险",全世界——包括美国政府——就会真的相信你。Sam Altman在4月就讽刺过Anthropic的Mythos营销是"恐惧营销":"说'我们造了一颗炸弹,本来要扔到你头上,现在100万美元卖你一个防空洞'——这显然是绝佳的营销。"他当时可能没想到,这种营销最终真的引来了政府的炸弹。
历史会重演吗?
这不是美国政府第一次试图用出口管制控制危险技术。90年代,PGP加密软件的作者Phil Zimmermann被美国海关署刑事调查,理由是违反武器出口管制。结果呢?Zimmermann把PGP源代码作为书籍出版,最终调查撤销,PGP成为今天Signal和WhatsApp使用的端到端加密的基础。
2010年代,西方制造的间谍软件被用于监控中东异见人士,各国政府扩展了《瓦森纳协定》来限制双重用途软件出口。但以色列等间谍软件大国根本不遵守,欧洲也屡次放松对专制政权的间谍软件出口。德国间谍软件公司FinFisher在2022年倒闭,不是因为出口管制,而是因为德国检方调查它向土耳其出售间谍软件。
历史表明,政府主导的出口管制几乎从未成功阻止恶意行为者获取危险技术。它只会惩罚合规企业,让不合规的玩家获得竞争优势。
我的看法
Anthropic这次栽跟头,本质上是"安全叙事"的双刃剑效应。你可以说你的AI很安全,也可以说它很危险,但不能两边都占。Anthropic想用"危险"来制造营销稀缺性,结果政府真的信了,直接把产品禁了。
从技术角度看,Fable 5的所谓"越狱"漏洞很可能被夸大了。网络安全工具的双刃性是行业共识——同样的工具可以用于攻击也可以用于防御。如果政府用这个理由禁AI,那所有公开的代码审计工具、渗透测试框架都应该禁,这显然荒谬。
更大的问题是:这次禁令开了先例。如果"发现一个狭窄漏洞"就能召回已发布的模型,那所有前沿AI公司都不敢轻易发布新产品了。OpenAI、Google、Meta都在观望,这个标准如果推广,整个行业都会被拖慢。
Anthropic现在应该很后悔把Mythos包装得那么"危险"。有时候,低调比高调更安全。
参考来源:TechCrunch、Wired、Anthropic官方博客
评论区