美国下令封锁最强模型 Mythos,就因为它能帮你读代码修 bug
事情是这样的。
上周五美东时间下午五点二十一分,美国政府给 Anthropic 下了一道命令,援引的是国家安全和出口管制的权限。命令的内容一句话能说清,从现在起,所有外国国民不许再访问 Fable 5 和 Mythos 5 这两个模型。不管你人在不在美国境内,不管你是普通用户还是 Anthropic 自己雇的外籍员工,一律切断。
为了执行这道命令,Anthropic 实际上把自己手里最强的两个模型,在全球范围内下线了。
我刷到这条的时候愣了一下。一家市值被传到一万亿美元量级的公司,主动把旗舰产品关掉,这种事本身就够稀奇了。但真正让我没绷住的,是关掉它的理由。
不是模型教人造炸弹,不是泄露了什么国家机密,不是出了什么惊天动地的安全事故。
是因为,它能帮你读代码、修 bug。
我先把这事的来龙去脉讲清楚,再跟你唠唠我为什么觉得这件事比它表面看起来重要得多。
先说政府那边的担忧从哪来。起因是有人搞出了一个绕过 Fable 5 安全护栏的演示。护栏这个词,圈外的朋友可能不熟,我用人话解释一下。你可以把大模型想象成一个能力极强但需要被管教的实习生,厂商在它周围立了一圈规矩,哪些话不能说、哪些事不能干,这圈规矩就是安全护栏。所谓越狱(jailbreak),就是想办法骗过这圈规矩,让模型去做它本来被禁止做的事。这个词最早是从苹果手机那借来的,给 iPhone 越狱就是绕过系统限制装第三方东西,意思是一脉相承的。
所以政府收到的,是一份号称能给 Fable 5 越狱的演示。听起来挺吓人对吧,最强模型的护栏被人撬开了。
但 Anthropic 自己复核了这个演示之后,给出的描述就有点让人哭笑不得了。
Anthropic 在官方声明里说,这是一个狭窄的、非通用的越狱(narrow, non-universal jailbreak)。狭窄的意思是它只在很特定的情况下管用,非通用的意思是你没法拿它当万能钥匙到处开锁。然后是关键的那句,这个所谓越狱的本质动作,基本上就是让模型去读一段特定的代码库,然后修复其中的软件缺陷。
我读到这句的时候,是真的笑了一下。
让模型读代码库、找出里面的 bug、然后修掉。
这不就是我每天在干的事吗。这不就是 Cursor、Claude Code、Codex 这一整代编码工具存在的全部意义吗。全世界几百万程序员现在每天打开 IDE,第一件事就是把一段代码丢给模型,说你帮我看看这里哪儿写错了。这居然是个需要动用国家安全权限去叫停的危险能力。
Anthropic 自己也是这个态度。他们在声明里直接说,这个演示展示出来的能力水平,在其他模型上也广泛可得,包括 OpenAI 的 GPT-5.5。意思很清楚,你要说读代码修 bug 算危险能力,那市面上随便拉一个模型都有,凭什么单单把我这两个下了。复核完之后他们的结论是,只发现了一些轻微的、而且早就已知的小毛病,是别的公开模型不用任何特殊手段也能自己发现的那种。
这里就到了我觉得最值得停下来想一想的地方。为什么一个看起来人畜无害的能力,会被当成安全红线。
答案藏在一个很多人没意识到的事实里,攻和防,本来就是同一件事。
我搭 AI 脚手架这行,天天跟模型在生产环境里怎么跑、怎么翻车打交道,对这点感受特别深。你让模型读一段代码库找出里面的安全漏洞,这个动作本身是中性的。一个白帽工程师用它来做代码审计,提前堵住自家系统的窟窿,这是防。一个心怀不轨的人用同样的能力,去扫描别人的开源项目、找出可以利用的漏洞,这是攻。模型不知道也不关心你是哪一种,它只是忠实地把代码里的缺陷给你指出来。能力是同一个能力,方向是你给的。
这就是信息安全领域一个老到掉牙的命题了,找漏洞的能力和修漏洞的能力,是一枚硬币的两面。你没办法只培养一个会修不会找的模型,因为修的前提就是先得找到。政府那边的逻辑,我猜大概是这样,一个能高效定位代码缺陷的模型,落到错误的人手里,就成了一台自动化的漏洞挖掘机。所以要把最强的那两个,从外国人手里收回去。
逻辑链条我能理解。但 Anthropic 那句反驳,我觉得说到了点子上。
他们说,我们不认同,发现一个狭窄的潜在越狱,就应该成为召回一款已经部署给数亿人使用的商用模型的理由。
这句话的分量在哪。在于它把一个特别尴尬的标准给摊到了台面上。如果发现一个模型能读代码修 bug 就算找到了危险能力、就得下架,那这个标准放到整个行业,几乎所有新模型在发布的那一刻就该被叫停。因为没有哪个前沿模型不会读代码,这是基本功里的基本功。Anthropic 等于是在说,你这把尺子要是真立起来,量死的不只是我一家,是所有人。
我顺着这条线往下想,越想越觉得这事的荒诞感是有层次的。
第一层荒诞,是能力的日常性和定性的严重性之间的落差。一边是几百万人每天在用的、平平无奇的编码辅助,一边是动用国家安全权限的紧急叫停。这两个东西被强行摁在了一起。
第二层荒诞,藏在那个执行细节里。命令说的是禁止外国国民访问,连 Anthropic 自己的外籍员工都不能用。你想象一下那个画面,一家公司里一部分工程师还能登录用自家最强的模型,坐在隔壁的同事因为护照不一样,屏幕上弹出来访问被拒绝。同一个办公室,同一份工资单,同一个产品,因为国籍这一道线,能用的人和不能用的人被劈成了两半。模型还是那个模型,能力一点没变,变的只是谁有资格碰它。
这第二层,才是真正戳到我的地方。
因为它把一个我一直隐隐担心、但平时不太愿意细想的问题,给具象化了。AI 这个东西,它到底是会成为一个谁都能用、把能力拉平的工具,还是会变成一个被一道道线圈起来、按身份发放的特权。
过去这两三年,最让我们这帮一线干活的人兴奋的是什么。是能力的普及。一个三线城市自学编程的小孩,一个没读过名校的独立开发者,一个深夜还在改 README 的开源作者,他们和硅谷大厂工程师之间那道由资源和门槛筑起来的墙,第一次被 AI 凿开了一个口子。你买不起一整个算法团队,但你能用得起一个比大多数初级工程师都强的模型。这是我心里 AI 最动人的那一面,它在悄悄地把能力这个东西,从少数人的特权,变成多数人的日用品。
而上周五这道命令,是我第一次这么清楚地看到,那个口子也可以被重新堵上。能力可以普及,也可以被收回。今天收回的理由是国家安全和出口管制,是读代码修 bug。明天会用什么理由、收回什么能力、对谁收回,没人说得准。
我不是说政府这么做一定错。出口管制这套机制存在了很多年,背后有它的现实考量,一项足够强的技术,确实会牵扯到比商业更大的盘算。我也理解 Anthropic 的处境,法律命令下来了,你一家公司能做的就是先照办,然后公开把自己的不认同说出来,承诺二十四小时内给更多细节,一边努力恢复访问。声明里那种照令执行但据理力争的姿态,我觉得是体面的。
我只是作为一个天天用这些工具、也亲手给这些模型搭运行脚手架的人,心里那点朴素的不安被勾起来了。
我们这行有个特别容易让人上头的错觉,觉得能力一旦被创造出来、被普及开,就是不可逆的,就像水往低处流一样自然。你今天能用 Claude Code 重构一个老项目,你下意识会觉得这个能力永远会在那,最多是越来越便宜越来越强。但这道命令提醒我,不一定。能力的可获得性,从来不只是个技术问题,它是技术、商业、监管、地缘几股力量拧在一起的结果。任何一股力量发力,你手里那个用得正顺的工具,可能就在某个周五的下午五点二十一分,弹出一行访问被拒绝。
写到这我想起万能青年旅店那句,是谁来自山川湖海,却囿于昼夜厨房与爱。原本是讲人被生活磨平的,但这两天我脑子里翻来覆去是另一个版本的画面。一个能横跨山川湖海、读懂任何一段代码的模型,最后囿于的不是昼夜厨房,是一道国籍的线、一纸出口管制的令。能力本身那么辽阔,能不能用却那么具体。
回到这件事本身,往后会怎么走,我也说不准。Anthropic 说在努力恢复访问,也许过几天就证明是一场误会,两个模型重新开放,这事变成行业史上一个有点黑色幽默的小插曲,被人当段子讲,最危险的越狱原来是让 AI 帮你修 bug。我挺希望是这个结局的。
但就算它真的只是个插曲,我觉得也值得被记下来。因为它第一次把一个抽象的担忧,变成了一个具体的、有日期有时间戳的事件。它让所有像我一样,习惯了 AI 能力唾手可得的人,被迫认真想一想,这个唾手可得,到底有多牢靠。
我没有一个干净的结论给你。说实话这事我自己也没完全想明白,能力该不该被国界划线,划线的尺度该谁来定,怎么定才不至于既挡不住真正的坏人、又误伤了一整个行业,这些问题比我能回答的大太多了。
我只想把这件事原原本本摆在这,跟屏幕前的你说一声,留个意。下一次你打开 IDE,丢一段代码给模型,让它帮你找 bug 的时候,那个流畅到你几乎感觉不到它存在的瞬间,可能没有你以为的那么理所当然。
它是这个时代给我们的一份礼物。但礼物,是可以被收回的。
附几个原始信源,想看一手细节的可以自己去翻。
Anthropic 官方声明,把暂停的来龙去脉和自己的态度讲得最清楚,https://www.anthropic.com/news/fable-mythos-access
TIME 的报道,https://time.com/article/2026/06/13/anthropic-fable-mythos-ban-US-security/
TechRadar 的报道,标题就把那个越狱说清楚了,https://www.techradar.com/ai-platforms-assistants/claude/after-a-potential-jailbreak-anthropic-is-shutting-off-access-to-its-mythos-5-and-fable-5-models-under-national-security-orders-from-the-us-government
BleepingComputer 从安全视角的报道,https://www.bleepingcomputer.com/news/security/us-gov-asks-anthropic-to-ban-foreign-national-access-to-fable-mythos/
Bloomberg 的视频报道,https://www.bloomberg.com/news/videos/2026-06-15/us-orders-anthropic-to-block-foreign-access-to-mythos-video