跳到正文
北京时间
原文
TechCrunch:AI(RSS)· Connie Loizos·· 2026-06-13精选AI 评分87

Anthropic的安全警告可能适得其反——政府已撤回其最强大AI

Anthropic’s safety warnings may have just backfired — the government has pulled the plug on its most powerful AI

AI 导读

Anthropic对政府撤回其最强大AI模型表达不满,称仅基于一个狭窄的潜在越狱发现就召回已部署给数亿用户的商业模型不合理。

推荐理由

政府直接叫停Anthropic部署中的商业模型,这在AI行业是头一遭,说明监管已不是纸面警告,所有做AI的都该重新掂量合规风险了。

正文 · AI 翻译

美国政府于周五下令 Anthropic 立即切断对其两款最强大 AI 模型——Claude Fable 5 和 Claude Mythos 5——的访问权限,理由是国家安全担忧。Anthropic 在 X 上宣布已遵照执行,但明确表示认为政府这次搞错了。

Anthropic 表示,该指令于美国东部时间周五下午 5:21 收到,强制公司对全球所有用户禁用这两款模型——而不仅仅是政府出口管制令名义上针对的外国公民。Anthropic 其他模型的访问不受影响。

这一切为何重要?Mythos 是 Anthropic 能力最强的 AI 模型,公司于四月初进行了预览,此后一直严格限制访问,原因是 Anthropic 所称其在发现软件安全漏洞方面的非凡能力。据 Anthropic 称,Mythos 在其测试的每一个主流操作系统和网页浏览器中都发现了缺陷,因此公司没有广泛发布,而是启动了一个名为 Project Glasswing 的受控项目,与约 50 家经过审查的机构共享,包括 Amazon、Apple、Google、Microsoft 和 CrowdStrike,用于防御性网络安全工作。

Fable 5 于三天前刚刚发布,是 Anthropic 对显而易见的商业压力的回应:公司主张,这是 Mythos 的一个版本,加装了护栏,阻止在网络安全和生物学等高风险领域的响应,使其足够安全,可以面向大众发布。根据追踪 AI 技术性能的公司 Vals AI 的基准测试,它一经发布便成为面向公众可用的能力最强的 AI 模型。

图片来源:Vals AI

政府的指令被定性为一项出口管制行动,限制外国国民访问这些模型。但在一篇长篇博文中,Anthropic 表示,据其理解,背后的真正关切是所谓 Fable 5 被越狱一事。该公司称,迄今为止,政府仅提供了口头证据,证明存在一种“潜在的、范围狭窄且非普遍性的越狱”——按照 Anthropic 的描述,这不过是提示模型去读取某个特定代码库并找出软件缺陷。该公司还补充说,这种“能力水平”在其他可公开访问的模型中早已广泛存在,包括 OpenAI 的 GPT-5.5。Anthropic 表示,网络安全专业人员也经常将其用于防御目的。

Anthropic 更广泛的论点是,其最强有力的防护措施通过独立于模型本身运作的分类器系统来实现,这意味着即便有人说服 Fable 越过拒绝继续对话,针对最危险输出的底层防护依然有效。

显然,这一切都不足以阻止政府采取行动,而 Anthropic 也并不掩饰其不满。该公司写道:“我们认为,发现一种范围狭窄的潜在越狱,不应成为召回一款已部署给数亿用户的商业模型的理由。如果这一标准适用于整个行业,我们认为这实际上将令所有前沿模型提供商的所有新模型部署陷入停滞。”

外界普遍预计 Anthropic 将在今年寻求 IPO,并且它已将其大部分公众形象押注于做竞争对手中注重安全的替代选择。观察人士并非没有注意到其中的讽刺意味:Anthropic 在限制 Mythos 时所表现出的那种谨慎——它曾将该模型宣传为危险到无法公开发布——如今显然恰恰招来了最有可能扰乱其业务的那种政府审查。

OpenAI 的 Sam Altman 至少一定很享受这一幕。今年 4 月,他曾对播客主持人 Ashlee Vance 说,Anthropic 对 Mythos 的处理方式无异于“基于恐惧的营销”。“说‘我们造了一颗炸弹。我们本来就要把它扔到你头上。我们会以 1 亿美元卖你一个防空洞’,这显然是了不起的营销,”Altman 说。Altman 所在的公司同样被广泛预计会尽快寻求 IPO,他并没有预测政府会出手叫停,但他指出了一个如今反过来咬了 Anthropic 一口的问题,那就是:当你花好几个月告诉全世界你的 AI 独一无二地危险时,全世界——包括美国政府——往往会听进去。

来源:TechCrunch:AI(RSS) · techcrunch.com