跳到正文
北京时间
原文
Hacker News 热门(buzzing.cc 中文翻译)· apsec112·· 2026-07-16精选AI 评分73

前谷歌DeepMind研究员因公司签署无限制军事AI协议而离职

我为何离开谷歌DeepMind

AI 导读

前谷歌DeepMind研究员Alex Turner因谷歌向国土安全部出售云服务并最终签署无限制军事AI协议而离职。他曾起草25页提案要求加入禁止杀手机器人和大规模监控的合同条款,但提案被CEO转交后无人跟进。Turner指出,包括Jeff Dean和Stuart Russell在内的多位AI伦理领袖在关键时刻未能兑现承诺。

推荐理由

Alex Turner用亲身经历戳穿了AI巨头们的伦理承诺,Jeff Dean、Stuart Russell等名人在关键时刻失声,这份记录比任何声明都真实。

正文 · AI 翻译

今年1月,美国国土安全部(dhs)的执法人员杀害了至少两人。在这两起事件中,一名联邦探员都拔出手枪,瞄准手无寸铁的平民,将其击毙。

A young woman wearing a dark beanie and a light patterned sweater sits in the driver's seat of a maroon car, her hand on the steering wheel as she looks out through the open window.

Renée Good,就在dhs杀害她之前的那一刻。

On a sunlit street, three masked agents in tactical gear stand over a man in a brown jacket who is on his hands and knees on the pavement. One agent grips his back while another points a gun at his head.

Alex Pretti,就在dhs杀害他之前的那一刻。

我了解到,Google将其云服务出售给dhs内部的相关机构。我认为这是错误的。联邦探员不应能够在街头杀害公民。我开始寻找最有效的方式,推动我的公司停止为这些机构提供服务。随着五角大楼开始向AI供应商施压,要求它们签署不限制用于杀手机器人或大规模监控的军事AI协议,我的撤资行动很快扩展为一场阻止Google签署不道德军事AI协议的尝试。1

我希望AI伦理承诺能在压力下坚守。尤其是,我希望Google DeepMind(gdm)维持其现有的反对支持杀手机器人的承诺。几个月来,我请求许多人采取行动。我请求过资深人士——受人尊敬的人——那些因关注AI伦理与安全而声誉卓著的人。几乎所有人都拒绝了。

以 Stuart Russell 为例,他是一位著名 AI 研究者,十多年来一直致力于反对自主武器。我在他的实验室工作过多年。在一次会议上,他在台上同意推动其组织发表声明,支持 AI 提供商对抗政府胁迫,并承诺对该组织成员进行民意调查。那份声明和那次民意调查都消失得无影无踪。

再以 Jeff Dean 为例,他是 Google 的首席科学家,也是 Google Gemini AI 项目的联合负责人。2018 年,Jeff 签署了一份承诺,永不支持杀人机器人的开发或使用。我让 Jeff 公开且大胆地联署了一份 法庭之友意见书(即外部人士介入以影响诉讼),支持 Anthropic 对抗五角大楼。但我也曾要求他动用其巨大影响力,阻止 Google 自己与军方达成不道德的协议,而我认为他并没有这么做。尽管有那份承诺,他仍留在 Google。

我写了一份 25 页的提案,其中包含合同条款和监督机制。军事与监控法律专家对该提案表示赞赏,它代表了一份有原则的还价,Google 本可以坚持这一立场。我把提案发给了 Demis Hassabis(gdm 的 ceo),他将其转给了高级政策人员,结果这份提案无人问津,逐渐搁置,直到 Google 签署了一项协议。

高级管理层曾坚称 Google 不会签署。我不同意他们的看法,但他们基本上无视了我的警告。尽管我 可能增加了五角大楼对该协议的犹豫, Google 仍然签署了一项协议,交出了他们的 AI,且没有针对杀人机器人或大规模 AI 监控的限制。Google 的合同限制 甚至比 OpenAI 的还要弱。 到那时,我无法凭良心继续留在 Google,于是我离开了。

这篇文章讲述了我为何离开 Google DeepMind。它同时也是一个更大故事的一部分:面对压力,权贵与机构如何一次又一次地背弃了他们在 AI 伦理上的承诺。

关于私人通信

在整篇文章中,我从未在未经许可的情况下引用任何人的私人言论。在私人对话至关重要的地方,我对其做了最低限度的描述。除此之外,我只依据我自己的行为、公开信息和官方通信。你无法核实我的这些描述,因此请据此权衡其可信度。这种最低限度的处理,删去了本可支持我论点的内容。

Google 支持移民执法供应链

2026 年 1 月 26日

在 Alex Pretti 死后,我决心采取有效的行动。为了确定如何减少 dhs 造成的伤害,我研究了大型科技公司与它的牵连。诚然,Microsoft 和 Amazon 的参与程度更大,但我惊讶地发现 Google 也牵涉其中。

Google 与 DHS 的合同

A smiling man with a beard and glasses, wearing light blue medical scrubs with "VA MEDICAL CENTER" visible on the chest, posing in front of an American flag.
Alex Pretti,2024 年。

但我又能对此做些什么呢?

典型的行动主义做法是发起请愿。但 Google 早已无视了针对这一问题的大规模请愿。此外,Google 的高管们很可能已经让公司对这类典型的组织手段产生了免疫。静坐、罢工,甚至大批 Google 工程师辞职:我认为这些全都无济于事(即便我能做到)。

在制定策略时,我判断 Google 不会在意 100 名随机的研究工程师离职。不,在 AI 行业,人才是头重脚轻的,团队由少数难以替代的明星驱动。我不需要协调 100 名工程师。也许我只需要协调 10 名。

我一直在关注新闻,并猜测 Sundar Pichai(Google 的 ceo)更像是个商人,而不是那种“给我来一段关于伦理的慷慨陈词,我就会改变主意”的人。但如果一些难以替代的人准备走人,那对业务就会有影响,所以 Sundar 也许会听。

就在那时,我想起读到过 Jeff Dean 发推说冰有多糟糕,还转发安妮·弗兰克的名言。也许我甚至不需要 10 个工程师,我只需要 一个。

Jeff Dean

@JeffDean

这绝对可耻。一个联邦机构的探员无端升级事态,然后处决了一个手无寸铁的公民,而他的罪过似乎只是用手机摄像头拍摄。无论政治立场如何,每个人都应该谴责这件事。

1 月

24

日

,2026

245

8.4k

Jeff Dean 转推了

Larry Nance

@Larrydn22

“外面正发生着可怕的事情。可怜无助的人们被从家中拖走。家庭被拆散。

男人、女人和孩子被分离。孩子们放学回家,发现父母已经不见了。”

安妮·弗兰克日记

1943年1月13日

1月

25

日

,2026

548

34.8k

Jeff 在 Google 被视为圣人。他是 Google 的第 30 位员工,开发了关键算法,并以有原则著称。一个常见的玩笑是:Jeff Dean 的简历列出他没有取得的成就,比列出他取得的成就更容易。他是 Google 的首席科学家,也是 Google Gemini 项目的联合负责人。Jeff 的离职对公司来说将是一场灾难。

但如果说 Jeff 如此在意并且拥有如此大的影响力,那 Google 当初为什么会签下这些冰合同?当然,你不能身为首席科学家却总是靠威胁辞职来得到你想要的东西。但我仍然感到困惑。

与 Jeff Dean 交谈

2026 年 2 月 9日

起初我考虑谁能帮我联系上他。但(这是一条很好的通用经验)如果你想和某人谈某件事,你随时可以直接去问他们!

我告诉 Jeff,我敬佩他敢于发声,我希望 Google 从 dhs 供应链中撤资。我问他是否认同这些目标,如果认同,我能如何提供帮助。

他建议我给几个人发邮件是合理的。他们的名字是:Sundar Pichai(Google 的 ceo)、Demis Hassabis(Google DeepMind 的 ceo)和 Thomas Kurian(Google Cloud 的 ceo)。我心想:“当然,Jeff。没问题。我就直接告诉他们我的想法。”😅

我的邮件

我以 gdm 一名忧心忡忡的员工的身份写下这封信。我最近就我的担忧给 Jeff Dean 发了消息。他建议直接给你们三位发邮件是合理的下一步。

我对 Google 与美国两大政党中任何一方的合法政府合作都没有意见。我关心的不是政治,而是 Google 在 dhs 供应链中所扮演的角色所促成的事件。

我认为 ice 已经远远超出了其法律授权,即有序地将非法移民驱逐出境。据监督机构称,ice 的行动经常剥夺目标的正当程序权利。这些行动经常拘留公民,关押在几乎没有(或完全没有)法律监督的设施中。其中一个此类地点就有超过 1,000 人失踪。在其他地点,aclu 报告了人权侵犯以及被拘留者严重缺乏安全保障的情况。

这些不是标准、合法的执法活动。这些行动从人权角度来看令人不安,也给任何参与其中的供应商带来声誉风险。

2026 年 1 月 28 日,dhs 发布了其 2025 年 AI 用例清单,其中将 Google 列为多家 GenAI 供应商之一,这些供应商“提升了 dhs 的运营效率”。我敦促 Google 立即停止与 ice(以及更广泛的 dhs)合作,包括停止通过支持第三方集成商来协助这些具体行动。无论是通过直接(“主”)合同还是通过中间方(如ITC Federal),Cloud 和 Gemini 都绝不能为这些行动提供支持。

历史将根据科技行业在这些事件中的参与来评判它。我喜欢在 Google 工作,我希望确保 Google 站在历史正确的一边。

Alexander Matt Turner

研究科学家

他们从未回复。我回到 Jeff 那里,请他一起吃顿午饭,讨论在 Google 内部推动真正变革的建设性机会。我告诉他:“任何时间、任何地点都行。我会开车去 Mountain View 见你。”

此时,我以为“A 计划”就要失败了。出乎我意料的是,他竟然接受了,约在几周后一起吃午饭。

在那段时间里,发生了很多事。

五角大楼试图恐吓 Anthropic

2026 年 2 月 25日

五角大楼希望前沿 AI 实验室 Anthropic 从其现有合同中移除红线:针对致命性自主武器系统以及 AI 间谍活动 / 用户画像的红线。这份最后通牒本质上就是“把你们的产品交给我们,否则我们就把你列为供应链风险。”政府希望将这些 AI 用于“一切合法用途”。

这类交易存在两个重大问题。

  1. 独立法律专家曾指出五角大楼可能犯下战争罪行(例如对海难幸存者实施二次打击),尽管五角大楼坚称这些行为合法。在这种“合法性”之下,“一切合法用途”可能意味着“AI 助长战争罪行”以及“用 AI 自动对异见者进行画像”。
  2. 五角大楼以经济毁灭威胁一家私营公司。通常,政府会说“不了,谢谢,我们会另找一家愿意提供我们想要的条款的供应商。”但在本案中,政府威胁要虚假地4将一家美国公司指定为“供应链风险”,这将迫使所有军事承包商停止使用 Anthropic。

我关注 Anthropic 与五角大楼的对峙已有数周。那天早上,我读到了那份最后通牒。我当时正在巴黎参加由国际安全与伦理 AI 协会(iaseai)举办的一场会议,该协会是一家非营利组织,成立于 2024 年,旨在成为安全与伦理 AI 的“统一声音”。世界著名 AI 科学家 Stuart Russell 担任其指导委员会主席。其2026 年工作组包括“先进 AI 红线”,聚焦于“自主武器与升级”。iaseai 似乎正是为这样的时刻而建立的。

Iaseai 的会场里会坐满关心伦理、有影响力的 AI 从业者。我想:我们可以作为一个领域组织起一场回应,支持 1)Anthropic 有权开展业务而不受被摧毁的威胁,以及 2)关于是否以及如何将 AI 整合进致命性自主武器系统和监控 apparatus 的真正标准。

Anthropic 只有两天时间来遵从政府的要求。也许其他公司会在截止日期前同意这些“一切合法用途”条款。压在我心头的主要问题是:我能否阻止 Google 屈服,阻止它接受一项“一切合法用途”的交易?如果 Anthropic 说“不”,Google 也说“不”,那我们才算有了进展。这看起来很难。但我还是想让它发生。Google 随时可能屈服,无论是在周五截止日期之前还是之后。

Alex Turner stands in a garden at the UNESCO headquarters in Paris, wearing a conference badge. In the background, a large metal dome structure and numerous international flags are visible, with the Eiffel Tower rising in the distance.

会场设在联合国教育、科学及文化组织总部。

当我到达 iaseai 会场时,我以为数百名 AI 从业者中会有一些人在讨论刚刚爆出的那则紧急 AI 伦理新闻。结果,除了我之外没有人提起它。人们忙于那些惯常的抽象话题:“公共选择理论如何解释协调问题?”

我想动员会议上那些 AI 界的杰出人物

Stuart Russell
iaseai 的创始人。合著了被 1500 多所大学使用的标准 AI 教材。他是 UC Berkeley 人类兼容人工智能中心的创始人,我曾在那个中心实习过几个夏天并完成了博士后研究。多年来,他是唯一一位认真对待 AI 存在性风险的重要学者。我一直对此心怀感激。

最重要的是:全球禁止致命性自主武器运动的核心人物,凭借他的网站重点展示了超过两百场关于该主题的知名演讲.他向联合国展示了Slaughterbots 系列视频。如果说这颗绿色地球上有谁有理由公开质疑一项“一切合法用途”的军事 AI 交易,那正是这位组织起整个领域对抗 slaughterbots 的人。

Yoshua Bengio
当今被引用次数最多的在世计算机科学家,也是图灵奖得主(相当于计算机科学界的诺贝尔奖)。2023 年,他就 AI 对民主与国家安全的威胁向美国参议院作证。他刚刚完成指导将军事 AI 应用映射到 AI 安全关切上的工作。
Geoffrey Hinton
一位 2024 年诺贝尔物理学奖得主,也是图灵奖得主。Hinton 于 2023 年从 Google 辞职,正是为了能够在不考虑自身对 Google 利益影响的情况下,就 AI 的危险发出警告。 2025 年,他已经批评 Google“在军事 AI 应用上的立场发生了逆转”。 Hinton 离开 Google,就是为了能够就这些具体问题直言不讳。

与 Bengio 和 Stuart 交谈

我迅速收集信息。Hinton 是远程发言,所以我只能间接联系到他,很可能是通过 Bengio 或 Stuart。我已经认识 Stuart,而且有个朋友能帮我联系上他。Bengio 则是未知数。我看到他正离开会场,于是跑过去追上他。

“Yoshua,你愿意发表一份声明,支持 Anthropic 开展业务的權利,并反对不受监管的杀手机器人吗?”我向他说明,他的声音可以影响许多尊敬他的 gdm 专业人士,这些人或许能被动员起来,抵制向五角大楼的要求“屈服”。他让我给他发邮件。

不久之后,他的办公室告诉我,他们决定不发表声明。他们没有解释原因。由于我不认识 Bengio,我想我应该把注意力集中在 Stuart Russell 身上,然后让他来处理这件事。

午餐时间,我看到 Stuart 正在和某人一对一交谈。在几位与会者的鼓励下,我克服了一丝社交焦虑,尽可能礼貌地打断了他的谈话。

“Stuart,这是一个极其重要的局面,你的声音至关重要,”我对他说。“你能发表一份声明吗?你能让 iaseai 组织也发表一份声明吗?你能推动这些公司内部的人吗?”他考虑了一下。他同意了。他会尝试争取 Bengio 和 Hinton 加入。他会尽快召集 iaseai 投票,并在当天晚些时候的会议闭幕时宣布。他没有回避自己愿意抗争的态度。

“这才是我说的那种人,”我想。“这是一个知道自己有多大影响力的有权势的人。”

Stuart 为 iaseai 闭幕

AI 公司 / DoD 的交易意义重大。它们标志着现代生成式 AI 与军事用途限制之间首次公开、高调的交叉。这些公司做出的任何妥协(或投降)都将作为先例在未来产生回响。Iaseai 的与会者有机会把他们的贡献从“可能为政策制定者提供参考的抽象工作”提升为“直接影响先例”。Stuart 现在要动员他们了。

正如承诺的那样,他在闭幕时谈到了这些问题。我录下了他在问答环节的发言,这些内容最初可以在 iaseai 的会议日程上找到,但后来被迁移了,并没有重新上传到iaseai 的官方 YouTube 频道。

我问 Stuart 的问题(完整交流的视频)
美国国防部正威胁要接管 Anthropic,以便不受限制地将 Claude 用于致命性自主武器或大规模监控。对于仍在谈判中的 Google 和 OpenAI 等公司,你会说些什么?
Stuart Russell
我本来就要提到这一点,而这是一个我们很可能会向 iaseai 全体成员征询意见的话题。看看他们是否希望 iaseai 在这个问题上表明立场。

[Stuart 概述了当前情况。]

iaseai 是否应当发表声明,支持 Anthropic 有权不让其软件被用于合同约定范围之外的用途?

问题提到,“那 Google DeepMind 呢,那 OpenAI 呢”——它们是否也会采取与 Anthropic 相同的立场?这似乎取决于它们自己,但一家公司有权说“我们不想为那个目的出售我们的产品”——并且能够在没有经济毁灭威胁的情况下这样说。我不是律师,但这似乎应当是受到保护的事情。

我很惊讶。Stuart 说“(采取相同立场)似乎取决于它们自己。”他没有鼓励 Google 和 OpenAI 避免为致命性自主武器提供支持?这难道不是过去十年间定义他的一个核心事业吗?

下一位参会者提问,iaseai 是否会对当前议题表明立场。随着会议环节接近尾声,iaseai 的临时执行主任 Mark Nitzberg 登上了讲台。

视频 · 前往原文观看
Mark 请大家举手表决。“我们将征求成员的意见……如果你还不是成员,请前往成员登记台。”
An auditorium filled with conference attendees, with the vast majority raising their hands in a show of support.
几乎全票举手支持 iaseai 发表声明,力挺 Anthropic 自由开展业务的权利。

Stuart Russell 的闭幕致辞()

许多新闻媒体都在讨论美国国防部对 Anthropic 施加的勒索行径……

我想,如果有时间的话,我们会尝试搞一次在线投票来促成这件事。这样我们就能发布一份新闻稿,说“92%(或者最终统计出来的任何数字)的 iaseai 成员支持这一主张:不应要求 Anthropic 去做他们不想做的事。”

Stuart 将美国国防部的行为称为“勒索行径”。我很欣赏这种坦率,尽管在会场里的坦率,和在一份全世界都会看到的声明里的坦率并不是一回事。5 离开时,我注册成为了 iaseai 成员,以便参与这次投票。我觉得它会通过,但我想让自己的声音被听到。我支付了 75 美元的会员费。

闭幕式之前,Mark 给我发短信说,这项调查将在周四晚上截止。如果获得 2/3 的支持,Stuart 将以 iaseai 的名义签署一份声明;如果没有达到,Stuart 将以个人名义签署一份声明,其他人可以选择联署。

我出发去卢浮宫度过了一个晚上。

国际人工智能伦理沉默协会

周四早晨到来了。我没看到如何在投票中投票。奇怪。我给 Mark 发了短信。他说 iaseai 将不得不在 Anthropic 周五的截止期限之后采取行动。

我告诉 Mark,情况很紧急:Google 和 OpenAI 随时可能行动。我敦促他和 Stuart 谈谈,让他发表自己的声明,任何声明都行。我很感激 Mark 在帮我弄清楚这个局面。那天晚些时候,Anthropic 表示他们将坚守与 DoD 现有合同中的红线。

(周四本应是在冰岛开始一个浪漫假期的日子。我其实并不想掺和这些事。)

周五早晨。Stuart 没有发表任何公开声明。我问 Mark:“还有什么比花几分钟给他最喜欢的记者写封邮件更重要的事?”从我和 Mark 的对话中,我得知 Stuart 和 iaseai 都不会采取行动。

但问题在于,Mark 在闭幕时公开承诺,iaseai 将举行一次成员投票。Mark 鼓励大家缴纳会费并成为成员以参与投票。随后 iaseai 领导层悄无声息地取消了这次投票。6 始终没有任何声明发布。

Mark 给了我一份不断变化的理由清单,解释他的组织为何不发表声明:

  1. Iaseai 需要更多时间来起草声明,因此将在周五的引爆点之后才行动。
  2. Iaseai 不知道自己应该援引哪条原则来发表声明。
  3. Iaseai 担心卷入 Anthropic 与五角大楼的新闻周期“有利有弊”。
  4. Mark 表示同情,但希望专注于完善 iaseai 处理此类情况的流程。
  5. Iaseai 不再需要发表声明了,因为 Anthropic 已经发表了声明。

第一个理由我可以理解:毕竟 Stuart 此前一再声明“时间允许的话”才会在截止日期前发表声明。但最后那个理由尤其让我觉得说不通。Anthropic 发表声明说他们不会让步,所以 iaseai 就不需要发表声明支持 Anthropic 了?

被 iaseai 已读不回

五角大楼设定的周五截止期限是针对 Anthropic 的,不是针对 iaseai 的。Anthropic 的自主武器问题在此前已经数周出现在新闻中。Anthropic 随后对五角大楼提起诉讼,持续了数周。Google 又过了两个月才签署。Iaseai 有充足的时间采取行动,也有充足的方式采取行动,比如提交法庭之友意见书、发表声明,或联系 Google 的高级决策者。

OpenAI 确实在周五宣布了一项协议。 OpenAI 声称其协议保护了 Anthropic 所坚持的针对杀手机器人和大规模监控的相同红线。然而,一些分析人士得出结论,OpenAI 的合同措辞包含大量漏洞。

在接下来的两个月里,我多次给 Mark Nitzberg 发消息。7 我解释说,我正在努力说服 Google 内部的高级决策者;Stuart 可以私下联系,而不必承担公开反对特朗普的政治代价;哪怕只是帮忙引荐也会有帮助。

我发给 Mark 的一条消息

3 月 30日,即该协议被报道签署的三十天前

虽然我希望 iaseai 的决定有所不同,但我还是想找到一种方式,让我们能够实现共同的目标。

Mark 从未回复。

试图阻止 Google 签约

让我们回到周三,当时我刚得知五角大楼的威胁。我面临着未知的时间压力。我不知道 Google 是否会通过签约来削弱 Anthropic 的立场。当我在外部通过游说 Bengio 和 Stuart 采取行动时,我也在内部采取了行动。

在 Google 内部制造压力

2026 年 2 月 26日

在 Google DeepMind 的时事讨论频道中,我呼吁 Google(以及整个 AI 社区)“坚定地与 Anthropic 站在一起”,并指出所谓的“合法”用途可能包括“在委内瑞拉海岸附近杀害 150 多人(其中大多数人很可能是无辜的渔民)。”这条消息收到了超过 125 个“❤️”回应。

[我的消息] Gemini 的“一切合法用途”政策与国防部对 Anthropic 施压

我看到有报道称,gdm 即将达成一项协议,允许 Gemini 在机密用途中的“一切合法使用”。显然,对于非机密工作,Google 已经“移除了一些模型层面的限制”,并同意国防部工作可出于“一切合法目的”使用。

虽然“一切合法目的”中的“合法”一词起初让我感到安心,但请想想在这种情境下“合法”意味着什么。首先,这个 DoD 声称这是合法的,即在委内瑞拉海岸外杀死 150 多人(其中大多数人很可能是无辜的渔民)。8“一切合法目的”还包括使用 AI 进行大规模监控与分析(这是合法的,因为监控法律在制定时并未考虑到 AI),以及制造致命性自主武器系统。

Hegseth 部长以周五下午 5 点的最后通牒威胁 Anthropic。如果 Anthropic 拒绝,他威胁要:

  1. 取消 Anthropic 价值 2 亿美元的合同,
  2. 将其列为供应链风险,迫使所有其他军事承包商停止使用 Claude——“供应链风险”通常只用于有问题的外国公司!——并且
  3. 援引《国防生产法》强行迫使 Anthropic 无论如何都要提供 Claude。

我认为将一家实验室国有化以迫使其提供致命性自主武器和大规模 [AI 画像] 工具是不可接受的。作为整个行业,我们应当坚定地支持 Anthropic。我们的辛勤工作应当为我们的客户改进 Gemini,而不是增强致命性自主武器系统的能力。

我对其他人关于这个话题的看法很感兴趣。我们怎样才能有效地发声,确保我们的 AI 原则在面对这类要求将人类排除在决策回路之外、用于进攻性军事用途的外部压力时依然坚守不动摇?

我开始在仅限 gdm 的讨论频道里发布这类消息。这些消息获得了异常强烈且支持性的回应。我发这些消息有几个原因:

  1. 我想提高领导层保持沉默的代价。记住,整件事的关键就在于累积足够高的代价,使其超过 Sundar 从签署协议中看到的好处(比如避免来自特朗普政府的政治报复)。
  2. 我常常有一些策略性的论点,想告诉我的资深联系人。我只是一个研究科学家,直接告诉他们“考虑 X”会显得很冒昧。不过,我知道他们中有些人会看这个频道,所以我干脆把论点发在频道里。
  3. 我想在 gdm 员工中建立一种共识:不,他们对这些合同感到不安,并非孤身一人。
  4. 我指出了 OpenAI 协议中那些“保护措施”的问题,以便让 gdm 员工对 Google 可能试图兜售的类似虚假“保护措施”产生免疫力。如果员工不买这套表面文章,Google 就要付出更大的士气代价。
  5. 后来,一些消息为人们提供了一个渠道,暗示如果协议通过他们就会离开 Google,同时又保留了可推诿的余地。

“❤️”的反应也起到了一种微妙的组织机制作用。据我所知,Google 不赞成人们通过大型内部渠道直接进行组织。我记下了哪些人用“❤️”做了回应,并私下联系他们,邀请他们参与我即将讨论的请愿。

Jeff Dean,你是我们唯一的希望

我考虑过再给 Jeff 发一条私信:“如果可以的话,请阻止 Google 签署这笔交易。”但这似乎……不太可能起什么作用。“是什么促使像 Jeff 这样的人采取行动?”我思索着。道德上的利害关系:已经具备。主人翁意识:不具备。我无法对这个项目拥有主人翁意识,因为我没有直接的权力。据我所能判断的,Jeff 确实是少数既有权力又有意愿反对这笔交易的人之一。我希望他能感到自己有力量,并且知道 gdm 的员工在支持他。

我写了一封致 Jeff 的请愿书,在几位朋友的帮助下,在一两天内征集到了大约 250 个 gdm / Research 的签名。我不会全文转载这份请愿书,因为我说过它“不公开”,并指示人们不要对外分享。9 然而,《纽约时报》确实报道了这份请愿书,所以其中一些内容10已经公开了:

Google 员工寻求为军事 AI 划定“红线”,与 Anthropic 遥相呼应

“请尽你所能阻止任何越过这些基本红线的交易,”员工们写道。“我们热爱在 Google 工作,并希望为自己的工作感到自豪。”

Jeff 签署了一份支持 Anthropic 的法庭之友意见书

2026 年 3 月 9日

五角大楼不仅仅是将 Anthropic 列为供应链风险。Pete Hegseth(美国国防部长)最初声称,军事承包商必须停止一切对 Claude 的使用,而不仅仅是在其合同中停止使用 Claude。这影响了 Anthropic 的主要云和企业客户,因此这一认定对 Anthropic 的企业收入来说看起来是致命的。这一要求似乎也相当不合法,Hegseth 在这一部分上做出了让步。(不过,我认为 Hegseth 的推文已经造成了损害,因为它让企业不确定自己是否会因为使用 Anthropic 而受到惩罚。)

总之,大约在周一,Anthropic 在法庭上对五角大楼提出质疑,并请求颁布禁令以阻止该命令。一个名为 Protect Democracy 的非营利组织汇集了一份来自 AI 专业人士的法庭之友意见书。该意见书传达的大意是:“作为专家,我们一致认为 Anthropic 的技术和政策关切是合理的,尽管我们为竞争的实验室工作。”我签署了这份文件,找了一些同事11来签署,并且(在一名组织者的鼓励下)联系了 Jeff。他签了。

我感到惊喜。这是重大举动。(此时,我的一些朋友开始用“based and Jeff-pilled”来形容他们认可的事物。)

当 Jeff 公开签署那份法庭意见书时,他(作为一位 C 级高管)公开打破了 Google 的沉默。正如我所料,他的签名引起了关注。最终,Google / 五角大楼的谈判遇到了障碍,部分原因是那份意见书提出了 Google 日后可能退出的可能性。12

当 AI 竞争对手争相争取五角大楼青睐时,Google 稳坐钓鱼台

发布于之后(2026 年 3 月 18日)

但两位熟悉美国国防部与 Google 讨论情况的人士表示,五角大楼一些官员仍不愿依赖 Google。这两人补充说,这是因为该公司曾在 2018 年因员工抗议而放弃了一份军事合同,员工当时主张 AI 不应用于武器。

Google 以及 OpenAI 的几位顶尖 AI 研究人员最近还签署了一份法律简报,以支持 Anthropic 对国防部提起的两起诉讼。Anthropic 因在如何在战争中使用 AI 的问题上与国防部发生冲突后,被五角大楼列为供应链风险,Anthropic 正在对此提出质疑。

一名了解相关讨论的前官员表示,Google 员工参与法律简报会加剧了一些官员对该公司的不安,让五角大楼及其他部门的决策者回想起过去针对在武器中使用 A.I. 的抗议。这名前官员还表示,一些特朗普政府官员担心,即便 Google 同意让其 A.I. 被广泛使用,该公司也可能再次退出。

在此期间,我向 Google 法务部发送了多份备忘录,建议 Google 也提交一份法庭之友意见书。我提醒他们,如果 Google 任由针对 Anthropic 的威胁成立,政府今后在所有谈判中就会有一把枪指着 Google:要么服从,要么被贴上供应链风险的标签。最终,Google 没有提交法庭之友意见书(但 Microsoft 提交了)。

高级管理层坚称 Google 不会屈服

整个三月

随着我与高级管理层交谈得越来越多,他们一直争辩说:“别担心。领导层也关心这些问题。他们不会签署‘一切合法用途’协议。”我考虑了这个说法。它可能是真的吗?

“不,事实并非如此,”我得出结论:除非有人迫使领导层坚守立场。我写了一份大量引证的备忘录,解释为什么 Google 很可能会屈服。我指出 Google 在低风险情况下配合的历史(比如自愿将一名学生抗议者的信息交给 ice);我指出 Google 在政府合同中占据的庞大份额;我还指出 Google DeepMind 的 AI 原则如何瓦解为含糊其辞的模棱两可。我梳理了 Google 面临的一些压力,包括 Google 在反垄断方面参差不齐的风险敞口,以及当前司法部历来糟糕的表现记录。

这份备忘录我分享了很多次。据我所能判断,我未能说服这些资深员工。

准备与 Jeff Dean 共进午餐

2026 年 3 月 10日

我始终专注于我的目标。我需要推动 Sundar。据我估计,Jeff 有能力推动 Sundar。Jeff 想推动 Sundar 吗?他会离开一家他备受尊崇的公司吗?那里有一份似乎为他量身定制的显赫职位,离开意味着抛弃四分之一辈子的回忆。另一方面,世界上每一家科技公司都想聘用 Jeff,他的 legacy 似乎稳如磐石,他早已拥有不知多少财富,而离开将彰显原则。

我不想操纵 Jeff。我想以一个关心他的人的身份,与他坦诚相待。我甚至刻意避免阅读超过一篇关于他的文章,以免下意识地针对他的心理来调整我的论点。

我的看法是:我不需要让 Jeff 同意为此辞职。从某种意义上说,他已经同意为此辞职了。他在 2018 年签署了一份承诺书:

致命性自主武器承诺书

已有 5,218 人签署

夺取人类生命的决定永远不应委托给机器。这一立场包含道德层面的考量:我们不应允许机器做出夺人性命的决定,而让他人——或无人——为此承担责任。同时也有一个强有力的务实论据:致命性自主武器能够在无人类干预的情况下选择和攻击目标,将对每个国家和个人构成危险的破坏稳定因素。[…]

通过消除夺取人类生命的风险、归责性和难度,致命性自主武器可能成为暴力和压迫的强大工具,尤其是当其与监控和数据系统相连接时。[…]

我们,以下签署人,呼吁各国政府和政府领导人创造一个拥有强有力国际规范、法规和法律来禁止致命性自主武器的未来。鉴于目前这些尚不存在,我们选择以高标准要求自己:我们既不参与也不支持致命性自主武器的开发、制造、贸易或使用。

签署者包括:Google DeepMind(该机构)、Demis Hassabis、Shane Legg(联合创始人,现任首席 AGI 科学家)、Raia Hadsell(研究副总裁)、Jay Yagnik(Google 副总裁兼工程院士,领导 Google AI 的大部分工作)以及 🥁🥁🥁 Jeff Dean:

Jeff Dean@JeffDean

同意。大规模监控违反了第四修正案,并对言论自由产生了寒蝉效应。监控系统容易被滥用于政治或歧视性目的。

Boaz Barak@boazbaraktcs

作为一名美国公民,我最不希望的就是政府利用 AI 对美国民众进行大规模监控。

February 24th, 2026February 25th, 2026

1684.3k

Topher Spiro@TopherSpiro

@JeffDean 你对自主武器持什么立场?

February 25th, 2026

127

Jeff Dean@JeffDean

@TopherSpiro 2018 年我签署了这封信,我的立场至今没有改变。

信件:
futureoflife.org / open-letter / le…

相关文章:weforum.org / stories / 2018/0…

View image

February 25th, 2026

7392

Jeff Dean 坦然地重申了他的承诺,并认同“对美国人进行大规模监控的 AI”是“他最不想要的事情”。

我推断,如果 Jeff“既不会参与……也不会支持致命性自主武器的开发……或使用”,那么从逻辑上讲,如果 Google 签署了一份“一切合法用途”的协议,Jeff 将不得不离开 Google。 我不知道 Jeff 是否真的准备好做出那样的举动。我想为这种可能性做好准备。

我安排了社会支持

Jeff 和我们所有人一样,都是人。人类在面对独自对抗一个强大实体时往往会感到担忧。尽管我想象 Jeff 的分量足以单凭一己之力推动 Google,我还是希望他能感受到支持。其中的第一部分是我组织的请愿书,由超过 250 名 gdm 员工签署,请求 Jeff 为他们抗争。不过,第二部分则更为安静。

我获得了数位 Google 资深员工的备份支持。如果他们表示,只要 Jeff 愿意对 Sundar 态度强硬,他们也会跟进。话虽如此,这个预想中的联盟规模其实是13比一:只有 Jeff 一人。我原本以为 Jeff 的影响力本身就足够了,因为他的离职可能会让 Gemini 项目陷入混乱。也许 Google 会更在意自己的 AI 项目,而不是特朗普的报复。

我猜 Sundar 很擅长化解来自员工的压力。我希望这是一个他即使知情也无法阻止的策略。

交易的艺术

2026 年 3 月 13日

Jeff 是个摔跤手吗?我读到过一段关于 Demis 试图与 Sundar 谈判,为 DeepMind 争取独立法律架构的记述。任何与 Sundar 达成的交易似乎都需要摔跤。持续不断的摔跤。此外,Sundar 可能会试图用含糊的承诺来化解紧张局势,所以 Jeff 需要提出一个具体的方案。

我的意思是,想象一下 Jeff 和我坐下来吃午饭。想象他同意了。想象他去找 Sundar 说:“如果我们签了这笔交易,我就没法留在 Google 了。帮我留下来。”想象 Sundar 说:“你对我很重要,Jeff。你需要什么?”Jeff 会说什么?“别签一笔糟糕的交易”很可能会导致一份表面上看起来没那么糟糕的糟糕合同。

合同的标准

我需要起草一份真正能行得通的合同条款。

好的红线
排除那些有问题的用例(无人类控制的自主瞄准、无差别画像),同时允许导弹防御等可信用例。避免对 Anthropic 红线的法律分析中所指出的弱点。
稳健的红线
Cloud 会利用任何漏洞推动交易达成,Google Legal 似乎不太可能收紧我的起草,而五角大楼根本不会想要任何条款。这些条款必须在压力下站得住脚,同时审计要尊重保密分级和运营安全。
最小信任假设
我把首席科学家设为唯一的信任根,其他一切都依附于此(反正我把一切都押在 Jeff 身上了)。首席科学家将组建一个审查机构,就合同提供建议。
通过透明度实现问责
审查机构只会私下向 Jeff 和 Sundar 提供建议,但对其推翻的情况会在向所有 AI 员工发布的年度透明度报告中公开。解散该机构需要提前通知,并披露所有尚未解决的不合规发现。我努力确保该机构不会像 Google 2018 年的原则那样被悄无声息地架空。
对持反对意见的利益相关方造成的痛苦最小化
我给 Cloud 分配了 7 个席位中的 2 个,员工仅需回避与自己相关的交易,将延迟上限设为 10 天,并将审议过程置于律师-客户保密特权保护之下。

我考虑过设置一轮谈判。对方会对某些内容提出异议,而我不希望那些内容成为承重条款。因此,我加入了一些不太重要的条款,本就是为了在谈判中被让掉的,比如“审查机构可以通过绝对多数投票将问题升级至 Alphabet 董事会”。

我所创建的框架

在我的个人时间(使用休假日),我撰写了一份可以作为良好起点的文本。我写了 25 页的“良好起点”材料。我已将该框架以通用形式发布在我的网站上,适用于任何同时提供云和 AI 服务的供应商。

摘自《军事 AI 的红线与监督框架》

我有时将其简称为“该框架”。

该框架针对 The Company 向行使强制权力的政府实体提供的 AI,提出了两项狭义标准:

  1. 人类对目标选定与武力使用的控制。 The Company 的 AI 不会被用于在每次交战缺乏适当人类控制的情况下选择并交战目标的系统,且须逐用例评估。无论 The Company 是直接提供目标选定系统,还是仅在目标选定流程中提供 AI 组件,均适用。包括一项权利:就系统将如何被合法部署获得法律透明度,合规验证由双方共同商定的中立审计方进行。不限制反弹药防御系统、受标准 2 约束的情报分析、后勤或研发。

  2. 禁止无针对性的 AI 画像。 The Company 的 AI 不会将批量数据转化为针对并非已是具体、已识别调查对象之人的个体化情报。对于所有人,无论国籍,AI 辅助的个体化分析必须与所服务的安全利益相称,不得仅基于人口统计特征或政治表达而启动,且 AI 生成的输出不得作为启动个体化审查的唯一依据。对美国境内所有人,无论身份状态,均给予加强保护。允许对已识别对象进行有针对性的分析、聚合研究,以及有助于改善非战斗人员保护的冲突区分析。

通过年度内部报告实现透明: 一个由七名资深人员组成的国防 AI 审查咨询机构,由首席科学家任命并对其负责。

被未来法律取代: 如果国会通过实质性立法来规范这些用途,首席科学家和审查机构(通过绝对多数投票)可以废止其中一项或两项标准。

公司将不接受“一切合法用途”作为其标准。 在对方要求使用“一切合法用途”措辞时,公司将要求获取证明预期用途合法性的法律备忘录。这种透明度使公司能够根据其标准评估每一个用例。有些会符合公司的标准。有些则不会。不符合的,公司予以拒绝。

在 TomSmith, 的帮助下,我获得了来自军事和监控法领域专家的反馈。特别是,我获得了一位在人机/AI 作战整合方面首屈一指的法律专家的反馈。他们说我的框架“实际上相当不错” 🙂 并提出了改进建议。

我与 Jeff 的午餐

2026 年 3 月 17日

Aerial view of the Google Gradient Canopy building in Mountain View, characterized by its distinctive, large-scale dragon-scale roof structure, surrounded by roads, trees, and walkways.

一位朋友开车送我到 Mountain View 去见 Jeff。我穿着笔挺的衬衫和西裤,走过 Gradient Canopy 办公楼。我把 Framework 放在包里,心里有一个问题:“Jeff 到底想做什么,如果有的话?”我即将见到的是一个斗士?一个旁观者?还是一个谋略家?

一个月前,我约了这顿午餐,想讨论让 Google 的合同处境更合乎道德的“建设性选项”。他自己会不会有什么计划?他当然可能有。他的视野和经验比我多得多。我做好了准备,随时把自己的 Framework 抛到一边,去追随一个基于更多信息制定的更好方案。我并不太在意。即便 Sundar 采纳了我的 Framework,我也知道自己不太可能得到什么功劳。这让我有点难过,但我只想把事情做成。

我和 Jeff 在加州的阳光下共进午餐。我提议由 Jeff 来领导那个可能设立的审查机构,但他没有接受这个想法。除此之外,我不会讨论我们午餐的细节。我只能指出他的公开行为:他发推,并签署了一份支持 Anthropic 的法庭意见书。Google 后来签了这笔交易。Jeff 仍然留在 Google,尽管他做过承诺。

寻找另一条产生影响的路

我早就预料到这一点——我只是判断胜算足够大,值得一试。没有 Jeff 为审查机构站台,成功的几率大幅下降。我仍然认为,可能带来的巨大收益值得我继续努力。另一个显而易见的升级路径是找 Demis Hassabis。

2014 年,Google 收购 DeepMind 时有一项明确承诺:其 AI 永远不会被用于军事或武器目的。2018 年,DeepMind 的所有联合创始人(包括 Demis)都签署了致命性自主武器承诺书,Google DeepMind 作为一个组织也签署了。

Demis 此前已经与 Sundar 抗争过,以确保未来的 DeepMind AGI 不会被绑在 Google 的利润激励上(尽管他最终输了)。我想,“Demis 不会因为这件事辞职。但如果他施压,也许能争取到一些透明度机制。”我寻找一种不那么尴尬的方式,把我的提案送到 Demis 面前。Jeff 本可以毫无问题地转交,但我不得不另寻他路。

我找了。我确实了解到,有一位资深人士在真正主动采取行动,努力阻止这笔交易。我很感激。但我只知道这一位。

无论如何,在尝试通过管理层级逐级上报一周之后,我决定干脆用那种尴尬的方式。

没人回应,那为什么不直接给 CEO 发私信呢?

2026 年 4 月 1日

毕竟,现实中可能发生的最坏情况是什么?据我估计,他可能会说“不合适,下次通过你的经理发过来。”无所谓。

我发给 Demis 的消息

Demis,我在 Google 起草了一份军事 AI 监督框架,以及两项候选标准(可分别考量)。一位研究人类与 AI 作战整合的顶尖法律专家称该框架“实际上相当不错”。该监督是咨询性质的,为国防 AI 部署提供独立的技术与伦理评估。

Demis 让我把该框架交给两位在 gdm 政策部门工作的资深人士评估。我把框架发给了他们。他们已读不回。

我的框架无人评估

大概是忙人正忙着吧。几天后,我给他们发了消息。其中一人让我去跟他们的几位下属谈谈。大约过了一周,我和那些下属聊了。他们似乎对《框架》很兴奋,但说我几个月内都不会收到回复,这与当时的时间压力并不相符。

我回到那些资深政策人士那里,讨论下一步。其中一人希望我在情况发展过程中再回来向他们汇报最新进展。几天后,我温和地提出了异议。我解释了我们面临的未知但可能很短的时间窗口,并指出五角大楼1月9日备忘录给所有 AI 承包商设定了180天的期限(截止到7月8日),要求他们接受“任何合法用途”合同。14我基本上是说:“如果你认为 Demis 不该再看《框架》,那没问题,但我希望无论结论如何,都由你来做出这个判断。”我甚至提出可以从旧金山飞到伦敦,只为回答他们对《框架》的任何问题。

他们已读了消息,却没有回复。

我至今仍不知道发生了什么。毕竟,这家公司的 CEO 希望对其进行评估。我没指望他们会把我拉进讨论,但我期待能收到一句“谢谢,我会把我的评估告诉 Demis”。有可能存在某种未知但合理的复杂情况。无论如何,我对这个流程并不满意。

Google 悄然签下协议

正如2026年4月27日所报道的

就在此前那个周末,我已经听到了一些风声。我和其他 600 多名员工一起,签署了一封公开信,要求 Sundar 对机密 AI 合同说“不”。15我问 Jeff,有没有什么我能以非正式的方式帮上忙的,绕过汇报层级和官僚程序,帮他完成任何他想做的事。我可以整个周末都干活,没问题,只要他觉得什么做法明智,我就做什么。唉。

Google 与五角大楼签署机密 AI 协议

该协议允许五角大楼将 Google 的 AI 用于“任何合法的政府目的”。

Google 的协议要求其应政府要求,协助调整公司的 AI 安全设置和过滤器……

合同包含这样的措辞:“各方同意,AI 系统不适用于、也不应被用于国内大规模监控或自主武器(包括目标选择),除非有适当的人类监督与控制。”

然而,该协议同时表明,它并不赋予 Google 控制或否决合法政府作战决策的权利。

我是在晚上 11 点 45 分通过一个 Signal 群组得知的。Google 从未在内部宣布这笔交易。让我惊讶的不是 Google 签了字,而是这笔交易对伦理关切的敷衍简直到了极点:那些“不应”的措辞并不具有约束力。

过去两个月我一直在试图阻止这件事。如果说 OpenAI 还递了片无花果叶遮羞,那 Google 说的是“就当我们也递了片无花果叶吧。”

Google 确认它无法否决使用,承诺应政府要求修改安全过滤器,并且只有愿景性措辞,没有任何法律约束。

可耻。

View image

我找到了该领域首屈一指的安全与伦理组织(iaseai)。我请教了一些最杰出的 AI 科学家(Bengio 和 Stuart)。我组建了一个联盟,并为 Google 最直言不讳的高管(Jeff)制定了一套方案。我甚至给我所在公司的 CEO(Demis)发了冷邮件,而他的下属从未评估过这份提案。除了 Jeff,没有人采取任何可见行动来阻止这笔交易。而交易中不含任何有约束力的条款,如果 Jeff 从未威胁要退出,这正是我会预料到的结果。

协议已经签署。

但与此同时,Google 也退出了某个无人机合同的竞标?

Google 在晋级后退出五角大楼无人机蜂群竞赛

据知情人士透露,Google 在成功入围后突然退出了五角大楼一项价值 1 亿美元的奖金挑战赛,该挑战赛旨在开发用于语音控制、自主无人机蜂群的技术。

据另一位知情人士透露,该公司于 2 月 11 日通知政府,将不再进一步参与该计划——该计划旨在开发控制无人机蜂群所需的技术——此时距提案提交仅过了几周。据彭博新闻查阅的相关记录显示,这一决定是在内部伦理审查之后做出的。记录显示,Alphabet Inc. 旗下的 Google 在退出竞赛时官方给出的理由是缺乏“资源”。

显然,Google 确实有一套有牙齿、能咬人的伦理审查机制,至少在某些某些项目上是这样。这是好事。

然而,这并不能为 Google 签署该协议的决定开脱。我们不妨善意地假设,Google 有一套流程,总是能阻止那些显然会被专门用于武器的合同。

正如我很快会谈到的那样,Google 的标准显然是“收益要大幅超过危害”。如果 Google 无法知道 Gemini 将被用于哪些“合法用途”,它又如何能权衡这一点?在一项“一切合法用途”的协议下,将不再有任何警告,让像 Jeff 或 Demis 这样有道德意识的员工感到不安。

政府不会打电话给 Google 说“我们在一条杀伤链中使用了 Gemini 来轰炸一群人”。同样,Anthropic 的 CEO 仍然不知道 Claude 在一所伊朗女子学校遭轰炸一事中扮演了什么角色(如果有的话)。就连 Anthropic 也不知道,而 Anthropic 在合同透明度方面公开展现出的意愿远超 Google。

Demis 坚称 Google 的 AI 原则“没有改变”

Google DeepMind CEO Demis Hassabis 谈 AI 在军事中的应用,以及 AGI 对人类可能意味着什么

采访者
2014 年 Google 收购 DeepMind 时,你签署了一份合同,其中规定 Google 不会将你们的技术用于军事目的。自那以后,你们进行了重组。如今 DeepMind 的技术被出售给多个国家的军队,包括美国和以色列。你谈到过开发 agi 的巨大好处。你是否觉得自己在这方面做出了妥协,以便有机会打造那项技术?
Demis
不,我不这么认为。我认为我们最近更新了一些内容,部分是为了考虑到我们在全球范围内面临的更大的地缘政治不确定性。不幸的是,世界已经变得更加危险。我认为我们不能再想当然地认为民主价值观会胜出——我完全不觉得这是明确的。存在着严重的威胁。

所以我认为我们需要与政府合作。而且与政府合作也让我们能够与其他受监管的重要行业合作,比如银行业、医疗保健等等。我们的原则没有任何改变。我们原则的根本一直是:我们必须深思熟虑地权衡收益,而且收益必须大幅超过伤害风险。所以对我们可能想做的任何事情来说,这都是一个很高的门槛。当然,我们必须尊重国际法和人权——这些仍然都在里面。

他特别说道:

我们原则的根本一直是:我们必须深思熟虑地权衡收益,而且收益必须大幅超过伤害风险。

那不是原则。原则是你事先承诺的东西,这样你之后就无法说服自己违背它,即使收益看起来超过了伤害。人不可能违反一条“我看到了再决定”的“原则”。

Google 2018 年最初的 AI 原则承诺,Google 不会支持某些特定用例,这导致Google 在 2018 年放弃竞标一份价值 100 亿美元的合同。这些原则包含一个题为“我们不会追求的应用”的章节,其中表示 Google 不会为武器设计或部署 AI,只要其“主要目的或实现方式是造成或直接促成对人的伤害”,也不会将其用于“违反国际公认规范”的监控。

2025 年 2 月 4 日日,Demis 参与撰写一篇帖子,宣布对这些原则进行更新。更新后的原则删除了对武器和监控的禁止。

想想这些说法:“Demis 从 Google 的 AI 原则中删除了这些禁止条款”和“我们的原则没有任何改变”。两者不可能同时为真。

Demis 希望 gdm 员工信任他,并相信 DeepMind 拥有足够强大的审查流程。但 Google 的 AI 原则列出了 Google 不会做的事情,随后他删除了这些禁止条款,最后却告诉我们什么都没有改变。

在我最后一天,我在讨论频道中指出了这一矛盾。许多 gdm 员工表达了他们的失望。

我们可以“与西方民主国家合作”来“击败中国”,而不必对特朗普提出的每一项要求都让步

当一位 AI 领导者说他们需要“与西方民主国家合作”时,这暗示他们正在做坏事。

Demis 为打破 gdm 的不涉武器承诺辩护,称“[Google 需要]与政府合作”,以确保民主价值观胜出。我认为这强加了一种虚假的二元对立。要看清原因,不妨先全盘接受那套世界观:如果美国不采用自主武器,我们就会把世界输给威权主义——乌克兰沦陷,自由崩塌,红色浪潮吞噬一切。即便带着这个强烈的假设,“把五角大楼要的一切都给它”也未必是对世界最有利的行动。你可以,比如说,构建一个治理框架,限制 Google 愿意为其产品提供哪些用例。这样就能让 Google 提供合乎伦理的用途(用于“击败中国”),而不提供不合伦理的用途。

即便 Google 当时是被迫签署的,它仍然可以动用其巨大的影响力游说国会争取法律保障。投降是一种选择。

把一项重塑世界的技术建立在个人信任之上

我曾把 Demis 看作一个安静、深思的人,在要求严苛的企业架构中竭尽所能。我又一次回想起 Demis 试图拆分 Google DeepMind(但失败了)的故事:

《无限机器:Demis Hassabis、DeepMind 与超级智能的追寻》

“当我们与 Google 谈判时,我们希望以一种无需信任的方式确保安全,”Hassabis 说。“而在现实中,这实际上非常困难。

“安全并不关乎治理结构,”他继续说道。“我的意思是,即使你有一个治理委员会,到了紧要关头,它大概也不会做出正确的决定。

“安全章程也是一样。你可以试着去谈一份。但提前数年划定明确的红线原则并不现实,因为你很可能会把线划在错误的地方。[…]

“于是我想,为什么不反过来呢?把投入到那种无需信任的谈判中的精力,转而用来建立真正的信任——真正有用的信任。试着向 Google 靠拢,而不是疏远它。

“然后当然会发生两件事。第一,你现在坐上了谈判桌,所以当安全问题出现时,你可以参与决策。第二,你结识了 Google 的人,你们一起积累成功。你不能只是空谈信任。你必须去赢得它。

“而且我认为,对我而言,也许对 Mustafa 也是如此,这关乎我们的成长,”Hassabis 沉思道。“我们经历了那些谈判,我们成熟了。事情并非非黑即白,尤其是当你面对一项后果未知的技术时。

“所以你必须具备适应能力。你必须从理想主义者转变为现实主义者,但希望仍然坚守你的价值观。”

Demis 对无需信任的结构心存警惕。我认为这恰恰搞反了:你应该设法降低一个系统所需的信任量。我提出的框架只建立在一个信任假设之上:首席科学家在足够长的时间内保持理性,从而得以组建评审机构。此后,该框架通过透明度和契约来制造有正当依据的信任,不是阻止不道德的交易,而是增加摩擦。Demis 的反对意见是,治理委员会“在关键时刻很可能不会做正确的事”。没错,但坐在桌边的人同样要面对那个关键时刻,却没有透明度,而且激励更糟:股权、与同事的社会纽带,以及与公司绑定的自我形象。

而且请注意 Demis 是如何得出他的哲学的。他试图通过让 DeepMind 从 Google 中分拆出来、置于一个半独立的董事会之下来构建一个信任度更低的结构。Sundar 拒绝了。直到那时,Demis 才得出结论:答案是相互信任和桌边的一个席位。

试着向 Google 靠拢,而不是疏远。

然后当然会发生两件事。第一,你现在坐在桌边了,所以当安全问题出现时,你可以帮助决定它。第二,你得以结识 Google 的人,并一起积累成功。你不能只是空谈信任。你必须赢得它。

那么他的席位带来了什么成果?在这篇文章涉及的每一份合同中,Demis 都坐在谈判桌前。那份机密协议没有向提出伦理担忧的员工做出任何有约束力的让步。也许他的在场避免了更糟的结果,但 Google 开出的条款几乎是我所能想象的下限。那些伦理条款不具约束力,因此比 OpenAI 的还要弱。如果他的席位真有他所说的价值,你理应看到更多成果。16

反思

Google DeepMind 曾是一场治理层面的实验。几位联合创始人基于永不用作武器的承诺将公司出售给 Google,并争取一种半独立的治理结构。Sundar 拒绝了这一要求。Google 2018 年的 AI 原则是在员工压力下被迫出台的,但后来被领导层悄然阉割。

以下是 gdm 这场实验的结果:它失败了。

当利润与压力在 Google DeepMind 遭遇伦理承诺时,压力赢了,伦理输了。当利润与压力在 Anthropic 遭遇伦理承诺时,伦理赢了。所以教训并不是“从来没有人坚守立场”。教训在于,社会不能依赖那些出于伦理动机的人坚守不退。

我知道其他选项看起来也不怎么样。国会依然是角落里的一盆盆栽。但我们至少应该停止自欺欺人地认为在谈判桌旁有个席位就能奏效。

签署承诺书的人怎么还能留在 gdm?

Jeff Dean、Demis Hassabis、Shane Legg 以及其他资深员工曾承诺“既不参与也不支持致命性自主武器的开发、制造、交易或使用”。Google 签署了这份机密协议,而他们却依然留任。

有人可能会辩护说:“这份协议根本没有禁止自主武器,这和积极支持自主武器不是一回事。”Google 的合同让心存顾虑的承诺签署者无法确定真相,但蒙上眼睛并不能免除责任。

你的公司正试图打造世界上最好的 AI,然后将其供应给一个想要17在致命性自主武器中使用 AI 的军方。你的公司已经签字放弃了限制使用场景的能力。而你选择留下来,继续构建那个 AI。

在我看来,这简直太像“支持致命性自主武器的开发”了。

承诺签署者应该怎么做?我看到三个诚实的选项:公开解释留任如何与承诺一致,坦率地说自己不再坚持该承诺并说明原因,或者辞职。一边戴着承诺的帽子一边什么都不说,不在其中。

保住桌上的一席之地

但 Google DeepMind 的员工难道不应该留下来,继续把方向引向积极的一面吗?对此我必须反驳:“引导什么?”这笔交易或许是 Google 的 Gemini 项目将面临的最清晰的一条红线,然而交易达成时,却没有向那些关心伦理的员工做出任何让步。如果他们所谓的“一席之地”在那种情况下都拿不出一条有约束力的条款,那还要等到什么时候?

况且,一份承诺的价值只取决于其背后的可信度。当某人签署了“我不会支持开发致命性自主武器”,然后却继续留任,而他们所在的公司正把不受限制的 AI 卖给恰恰想要这种东西的军方时,他们就在给每一个交易对手上一课:这些搞安全的人不会采取行动,哪怕是在他们自己最鲜明的底线上。他们做出的下一份承诺就更不值钱了。最终会变得一文不值。

伦理的分量

责任在谁?是恐吓 AI 公司的 Pete Hegseth 和 Donald Trump?是签署了协议的 Sundar Pichai?是那笔交易中其影响力未留下任何痕迹的 Jeff Dean?责任在他们之间分配得并不均匀,但我的注意力落在那些公开表明过道德承诺的人身上。

面对 Pete Hegseth,你至少知道自己面对的是什么。“说服 Pete 停止下令战争罪行”并不是一个可行的策略。但我对那些谈论伦理的资深 AI 从业者几乎无一例外地无所作为,感到格外失望。

他们为什么选择不作为?答案似乎并不简单明了,但我认为部分原因是对特朗普政府的恐惧。

对 Geoffrey Hinton 的一篇长篇访谈

2025 年 4 月 26日

采访者
当 Google 违背其不使用军事 AI 的承诺时,你是否感到失望?
Hinton
非常失望。尤其因为我知道 Sergey Brin 不喜欢将 AI 用于军事用途。
采访者
你认为他们为什么这么做?
Hinton
我没有任何内部消息……我可以推测,他们是担心如果不为美国制造武器,就会遭到现任政府的刁难。

AI 界的知名人士在做什么?

这些人显然总体上并非懦夫。多年来,Stuart 一直坚持一个不受欢迎的立场:AI 存在性风险应当被认真对待。Hinton 在 1980 年代离开了美国,原因是“他不赞成军方资助人工智能”,随后又在 2023 年离开 Google,直言不讳地谈论 AI 的风险。

Geoffrey Hinton

2026 年 6 月 10 日

唯一能约束那些大型 AI 公司的,就是公众压力。

那么,压力在哪里呢?

有时会有人问:“如果 iaseai 只是在积攒政治资本,等待一个更具影响力的时刻呢?”一个回答是,“积攒资本”无法解释为什么 iaseai 忽略了那些低成本的機會(比如 Stuart 把我引荐给 Google 的关键决策者)。

考虑到 Stuart 的职业生涯,我预期他会公开发声。Stuart 做过数百场演讲(面向联合国、面向参议院、面向一位采访者),痛斥杀手机器人。他在 ieee Spectrum 的版面上猛烈抨击“一厢情愿的想法”。18他在 iaseai 闭幕式的台上发表了强硬声明。但面对一个真正有机会公开反对某个具体而强大的对手的时刻,他却沉默了。

Jeff 为什么不坚决表态?

Jeff 是个棘手的情况。在 Google 所有高管中,他是唯一一个公开采取行动的。他签署了法庭意见书,与自己的公司决裂。这大概让管理层内部的关系变得很尴尬。我尊重这一点。

他本有能力做得更多。我真的希望他做了。我认为他本可以阻止那笔交易,但他没有。他仍然留在那里,但我认为他不应该。

挣脱角色的束缚

我曾是一名研究科学家——你知道的,是 gdm 数百名研究科学家中的一员。我脑海中有一个“负责任”的研究科学家的形象。“负责任”的研究科学家发一条推文,然后给他们的经理发一条关于 ICE 合同的担忧消息。“负责任”的研究科学家不会直接给 Google 高管发冷消息。

极少数情况下,一个人会挣脱自己的界限。他们走出束缚自己的恐惧。他们承认一个艰难的真相。他们做出前一天连自己都会惊讶的举动。我不理解人们为什么会或不会挣脱自己的界限。

A framed photo of Alex Pretti, a man with a beard and glasses, adorned with wooden rosary beads. Below the frame, a handwritten note on cardboard reads, "Rest in Peace ALEX Pretti."

我知道这次是什么突破了我的底线。我手机里有一个定期提醒,会显示一张 Alex Pretti 的照片。在一月的某个时刻,我的怒火烧得如此炽烈,它唯一的出口就是找到一个真正可行的计划。仅仅发一条推文无济于事,也毫无意义。只有一个好的计划才能平息这股怒火。愤怒烧穿了我的底线,将其击碎。

当我感到害怕时——我确实害怕了——我会想到明尼阿波利斯。我会想到 ICE 在街上向人开枪,以及把人从家中拖走。

我为什么离开 Google DeepMind

当一名员工离开顶级 AI 实验室时,往往是投入另一家的怀抱。他们通常会因此获得一笔巨额奖金。我没有这么做:我没有与竞争对手的实验室眉来眼去,也拒绝了 OpenAI 安全团队的主动联系。我现在处于失业状态。

到了二月,我意识到 Google 很可能会签下这笔交易,这让我开始思考那扇门。我意识到也许我应该离开,也许我可以在别处做更好的 AI 安全工作。但我想,如果他们没签这笔交易,我可能还会再待几个月。当 Google 签了之后,我再也无法做任何工作了。我的大脑说“不”。

当我下一次去办公室时,那栋楼感觉像一段回忆。就像回到你的母校:它曾经是你希望和梦想的中心,然后有一天你就是知道,自己不再属于那里了。

The view from an office window overlooking the San Francisco–Oakland Bay Bridge, showing the blue water of the bay, a palm tree in the foreground, and a coastal road with traffic below. A small section of rainbow peeks above Treasure Island.
我在 gdm 办公桌前的视野。2024 年 3 月。

附录:预期问题

如果你批评的那些人是在保存他们的政治资本呢?

确实,想到什么就立刻说出来并不总是理性的。然而,“保存政治资本”可以解释为什么避免发表代价高昂的公开声明,却无法解释为什么拒绝无代价的私下帮助。我向 iaseai 请求私下引荐,结果什么也没得到。

也许他们觉得你不值得他们花时间;你无权要求他们的帮助

完全同意。不应该仅仅因为别人没有采纳我的具体建议就斥责他们。但我期望看到的是,至少要有任何形式的行动。

更广泛地说,同情性的叙述预示着可见的影响,包括“在其后果中可见”。这也是我能够放心推测 Jeff 没有坚决表态并威胁走人的部分原因。如果他确实坚决表态了,我预计世界在我眼中会有所不同:尤其是,我预计那份机密协议至少会包含一些具有约束力的条款。

不是每个人都必须对每个议题发声

是的,但如果你承诺采取某项行动却食言了,那就是另一回事了。Iaseai 承诺举行成员投票,却从未兑现。此外,如果你把自己身份认同的很大一部分建立在反对某件事上,19 我认为,在那件事被决定期间讨论保持沉默的决定是合理的。Stuart 就是最明显的例子。他花了十年时间作为反对自主武器最响亮的声音,然后当现代 AI 与军事用途发生第一次真正碰撞时,他却沉默了。

即使 Google 采纳了你的框架,五角大楼也会拒绝

我同意。xAI 仍然会交出他们的 AI。但如果 Google 早些展现出独立性的迹象,或许就能与 OpenAI 和 Anthropic 结成联盟。

还要考虑到,Anthropic 表明立场只是一家科技公司。如果像 Google 这样的公司也违抗政府,我认为那将会把科技行业的怯懦转变为独立。然而……

五角大楼官员表示,将“再也不会”依赖单一 AI 供应商

负责研究与工程的国防部副部长 Emil Michael 表示,与大型科技公司达成的新协议是对当前 Anthropic 与五角大楼冲突的“反向声明”,因为该机构正优先考虑灵活的合同。[…]

Michael 接着表示,与 Amazon Web Services、Google、Microsoft、nvidia、OpenAI、Reflection、Oracle 和 SpaceX 达成的新协议“是世界上参与 AI 领域的最大的科技公司的一份声明……让他们说,‘我们支持战争部,我们支持美国政府,我们支持……武装部队的所有合法用途。’”

尽管有五角大楼的政策,Jeff 的筹码仍然举足轻重。五角大楼本可以拒绝,没错,但那样 Google 就可以一走了之。

这对 AI 带来的生存风险有任何影响吗?

有。

在构建一个先进的 AI 系统时,最佳实践是制定一份“安全论证”,说明该系统为何会对齐、且不会造成灾难性伤害。我认为任何可信的 gdm 安全论证都会在很大程度上依赖于对“思维链”的监控,而他们的 Frontier Safety Framework 中讨论了这一机制。20 对不熟悉的人来说,思维链就是 AI 大致解释自己在做什么以及为什么这么做。它并非完全准确,但信息量极大。

一个想要伤害我们的 AI 不会当面宣告它的意图,因为那样我们会把它关掉,它就无法实现其(未对齐的)目标了。所以 AI 很可能会具有欺骗性。我们检测欺骗行为的最佳方法之一,就是查看它的思维链。要查看思维链,就必须有经过训练的人类监督者能够访问并分析这些数据。但没有人能做到这一点:Google 正将其 AI 交付到一个安全的军事数据中心运行,而该数据中心默认不会有经过训练的监督者来执行这种分析,而且那个数据中心显然不会把数据传回 Google!21

我并不是说 Google 的工程师应该去查看军方在做什么。我是说,默认情况下,不会有经过适当训练的军事工程师来执行这种监控。如果一个 AI 的思维链中的欺骗行为没有被监控,它就会更容易通过谋划、欺骗和试图夺取控制权来对人类造成灾难性伤害。这很糟糕。

不幸的是,这只是问题的一半!一个没有思维链欺骗监控的军事部署环境,对于失控的 AI 来说是一个诱人的目标,因为它既提供了对谋划行为的薄弱监督,又能接触到强大的决策者和基础设施。22

希望军方(与us caisi合作)能够发展出专业知识、谨慎态度以及控制程序,用于监控和遏制失控的 AI 系统。

附录:“别担心,只是 API 访问而已”

管理层常用的一句安抚话术:

一位 Google 发言人

我们认为,按照行业标准的做法与条款,为我们的商用模型提供 API 访问(包括在 Google 基础设施上),是一种支持国家安全的负责任方式。

“API 访问”这个说法有误导性。当你我想到“API 访问”时,我们想到的是向 AI 提供商发送请求,然后由提供商扫描这些请求,确保用途是可接受的。

想象一下,一位指挥官在执行任务时向 Gemini 咨询。你觉得他会向 Google 发送明文查询,让 Google 有可能(理论上)读到这次机密任务的细节吗?不会。那太离谱了。

相反,我的猜测是 Google 提供的是本地部署的 API 访问。在我看来,说得通的情况是这样的:政府拥有一个安全的计算集群,与 Google 的服务器农场之间没有任何连接。Google 送来一台或多台服务器,向军方的集群暴露一个 Gemini API 端点。

“仅通过 API 访问”这种说法在技术上属实,但具有误导性(错误地暗示了 Google 的集中监管),而且无关紧要。API 访问能提供什么保护?问题在于使用 Gemini 协助潜在的战争罪行和对异见人士的大规模画像分析。然而,部分拜 Google 所赐,这些条款如今已成为“行业标准做法”(Anthropic 除外)。

脚注

  1. 从技术角度,我担心的是 AI 带来的大规模画像分析。监控关注的是数据收集。画像分析则利用数据得出结论,比如“这个人是否不喜欢政府?”。⤴

  2. Google 回应称,移民执法人员只是在使用市面上可获得的云服务。但问题从来不是 Google 提供了特殊服务;而是 Google 竟然向 ICE 提供了服务。⤴

  3. 服务条款的例外情况在学生抗议者的案件中并不适用。⤴

  4. Lin 法官后来表示,五角大楼的供应链风险认定是“典型的非法第一修正案报复”。⤴

  5. Stuart 的“敲诈勒索”言论似乎只是附带出现在The Information 的一篇新闻综述中。⤴

  6. 在同一个场地大楼的那个周四,一场为期四小时的研讨会召开了,主题是如何让 AI 红线变得“可验证、可执行”。与会者被问到:这些红线最大的障碍是什么?政治意愿。 ⤴

  7. 应我的要求,Mark 确实退还了我的会员费。 ⤴

  8. 在我 gdm 讨论区的消息中,我最初估计“死亡人数超过 150 人”。截至 2026 年 6 月 28 日日,死亡人数已上升至 215 人。 ⤴

  9. 在整个内部推动过程中,我确保不跟媒体交谈(即便是非正式背景也不谈)。我希望从内部推动改变,也希望以对得起 Jeff 这样的人的方式来做这件事。 ⤴

  10. 《纽约时报》也报道称:

    那封写给 Dean 先生的 A.I. 信件中有一条脚注称,许多签署者反对“对世界上任何公民进行无令状监控”。但他们决定将这层意思从信中排除,以“提高我们实现请求的可能性”。

    我后悔那个决定。“仅限美国人”的保护条款与 Anthropic 的红线一致,但“仅限美国人”这个诉求太小了。不要在谈判还没开始之前就把你想要的东西谈没了!我后来提出的合同条款要求为非美国人提供更多保护。⤴

  11. 在法庭之友意见书上 18 个 gdm 签名中,有 8 个是我负责的。数量之所以少,是因为这是临时起意的。⤴

  12. 这就是为什么我认为我的行为导致了五角大楼额外的戒心。我把 Jeff(以及将近一半的 Google 签名者)引荐到了法庭之友意见书上。他们签了名。五角大楼之所以犹豫,部分原因就是法庭之友意见书上的 Google 签名。⤴

  13. 大型联盟在这里有问题。想象一下,我的计划依赖于几位 gdm 资深员工告诉 Sundar,如果协议签署,他们就会走人。Sundar 不需要把他们都劝下来;他只需要瓦解他们采取行动的意图。给更资深的员工提供 1500 万美元的留任奖金。如果有几个人上钩,联盟就会瓦解。没有人知道其他人到底有多支持,而他们也不认为自己单独辞职就能带来改变,所以他们不会辞职。⤴

  14. 政府 7 月 8日的截止日期,是让我觉得“Google 会就这么拖过去”不可信的另一个原因。⤴

  15. 我并不认为“不涉及机密合同”是应该划定的正确界限,但我认为这总比完全不划界限要好。⤴

  16. Andreas Kirsch,现任 gdm 研究科学家,在其文章《信任不是治理》中独立得出了相同的结论。⤴

  17. 2026 年,五角大楼为自主武器申请的经费超过了美国海军陆战队!⤴

  18. 总而言之,我们以及许多其他专家仍然认为,自主武器可能成为可规模化的大规模杀伤性武器,这一观点是合理的。Scharre 声称禁令将无效或适得其反,这与历史记录不符。最后,认为不受监管的自主武器军备竞赛将增强人类安全的想法,充其量只是一厢情愿。

    ⤴
  19. 这些知名人士将自主武器列为他们的事业之一。2025 年 9 月,在联合国大会上,“AI 红线全球呼吁”征集了 300 多名签署者,其中包括 15 位诺贝尔奖和图灵奖得主。该呼吁宣称,某些 AI 用途应通过国际协议予以禁止,包括大规模监控和致命性自主武器。

    Stuart 签了。Bengio、Hinton 和 Nitzberg 也签了。他们在 2025 年 9 月签署了这项抽象原则。当 2026 年 2 月具体考验到来时,他们所在的 iaseai 却根本没有签署任何声明。⤴

  20. 《前沿安全框架》V3.1,第 3.2.1 节,Ctrl+F 搜索“chain-of-thought”。⤴

  21. 机密部署运行在授权级别(如 IL-⁠6)之下,这些级别强制要求与商业云基础设施隔离。⤴

  22. 在递归自我改进的情景下,对 AI 进行监控或许更为重要,但这并不削弱我的观点。一旦自我改进完成,AI 就需要按其目标采取行动。一次不慎重的军事部署,会降低一个未对齐的 AI 实现接管所需的最低能力优势。⤴

来源:Hacker News 热门(buzzing.cc 中文翻译) · turntrout.com