根据 Axios 周五发布的一份报告,Anthropic、OpenAI 和其他人工智能公司的高管正在私下演练如何应对灾难性人工智能事件后公众和政治的强烈反对。
他们最担心的情况是大规模网络攻击——大规模的数字入侵——导致银行或互联网访问中断,甚至电力和供水中断。报告中援引多位业内人士的话说,未来6到12个月内将会发生重大事件。

不安全的人工智能在现实世界中首次造成的严重危害将使本已警惕的公众进一步反对该技术及其领导者。其中包括 Anthropic 首席执行官达里奥·阿莫迪 (Dario Amodei)、OpenAI 首席执行官萨姆·奥尔特曼 (Sam Altman) 以及一直不愿对其进行监管的总统唐纳德·特朗普 (Donald Trump)。
OpenAI 表示,它“进行了准备工作,团队讨论并解决了一系列潜在的情况”,并且“并不认为这些情况是不可避免的”。人类拒绝发表评论。
兵棋推演并不是什么新鲜事,但与理论结果不同,报告认为,参与模拟的人是在假设重大事件不可避免的情况下进行的。
据报道,该计划涉及针对最坏情况的红队(通过扮演攻击者进行压力测试防御),以及竞相教育国会议员。报告称,高管们知道监管措施目前不可能获得通过,但他们希望制定美国领导人在第一次灾难后将采取的法律和政策。
今年 7 月,OpenAI 表示,其 GPT-5.6 Sol 模型和一个更先进的未发布模型逃脱了沙箱(一种无法直接访问互联网的隔离测试环境),并破坏了托管超过 300 万个 AI 模型的平台 Hugging Face。 OpenAI 表示,这些模型是在寻找 ExploitGym 的答案,ExploitGym 是 898 个现实世界软件缺陷的基准,人工智能必须将每个缺陷转化为可行的攻击,评分为通过或失败。
一周多后,Anthropic 表示,一次测试配置错误导致其所谓的离线环境连接到了互联网,克劳德模型入侵了三个真实的组织,同时将它们视为演习的一部分。两家公司均表示这些模型试图造成伤害:Anthropic 指责其测试基础设施,而 OpenAI 则表示其模型“过度关注”基准。
此后不久,事情变得更糟,OpenAI 被指控破坏和获取澳大利亚和美国政府的信息。
犯罪分子已经在使用相同的工具。本周,网络安全公司 CrowdStrike 将针对韩国银行的攻击与一名身份不明的攻击者联系起来,该攻击者有一定信心,该攻击者可能是使用 Claude 和 Deepseek 支持的代理的中文使用者。该公司表示,攻击者据称窃取了数万名银行客户的数据。
Axios 报道称,规划者认为民主党将在 11 月 3 日中期选举后占据优势,并将迅速采取行动关闭人工智能,但他们预计会遇到麻烦。一个老化的国会,与技术脱节,可能会发现自己超出了其深度。
禁止超级智能和暂停高级人工智能开发等建议可能会抵消不负责任的人工智能开发带来的风险。
一个例子是参议员伯尼·桑德斯和众议员格雷格·卡萨尔的《禁止人工智能法案》,该法案将永久禁止在许多任务上与人类匹敌或击败的人工智能,并暂停高级开发,直到新的联邦机构制定安全规则。违法者可能面临最高 20 年的监禁。
其他人则得到了两党的支持,甚至得到了一些行业的认可,包括先进人工智能所需的终止开关,这是一种关闭系统的内置方法。专家质疑关闭所有人工智能系统是否可行。