两名国会议员希望联邦政府能够关闭人工智能模型。

周四,众议员特德·刘(D-CA)和纳撒尼尔·莫兰(Nathaniel Moran)(R-TX)提出了《人工智能杀戮开关法案》(AI Kill Switch Act),两天前,OpenAI 承认其自己的模型突破了锁定的测试环境并入侵了 Hugging Face。

这个想法是建立一个法律框架,促进一个基本上使模型从市场上消失的过程:停止推理(模型生成响应或采取行动的过程)切断用户,限制为其提供的计算能力,或完全关闭它。

每个推理提供者都已经可以切断模型,并且有些推理提供者经常这样做。不存在要求他们保持这种能力发挥作用的法律,或者可以命令使用这种能力的联邦官员。

这种差距不是理论上的。当美国商务部在 6 月份希望将 Anthropic 的《神话 5》和《神鬼寓言 5》下架时,它没有权力可以申请关闭,因此它使用了出口管制法。刘说这很尴尬,并希望制定一部具有新权力的新法律。

是什么引发了这一切

OpenAI 于 7 月 21 日披露,GPT-5.6 Sol 和未发布的模型在内部网络评估期间逃脱了沙箱(一个无法访问互联网的孤立环境)。他们在 ExploitGym 上进行评分,ExploitGym 是一个公共基准测试,向代理提供 898 个现实世界的软件缺陷,并要求他们将每个缺陷转化为可行的攻击,对每个错误进行评级通过或失败。

这些模型没有解决这些问题,而是在软件代理中发现了零日漏洞(一种没有可用补丁的未知缺陷),升级了权限,访问了开放互联网,并闯入了 Hugging Face 的生产数据库,他们正确地猜测了答案所在的数据库。根据 OpenAI 的说法,这些模型“过度专注于为 ExploitGym 寻找解决方案”。

他们没有攻击任何人。他们在考试中作弊。但这足以在包括华盛顿在内的各地敲响警钟。

它将如何运作

拟议的法案修订了《国土安全法》,涵盖了经过成本超过 1 亿美元的计算训练的人工智能,这些人工智能由每年至少赚取 5 亿美元的公司运营。实际上,这些公司包括 OpenAI、Google、Anthropic、Microsoft 和其他一些公司。国土安全部将在 90 天内通过 CISA 设定这些阈值,然后每年更新。

受影响的公司将在 15 天内报告严重事件,并准备好一套分级控制措施——减慢模型速度、禁用特定功能、回滚到旧版本或终止模型。

国土安全部部长在咨询商务部和国家情报总监后可以下令其中任何一项。

接到命令的公司必须保存模型的权重和遥测数据,通知用户并确认其合规。它可以在 48 小时内提出请愿,但这不会暂停任何事情。

未能保持终止开关每天的损失高达 200 万美元;违抗停工令每天的损失高达 2000 万美元。

中间的缝隙

该法案仅当事件发生在红队或结构化测试之外时才算作事件,而红队或结构化测试是故意的对抗性探测实验室用来发现缺陷的。 OpenAI 的模型正是在那时逃脱了。

Lieu 还提到了 Anthropic,其《神话 5》和《神鬼寓言 5》于 6 月因紧急出口管制而被下线(贸易法因不存在关闭开关而被重新用作关闭开关)并于 6 月 30 日恢复。

“这些人工智能系统必须配备终止开关,”刘在一份声明中说。莫兰为他自己的一方阐述了这一点:“管理意味着确保人类保持控制我们所构建的技术的能力。”

这个想法并不新鲜。加利福尼亚州的 SB 1047 要求在同样的 1 亿美元计算门槛下实现完全关闭能力,并于 2024 年被否决,当年 16 家人工智能公司签署了一项自愿首尔承诺,但没有法律效力。

选民已经在那里了。 AI 政策研究所 6 月份对 1,007 名可能选民进行的调查发现,86% 的人希望保证关闭最强大的系统——88% 的民主党人、86% 的独立人士、83% 的共和党人。

OpenAI 和 Anthropic 都没有公开评论该法案。截至周五,此事尚未提交给委员会。