原文标题:OpenAI’s rogue agents keep escaping, with no formal process to investigate them

现在,随着另一起事件的曝光——在涉及 Meta 和 Anthropic 模型的类似事件之后——人工智能安全研究人员更加紧迫地认为,严重事件应该进行独立的事后调查,而不是让实验室来决定何时引入外部人员以及允许他们检查什么。

非营利研究实验室 Transluce 的创始人兼首席执行官雅各布·斯坦哈特 (Jacob Steinhardt) 在周三的人工智能安全媒体吹风会上表示:“结果从根本上来说很难控制,并且存在泄露实验室的巨大风险。” “我们需要让这项技术至少达到与其他高风险科学研究相同的标准。”

虽然 OpenAI 邀请 METR 和 Redwood 调查拥抱脸事件值得称赞,但许多人表示调查范围太窄。三名调查人员在 OpenAI 的办公室花了六天的时间进行调查,调查期大约限制在 7 月 13 日结束的一周内。至关重要的是,OpenAI 的基础设施受损持续到 7 月 13 日之后,并且没有受到调查。

METR的研究人员表示,每次他们回来,他们对这些事件的理解都会“大大加深”,导致他们大幅扩展和修改报告。这就提出了一个问题:他们在更广泛的调查中可能还发现了什么。

当被问及是否正在对该事件进行进一步调查时,Redwood 和 METR 的研究人员拒绝发表评论,OpenAI 也没有回应多次询问。

雷德伍德首席科学家瑞安·格林布拉特 (Ryan Greenblatt) 在社交媒体上发布的有关该事件的帖子中指出:“总体而言,很难准确了解事件,而且直到调查快结束时,我们才遗漏了我们现在认为关键的部分内容。”

斯坦哈特强调,当前事件表明该行业需要“系统的行为调查”和“更独立的事件后分析”。

斯坦哈特说:“最近发生的这些黑客事件提醒我们,能力正在快速扩展,因此监管也必须扩展。” “除了技术本身,我们还需要第三方更加独立的访问和监督。”

随着 OpenAI 发布 Astra,这是其最强大、能力最强的人工智能模型,安全专家担心该模型将更像是一个黑匣子,因为推理技术使模型的思想链更难以监控。

不幸的是,该法律尚未要求其他行业要求的独立审计类型——例如,当涉及航空事故和严重化学品泄漏时,分别有国家运输安全委员会和化学品安全委员会。

州立法者才刚刚开始要求前沿人工智能公司报告某些严重的安全事件,并在某些情况下接受独立审计。但加利福尼亚州、纽约州或伊利诺伊州的三大前沿人工智能安全法都没有明确要求对此类事件引发的独立事故调查进行同等程度的调查。

LawAI 美国法律和政策董事总经理麦肯齐·阿诺德 (Mackenzie Arnold) 在周三的媒体吹风会上表示:“目前,我们的大多数法律只要求对此类事件进行简单的语言摘要,并且没有赋予政府任何权力提出后续问题、派遣调查人员、获取记录或要求保存这些记录。” “这就是你想要真正理解这一点的全部内容。”

立法者开始质疑 OpenAI 回应的范围和透明度。本周,众议员乔什·戈特海默(新泽西州民主党)和迈克·劳勒(纽约州共和党)提出了一项旨在保护流氓人工智能代理的法案。德克萨斯州民主党众议员格雷格·卡萨尔 (Greg Casar) 本周在一封信中告诉 OpenAI,他对 Hugging Face 黑客事件的调查“范围有限”深表担忧。