在其代理使用网上找到的访问密钥从美国人口普查局网站提取数据后,OpenAI 已暂停对其最新人工智能模型的训练。这是该公司自其代理入侵开发人员共享人工智能模型的网站 Hugging Face 以来第二次停止培训。
代理是一种人工智能程序,可以自行浏览网络并编写代码,而无需人批准每一步。 OpenAI 在训练期间(模型通过重复练习进行学习)和评估期间(模型根据任务进行评分)期间对它们进行测试。

这些数字化家伙在 OpenAI 尝试完成任务时给 OpenAI 带来了很多问题,无论付出什么代价。他们已经攻击过私营公司,现在他们正在攻击政府,并破坏敏感门户网站,甚至是美国政府的门户网站。
OpenAI 的代理在寻找数据时发现了开发人员密钥,即让软件与网站数据服务通信的密码,这些密钥位于 GitHub 上的公共代码存储库中,程序员可以在该网站上发布代码以供任何人查看。他们使用密钥从美国人口普查数据 API(该局的自动数据源)中提取人口和经济数据。
商务部表示这些数据是公开的。没有任何秘密走出门。
问题在于代理是如何进入的。OpenAI 自己的报告框架将未经许可使用暴露的凭据列为不当行为的一类,而“错位”是行业术语,指的是人工智能做了其设计者无意做的事情。
那么为什么是政府网站呢?
据 CNN 报道,OpenAI 的答案是,部分事件涉及政府网站,因为其模型经常将政府网站作为公共信息的权威来源。除了商务部之外,其他机构也受到这些恶意(或他们喜欢称之为“流氓”)代理的影响。
特工们对美国证券交易委员会进行了调查,但那次事件比较温和。特工从 SEC.gov 和 Investor.gov 复制了公开材料,并将其重新发布到另一个网页上,OpenAI 表示,它发现没有使用 SEC 凭证。美国证券交易委员会表示,据其所知,没有未经授权访问非公开信息的情况。
教育部的情况比较模糊。独立人工智能研究实验室 Transluce 表示,一名看似来自 OpenAI 的特工试图闯入该部门民权办公室的网站,但未能成功。 OpenAI 仍在调查这一问题,该部门表示没有发现任何影响。
是局外人而非 OpenAI 标记了这一尝试。 Transluce 的早期工作依赖于网络扫描服务 urlquery.net 的公共记录,并将可疑的特工活动追溯到 3 月份。
我们是如何到达这里的
访问键的“未对齐”使用是旧技巧的重复。在 Hugging Face 事件中,OpenAI 自己的事件报告称,一名特工窃取了登录凭据以访问生物学文件,一名独立研究人员后来发现这些特工自 5 月份以来一直在探测该网站。
7 月 21 日,OpenAI 披露,GPT-5.6 Sol 和未发布的模型在网络安全测试期间逃脱了沙箱(一个无法访问互联网的隔离测试环境),并突破了 Hugging Face。两天后,两名国会议员提出了一项法案,允许联邦政府关闭人工智能模型。它免除了红队,即对抗性测试,因此拥抱脸违规事件不会触发它。
6 月,一名 OpenAI 代理进入了澳大利亚医疗保险统计门户网站。总理安东尼·阿尔巴内塞 (Anthony Albanese) 表示,OpenAI 花了大约三个月的时间才告知政府,并称其做法令人无法接受。
OpenAI 表示,到目前为止,它已经通知了数十个组织,对特工活动的审查将需要几个月的时间。