原文标题:‘Unprecedented’: OpenAI says AI models autonomously hacked another company
ChatGPT 创建者 OpenAI 表示,其两个最先进的人工智能模型突破了受控测试,并攻击了另一家人工智能公司。
OpenAI 周二表示,“前所未有的网络事件”发生在一次旨在测试其模型网络能力的内部演习中。
相反,由人工智能模型(新发布的 GPT 5.6 Sol 和未发布的“功能更强大”)驱动的自主代理逃离了测试环境并到达了开放互联网。该公司表示,然后它使用窃取的登录详细信息并发现了一个以前未知的安全漏洞来访问 Hugging Face 服务器。
OpenAI 声称,这次黑客攻击代表代理“竭尽全力”检索有助于满足测试目标的信息。
Hugging Face 联合创始人 Clement Delangue 表示,该公司怀疑前沿实验室是这次攻击的幕后黑手,他相信 OpenAI 没有恶意。
“这一切都是自发发生的,真是令人兴奋!”他写道,并补充说这“可能是此类事件的第一例”。
来自德克萨斯州的美国众议院民主党议员格雷格·卡萨尔称这一事件“令人震惊”。
他说:“人工智能发展极其迅速,但没有真正的法规来保证我们的安全。”他呼吁进行强制性独立安全测试、强制披露安全事件以及开展国际合作。
几周前,美国总统唐纳德·特朗普签署了一项行政命令,创建了一个框架,以在最先进的人工智能系统公开发布之前对其国家安全风险进行审查。
专家们多次对人工智能网络攻击和超出人类控制的模型发出警报。上个月,人工智能开发商 Anthropic 敦促业界暂停其最强大系统的开发。