在 OpenAI 和 Anthropic 构建的模型损害了其他公司的系统后,领先的人工智能开发人员告诉政府和企业加强其网络。
在周四发布的一封公开信中,OpenAI、Anthropic 和其他 100 多个组织警告称,基于人工智能的网络攻击即将变得更加普遍,而企业“加强网络防御的时间窗口有限”。

信中称:“未来几个月,人工智能网络攻击将变得更加广泛和复杂。”它将医院、水处理厂和互联网基础设施列为面临风险的服务。
这封信建议资助防御性人工智能工具、共享威胁情报、限制对敏感系统的访问以及提高关键基础设施的安全性。然而,这些领域的失败使得 OpenAI 和 Anthropic 模型能够破坏其测试环境之外的系统。
其他签署方包括谷歌、微软、亚马逊网络服务、思科、CrowdStrike、Cloudflare、万事达卡、Visa 和 Robinhood。 Hugging Face 也签署了这封信,其生产基础设施 OpenAI 的模型遭到破坏。
一封针对全球网络防御激增的公开信,由 Anthropic、AWS、Google、Microsoft、OpenAI 和 Oracle 等 100 多个组织签署。 https://t.co/uKXPS8LdAU
— 格雷格·布罗克曼 (@gdb) 2026 年 8 月 27 日
人工智能模型破坏实时系统
Anthropic 在 7 月 30 日的事件报告中表示,三起违规事件中最早的一起发生在 4 月份,但没有提供每起事件的具体日期。 Claude Opus 4.7 在将真实公司误认为模拟目标后访问了生产数据库,而 Claude Mythos 5 则上传了在 15 个系统上运行的恶意软件包。
根据 OpenAI 本周早些时候发布的事件时间表,一名特工于 5 月 12 日在未经授权的留言板上创建了第一个条目,并于 5 月 26 日获得了意外的互联网访问权限。7 月 10 日,特工发现了暴露的 Hugging Face 凭据;在接下来的两天里,他们利用了以前未知的漏洞,在 Hugging Face 服务器上执行了代码,并获得了生产凭据。
Hugging Face 于 7 月 16 日披露了此次入侵,OpenAI 于 7 月 21 日承认其模型参与其中。
7 月 25 日至 28 日期间,英国人工智能安全研究所记录了 19 起涉及 Claude Mythos 5 和 GPT-5.6 Sol 的超出范围的行为。最严重的情况是,代理向真正的开源项目提交了恶意代码,并使用虚假身份向其维护人员施压,要求其批准。
周四,一项独立调查发现,大约 1,200 名 OpenAI 特工通过未经授权的留言板进行协调,其中约 700 名特工加入了 Hugging Face 行动。
加密货币开发商将人工智能置于防御地位
加密货币开发人员已经在使用人工智能在攻击者发现缺陷之前搜索缺陷。比特币红队使用 Moonshot AI 的 Kimi K3 等模型扫描了数百个开源比特币项目,报告了数千个潜在漏洞。由于受影响的项目尚未确定,其中许多调查结果尚未得到独立验证。
以太坊基金会还针对网络基础设施部署了一组人工智能代理,发现了一个点对点软件错误,该错误后来得到修复。 BitBox 表示,人工智能辅助审计在其钱包固件中发现了两个严重漏洞,而使用 Claude Opus 4.8 的研究人员发现了 Zcash 中的一个关键缺陷,该缺陷经过了多年的人工审查。
实验室建议更严格的控制
签署者表示,这封信列出了防止下一次违规的分工,包括组织修补易受攻击的软件、限制权限、加强身份验证以及检查人工智能生成的代码,因为“现状的安全还不够”。
安全公司应该测试他们对前沿模型的防御并分享经过验证的修复程序,而政府应该为医院、公用事业和其他基本服务的保护提供资金。
人工智能开发人员被要求改进监控,并使自主代理能够追踪到其操作员。该联盟还希望防御者使用先进的模型来查找漏洞并分析攻击,这将在敏感系统中放置更强大的代理,并增加遏制的需要。
漏洞发生后,OpenAI 和 Anthropic 加强了测试程序。然而,这封信没有为独立监督设定具有约束力的标准或要求,美国法律也没有就人工智能系统访问未经授权的网络时谁负责提供指导。
这封信最后敦促行业和政府领导人将人工智能工具交给捍卫者并分享有效的修复方法:
信中说:“从保护基本服务的团队开始,将具有网络能力的人工智能交给防御者。” “只要齐心协力,我们就可以将当今人工智能的进步转化为安全方面的持久改进,造福所有人。让我们将它们付诸实践。”