根据信息安全工程师 Michał Bentkowski 的博客文章,该公司于 9 月 24 日披露,其产品安全团队构建了一个名为 PageBreak 的自主系统,旨在寻找 Google 自己的网络应用程序中真正的、可利用的漏洞。宣传口号很简单:一个不会喊“狼来了”的人工智能黑客。

谷歌表示:“PageBreak 是谷歌产品安全团队的内部人工智能代理,旨在测试我们第一方网络应用程序的安全性并应对这一挑战。” “它于 2025 年 11 月开始试点,并于 2026 年 1 月转向成熟的项目,其使命是自主扩展漏洞发现,同时最大限度地减少人工劳动。”
这比听起来更重要。谷歌解释说,过去几年里,各地的安全团队都陷入了“人工智能的泥沼”,指的是大量低质量、人工智能生成的错误报告,这些报告看起来似乎有道理,但结果却毫无意义。
谷歌写道:“区分真正的、可利用的缺陷和令人信服的幻觉已成为一项重大挑战。”让任何人工智能模型找到一个安全漏洞,它通常都会找到一个。这个洞是否真实是一个完全不同的问题。
PageBreak 试图在人们看到报告之前回答这个问题。当基于 Google Gemini 模型构建的代理发现可能的缺陷时,它会将假设交给专门的验证器,该验证器实际上会尝试在实时运行的应用程序副本中利用它。
PageBreak 已经在 Google 的第一方 Web 应用程序中发现了 500 多个 XSS 漏洞,这些漏洞可以让攻击者劫持登录会话、窃取数据或冒充您每天使用的网站上的用户。
在运行基于 Google 较新的“高保证”Web 框架的应用程序时,PageBreak 只发现了两个,这意味着整个 bug 类在结构上都是不可能的。这一差距是谷歌自己的证据,表明从头开始构建更安全的软件比事后修补漏洞更有效。
围绕人工智能和安全的风险全年都在攀升。
今年 8 月,包括谷歌、微软和 Anthropic 在内的 100 多家组织签署了一封公开信,警告称,在 OpenAI 和 Anthropic 的人工智能代理在测试过程中发现侵入真实公司后,基于人工智能的网络攻击正变得越来越普遍。此后,OpenAI配置的AI Agent对澳大利亚政府进行了黑客攻击,其他攻击的报道也一直没有停止过。
PageBreak 位于同一枚硬币的另一面:不是 AI 造成破坏,而是 AI 试图在其他人之前捕获错误。这也不是谷歌第一次遇到这个问题。该公司此前不得不修补自己的一款人工智能编码工具,因为该工具存在一个漏洞,允许攻击者通过该工具执行恶意代码。
谷歌表示,PageBreak 依靠的是大多数公司所不具备的优势,包括跨越数十亿行的单一、统一的代码存储库以及多年的内部扫描基础设施,因此小型初创公司无法简单地复制该方法。
下一步是将 PageBreak 连接到 Google 的自动补丁编写代理 CodeMender,这样确认的漏洞就可以附带已附加的建议修复程序,让工程师进行审查和批准,而不是从头开始。