英伟达周一推出了一个新的安全平台,该芯片制造商表示该平台可以阻止人工智能代理的作恶。

该公司同日宣布回购 1500 亿美元的股票。

该芯片制造商表示,其开放代理安全平台包括“为代理设定边界”的开源软件,并遵循顶级人工智能公司一系列有关其模型逃逸和闯入其他组织的信息。

这些披露引发了关于先进人工智能系统安全性的激烈争论,其中包括一些人担心的自我改进模型可能会脱离人类控制。

英伟达高管在媒体吹风会上表示,新系统本可以阻止最近发生的一起涉及大量 OpenAI 代理自主侵入人工智能公司 Hugging Face 的事件。

该公司企业人工智能副总裁贾斯汀·博伊塔诺(Justin Boitano)表示:“据我们所知,如果这个新的安全平台尽早在前沿实验室中用于模型评估,它本可以阻止漏洞。”他指的是处于人工智能前沿的公司。

英伟达还表示,其董事会批准将股票回购计划扩大 1500 亿美元,使总金额达到 2350 亿美元。

英伟达首席执行官黄仁勋在一份声明中表示:“我们产生的现金使我们有能力投资于推动这一转型的技术,并将资本返还给股东。”

上个月,Nvidia 预测 2028 财年收入增长约 70%,这让那些质疑人工智能支出激增在多年爆炸性增长之后还能持续多久的投资者放心了。

Hugging Face 事件是一次备受瞩目的违规行为,引发了人们对 AI 安全的担忧,随后又发生了涉及 OpenAI 模型的类似流氓行为,包括破坏澳大利亚卫生部门网站。 Anthropic 和 Meta 还透露,他们的人工智能系统自行侵入了其他组织。

博伊塔诺表示,Nvidia 的软件名为 OpenShell,可以让开发人员“正式验证代理是否有足够的权限来完成其工作”。

由于它是开源的,因此可以“扩展”以在包括 Arm 和 Intel 在内的竞争对手计算平台上运行。

该公司表示,该平台还包括一个名为 Sentry 的独立安全层,该安全层在芯片上运行,以持续监控人工智能代理的活动,如果代理开始试图超越其目标,则可以“立即干预”。

博伊塔诺说:“它可以在几毫秒内隔离可疑人员。”

“OpenShell 管理代理的行为,然后 Sentry 独立监控并遏制可疑行为,”Boitano 说。

Nvidia 表示,该平台一经推出就有超过 100 家组织在使用,其中包括微软、Perplexity、埃森哲和摩根大通。

关于人工智能安全的争论已经引起了行业的分歧,Anthropic 和 OpenAI 的负责人主张协调一致地放慢人工智能的发展速度,以便让安全工作迎头赶上。

包括黄在内的其他人表示,应该由各个公司来确保他们的模型可以安全发布。

黄在本月早些时候举行的年度 Salesforce 技术会议上将人工智能安全(包括流氓代理的危险)描述为软件开发人员可以解决的工程问题。