原文标题:Meta rolls out new AI tools to detect ads that secretly lead to child sexual abuse material
Meta 周三宣布,将在 2026 年上半年对 Facebook 和 Instagram 上的 3320 万条儿童性剥削内容采取行动。与此同时,该公司正在推出新的人工智能工具,以查找可能用于秘密引导人们观看非法儿童虐待材料的广告和帐户。
该公司表示,Meta 所处理的内容中有超过 97% 是在用户报告之前被其系统发现的。在印度,Meta 同期处理了 530 万条儿童性剥削内容,其中 98% 以上是在用户举报之前发现的。
Meta 表示,其最新的人工智能工具针对的是那些使用看似无害的广告将用户引导至 Meta 平台之外的非法内容的人。
该公司推出了一种新的大型语言模型(LLM)系统来检测所谓的“路标”。这是指看似正常但涉嫌将用户引导至网上其他地方的非法内容或其他有害活动的广告。 Meta 表示,这是最近不良行为者使用的一种策略,因为他们不断改变方法以避免被发现。虽然广告本身可能不包含非法内容,但它们仍然可以充当非法内容的门户
托管儿童性虐待材料的网站。
因此,Meta 表示,它现在正在关注广告将用户发送到何处,而不仅仅是广告包含的内容。该公司可以使用这些信息来阻止违反其规则的网站或其他目的地,并对它们背后的帐户采取行动。
Meta 还使用额外的人工智能驱动扫描来查找早期系统可能遗漏的儿童剥削内容。该公司表示,随着更多地了解这些网络的运作方式,它将继续添加新信号。
另一个新工具是“红队人工智能代理”,用于测试 Meta 自身的安全措施。它寻找不良行为者可能利用的弱点来绕过公司的保护。 Meta 表示,这可以帮助它在新的滥用方法变得更加普遍之前找到新的滥用方法。
此外,该公司正在改进其系统,以寻找在以前的帐户被删除后使用新帐户返回其平台的人。
这些新措施出台之际,Meta 继续面临其平台上儿童安全的压力。该公司因其社交媒体服务可能给年轻用户带来的风险而面临立法者的诉讼和批评。八月,
Meta 达成协议,支付高达 180 亿美元来和解涉及美国 29 个州的儿童安全诉讼,解决有关保护网络儿童的担忧。
Meta 今年推出了多项儿童安全功能,包括 Meta AI 的家长控制、WhatsApp 上的青少年账户,以及当孩子在 Instagram 上搜索自残内容时向家长发出警报。
9 月,WhatsApp 为家长增加了更多控制功能。他们可以限制青少年使用频道的方式,控制谁可以看到他们的状态更新,并决定谁可以将他们的孩子添加到群组中。家长还可以选择接收有关某些团体活动的通知。