Meta宣布推出一套新的人工智能工具,针对那些广告本身并未明显违规、却被用于将用户引导至托管儿童性虐待材料的外部网站的做法。与此同时,该公司表示,2026年上半年已对Facebook和Instagram上的3320万份涉及儿童性剥削的材料采取措施;其系统在用户举报前发现了其中超过97%。
在印度,Meta同期处理了530万份材料,并表示其中超过98%是通过主动检测发现的。来源提供的数字没有说明与这些材料相关的账户或广告数量,但反映出该公司越来越依赖在人工举报到来前进行自动检测。
监测目的地,而不仅是广告
这款新工具最突出的功能,是依靠基于大型语言模型的系统,检测Meta所称的“隐性指引”(signposting)。这一术语指的是一些看似普通的广告,但被怀疑被用作通往公司平台外非法内容或有害活动的入口。
按照这一新方法,Meta不再只分析广告本身的内容,还会检查广告将用户引向的目的地。如果发现相关网站或目的地违反公司规定,Meta可以对其进行屏蔽,并对背后的账户采取措施。Meta表示,这一改变源于其注意到不法方正在不断改进手法,以规避传统检测工具。
主动攻击测试与追踪回归账户
该公司还利用人工智能支持的额外扫描行动,寻找其既有系统可能未发现的材料,并在更好地了解这些网络的运作方式后不断加入新的识别信号。
Meta还开发了“用于主动攻击测试的人工智能代理”(red-teaming AI agent),其任务是寻找内部防护系统中的薄弱点,并模拟不法分子可能利用来绕过这些系统的方式。该公司还宣布提升了识别此类人员的能力,即识别那些在原有账户被移除后通过新账户重新返回平台的人。
为什么这则消息重要?
这一变化的实际意义在于,将部分安全监测工作从分析帖子或广告,转向分析一条可能始于看似合法的广告、最终通向有害外部网站的完整路径。这扩大了预防性干预的范围,但也意味着系统的有效性取决于其评估外部目的地及账户之间关系的能力,而这些方面可能需要随着不法网络手法的变化持续更新。
这些措施出台之际,Meta正面临围绕儿童保护持续不断的法律和政治压力。8月,该公司同意支付最高180亿美元,以和解由29个美国州提起的一起涉及儿童安全的诉讼。此外,该公司今年还推出了多项功能,包括Meta AI家长监督工具、WhatsApp上面向未成年人的专用账户,以及当儿童在Instagram上搜索与自残有关的内容时向家长发送提醒。
certi.news解读:这项公告明确扩大了人工智能的作用范围,从发现违规内容扩展到分析将用户引向这些内容的结构。不过,来源没有提供有关“隐性指引”工具准确性的独立测量,也没有说明因新工具而被屏蔽的网站或账户数量,因此,已公布的量化结果仍与Meta自身的报告相关。