新上线今天0 投票
Meta 推出新 AI 工具,打击暗藏儿童性虐待材料导流的广告
Meta 周三宣布,2026 年上半年在 Facebook 和 Instagram 上对 3320 万条儿童性剥削内容采取了行动,并同步上线一批新的 AI 工具,用于识别那些表面正常、实则将用户引向非法儿童虐待材料的广告和账号。
从“看内容”转向“看去向”
Meta 表示,其最新 AI 工具针对的是一类被称作 “signposting”(路标式导流) 的手法:广告本身看起来无害,也不含非法素材,但会充当入口,把用户引导到 Meta 平台之外托管儿童性虐待材料的网站。
为此,Meta 引入了一套新的大语言模型系统来检测这类导流行为。与以往主要审查广告内容不同,新系统会同时关注广告把用户送往何处。一旦发现目的地违反平台规则,Meta 可以屏蔽相关网站或其他目标,并对背后的账号采取行动。
Meta 称,这是不良行为者近期为规避检测而采用的新战术,因此平台需要持续补充新的识别信号。
检测效率与印度市场数据
Meta 披露,在其采取行动的内容中,超过 97% 是由系统在用户举报之前主动发现的。
在印度市场,Meta 同期对 530 万条儿童性剥削内容采取了行动,其中超过 98% 在用户举报前被检测到。
新工具还包括“红队 AI 代理”
除导流检测外,Meta 还上线了多项配套措施:
- 红队 AI 代理:用于测试 Meta 自身的安全防护措施,主动寻找不良行为者可能利用的漏洞,以便在新型滥用手法扩散前发现它们。
- 补充 AI 扫描:用于找出早期系统可能漏掉的儿童剥削内容。
- 回流账号识别:改进系统,以发现那些在被移除账号后、又通过新账号返回平台的人。
背景:持续面临的儿童安全压力
这些新举措出台之际,Meta 正因平台对未成年用户的安全问题持续承压。公司面临多起诉讼和立法者的批评。今年 8 月,Meta 达成协议,拟支付最高 180 亿美元,以和解涉及美国 29 个州的儿童安全诉讼。
Meta 表示,随着对这类网络运作方式的了解加深,将继续加入新的信号维度。
