Runway 公布儿童安全方案:用多层检测和 516 份举报,堵住 AI 生成儿童性虐待内容的口子
我们保护儿童安全的方法
Runway 在 2026 年 5 月 8 日发了一篇安全说明,专门讲他们怎么防止自家视频、图像生成工具被用来制作儿童性虐待内容(CSAM)。做法分三步:模型开发阶段,先用哈希匹配和专门的分类器清洗训练数据,不让模型学到涉及未成年人的色情内容,上线前还会做对抗测试找漏洞;产品部署后,所有用户上传的内容都要过已知 CSAM 哈希库和分类器扫描,一旦确认违...
推荐理由:Runway这篇讲的是他们怎么防儿童性虐待内容,不是产品更新。我会先打个折:标题很平,就是篇安全说明。但内容给了干货——哈希匹配和分类器做第一道过滤,再用大语言模型审核,最后靠红队找漏洞。2025年向NCMEC提交了516份报告,这个数字说明他们确实在跑这套流程,不是空话。对做视频生成模型的同行来说,审核成本和监管压力是绕不开的,这篇算一个可参考的操作样本。