# OpenAI 公开了它怎么拦截用 AI 生成或上传儿童性虐待内容

> 原标题：Combating online child sexual exploitation & abuse

- 来源：OpenAI News
- 发布时间：2025-09-29T03:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/452
- 原文：https://openai.com/index/combating-online-child-sexual-exploitation-abuse

## 摘要

OpenAI 在 2025 年 9 月 29 日发了一篇安全说明，讲他们怎么防止自家模型被用来制作或传播儿童性虐待材料（CSAM/CSEM）。规则上，任何涉及未成年人的色情内容都禁止，一旦发现生成或上传这类内容，账号直接封禁并上报给美国失踪与受虐儿童中心（NCMEC）。技术手段上，他们用了三套工具：哈希匹配（拿已知的违法图片指纹做比对）、Thorn 的...

## 推荐理由

这篇不是产品发布，是 OpenAI 在 2025 年 9 月 29 日发的儿童安全措施说明。我会先打个折：标题和开头像标准合规声明，没什么新闻爆点。但往下看，技术细节给得比一般政策文多——明确写了用哈希匹配、Thorn 的分类器，以及自家模型去扫文本、图片、音频、视频和用户上传内容。更关键的一句是，他们已经观察到用户上传违规材料，还要求模型做细节描述，这说明滥用不是假设，是正在发生的对抗场景。对做安全和对齐的团队来说，这套跨模态监测组合和已确认的滥用模式，比单纯喊口号有用。信息量够，但缺具体误报率或拦截量级，所以放在 featured 档，不往上拔。

## 锐评

这篇安全说明最值得看的地方，不是 OpenAI 用了多少套检测工具，而是他们亲口说“我们观察到用户上传虐待材料并索要详细描述”。这说明问题已经从“用 AI 生成假图”升级到“拿真图喂给 AI 做二次加工”，风险敞口比单纯的内容生成更大。

技术手段上，他们列了三板斧：哈希匹配比对已知违法图片的指纹、用 Thorn 的分类器做筛查、以及自家模型监控文本、图片、音频、视频和上传文件。一旦发现，账号直接封禁并上报给 NCMEC。但正文没披露这些检测的误报率和漏报率，也没说多模态输入（比如用户上传一段视频让模型描述）的拦截效果到底怎么样。

政策层面，他们禁止任何涉及未成年人的色情内容，连开发者做面向未成年人的应用都不允许生成擦边内容。这个态度很明确，但执行依赖开发者自查和事后封禁，缺少事前审核机制。另外，文章提到被封用户会注册新号绕开限制，OpenAI 只说有团队在追查，没给出封禁逃逸率的数据，这块的实际效果要打个问号。
