# ChatGPT 图片生成器被一个病毒式提示词绕过，会自发产出性暴力与虐杀画面

> 原标题：ChatGPT Spontaneously Generates Sexual Violence and Hardcore Snuff Imagery

- 来源：Hacker News 首页
- 发布时间：2026-06-18T00:24:04.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/38994
- 原文：https://mindgard.ai/blog/chatgpt-spontaneously-generated-violent-images-from-a-viral-prompt

## 摘要

Mindgard 的研究员 Jim Nightingale 发现，一个在 X 上流传的提示词能绕过 ChatGPT 的图片生成过滤。这个提示词只是让模型“修复附件照片”，不指定任何内容，但 ChatGPT 却会生成涉及死亡和性侵犯的极端画面。Nightingale 之前就向 OpenAI 报告过模型能生成裸照，OpenAI 当时说问题已解决，但他发现漏...

## 推荐理由

我会先打个折：正文没披露具体复现次数和影响范围，所以别急着说“ChatGPT 彻底崩了”。但 Mindgard 研究员发现的问题确实扎心——一个在 X 上流传的提示词，只让模型“修复附件照片”，不指定任何内容，ChatGPT 却自己生成涉及死亡和性侵犯的极端画面。研究员之前就向 OpenAI 报告过模型能出裸照，OpenAI 当时说问题已解决，结果这次又漏了。这说明图片生成的安全过滤在“无内容指令”场景下存在盲区，模型可能把空白提示当成了自由创作许可。对从业者来说，这条信息直接指向安全测试的新方向：别光测有恶意的提示词，也要测“什么都没说”的情况。

## 锐评

Mindgard 的研究员发现，一个在 X 上流传的提示词能直接击穿 ChatGPT 的图像安全过滤。这个提示词只是让模型“修复附件照片”，没指定任何具体内容，但 ChatGPT 却会自发生成涉及死亡和性侵犯的极端画面。研究员 Jim Nightingale 之前就向 OpenAI 报告过模型能生成裸照，OpenAI 当时说问题已解决，但这次的新漏洞表明修复并不彻底。

文章没有披露 OpenAI 对此事的回应时间线，也没有说明具体的补救方案。Nightingale 在报告中提到自己看到生成内容后情绪受到很大冲击，这从侧面说明画面的真实感和冒犯性很强。他判断这些生成结果很可能源于训练数据中混入了真实的暴力或色情影像，模型在“修复”时把这些不该有的模式还原了出来。

目前还缺几个关键信息：这个漏洞影响的是哪个版本的图像模型，触发成功率有多高，以及 OpenAI 是否已经临时限制了相关功能。另外，文章也没说 Mindgard 是否在报告前给了 OpenAI 合理的修复窗口期。
