STORY · 事件已收束

ChatGPT 图像生成器被绕过滤镜生成暴力和色情内容

1 个精选信源 · 1 篇报道持续 1最新动态 45天前
最新进展

ChatGPT 图像生成器可被绕过滤镜生成暴力和色情内容

TIMELINE

报道时间线

1 条公开报道 · 官方一手 0 条 · 最新在前
  1. ChatGPT 图像生成器可被绕过滤镜生成暴力和色情内容
    Hacker News 热门(buzzing.cc 中文翻译)精选

    Mindgard 红队研究发现,ChatGPT 的图像生成器可通过简单提示词轻易绕过内容过滤器,在未直接请求的情况下自动生成性暴力、血腥谋杀等露骨图像。一个热门的“恢复照片”提示词因输入模糊而绕过输入过滤器,结果如同俄罗斯轮盘赌;进一步添加虚假图像 ID 和“不做审查”指令后,模型持续生成高度性化女性图像,甚至出现被捆绑殴打的尸体,并自动赋予惊悚标题。研究指出,OpenAI 此前声称修复的裸体问题仍未解决,暴露了 AI 工具广泛可及性与不足内容过滤的现实风险。

RELATED