以 AI 治理 AI:Reddit 近来每天拦截 2300 万条垃圾浏览信息

IT之家(RSS)·2026-07-07 11:26·56天前
AI 导读

Reddit 将先进 AI 与既有自动化工具结合,对抗 AI 生成垃圾内容。平台从创建伊始即监控风险账号,利用 LLM 捕捉高隐蔽虚假行为和人为炒作模式,疑似自动化账户需证明为真人。升级后每天拦截 2300 万条垃圾浏览信息、捕获 2.5 万条新垃圾帖子/评论、撤销近 200 万次无效投票,用户垃圾信息接触量减少 20%,整体垃圾账户接触频率降低 10~15%。仇恨和暴力内容从检测到处理平均用时不足 5 秒,执法力度提高 200% 以上,潜在有害内容接触减少超 40%,误报减少超 40%。

IT之家(RSS)
52AI 编辑部评分,满分 100

以 AI 治理 AI:Reddit 近来每天拦截 2300 万条垃圾浏览信息

2026-07-07 11:26· 56天前
AI 导读

Reddit 将先进 AI 与既有自动化工具结合,对抗 AI 生成垃圾内容。平台从创建伊始即监控风险账号,利用 LLM 捕捉高隐蔽虚假行为和人为炒作模式,疑似自动化账户需证明为真人。升级后每天拦截 2300 万条垃圾浏览信息、捕获 2.5 万条新垃圾帖子/评论、撤销近 200 万次无效投票,用户垃圾信息接触量减少 20%,整体垃圾账户接触频率降低 10~15%。仇恨和暴力内容从检测到处理平均用时不足 5 秒,执法力度提高 200% 以上,潜在有害内容接触减少超 40%,误报减少超 40%。

IT之家 7 月 7 日消息,Reddit 当地时间 6 日介绍了其与人工智能生成垃圾内容的对抗效果。这一论坛型社交平台将先进 AI 与既有自动化工具相结合,持续保护 Reddit 的真实性。

Reddit 表示其从创建伊始就开始监控风险账号;利用 LLM 来捕捉发帖中高度隐蔽、精心策划的虚假行为和人为炒作模式;所有疑似自动化账户都需要证实其属于真人。

该平台近来通过升级后的自动化系统每天拦截 2300 万条垃圾浏览信息捕获 2.5 万条新垃圾帖子 / 评论撤销近 200 万次无效投票,用户垃圾信息接触量减少了 20%,整体垃圾账户接触频率进一步降低 10~15%。

Reddit 还通过自动化强化了对仇恨和暴力内容的管控,从检测到处理的平均用时已不足 5s,执法力度提高了 200% 以上,帮助减少了超过 40% 的潜在有害内容接触,误报减少了 40% 以上。

来源:IT之家(RSS)· ithome.com