
Reddit昨天公布了一组数字:每天拦截2300万条垃圾浏览信息,捕获2.5万条新垃圾帖子或评论,撤销近200万次机器刷票。这不是人工干的,而是AI在对付AI。
这个知名论坛平台一直在跟垃圾账号斗智斗勇。过去,垃圾内容还能靠规则识别,但现在AI生成的垃圾越来越“聪明”——它们会精心伪装成真人,有计划地发帖、评论、点赞。Reddit的应对办法是:用大语言模型(LLM)升级原有的自动化系统。这套新系统能精准识别那些刻意隐藏的虚假行为模式,比如某个账号突然在10个不同板块用相似语气发帖,系统会立刻标记,并要求它通过真人身份验证。
效果很明显。用户看到的垃圾信息总量减少了20%,垃圾账号的“刷存在感”频率也降低了10%到15%。更直接的是,那些靠机器刷出来的虚假投票——近200万次——全部被清空。社区的互动环境干净了不少,真实用户终于能更容易看到真实的声音。
在治理网络暴力和仇恨言论上,Reddit也靠自动化实现了质变。从系统发现有害内容到处理完毕,平均只用不到5秒。执法力度比之前提高了200%,也就是说,之前漏过的现在能抓住。同时,用户接触有害内容的概率降低了40%以上。最难得的是,审核力度虽然猛增,但误伤正常用户的情况反而减少了40%——系统变得更准了。
AI垃圾和AI治理正在成为一对冤家。Reddit的做法给行业提了个醒:与其人工堵漏,不如让AI去跟AI斗。谁的系统更聪明,谁就能守住社区的真实性。