产品信号

Reddit向新社区开放AI审核

Reddit将以LLM理解社区规则意图的Rules Hub开放给全部新建社区,已在约700个版主团队测试。

Reddit已将Rules Hub开放给所有新建社区。这套工具用LLM判断一条内容是否违反社区规则的意图,而不只匹配关键词或正则表达式。约700个版主团队已参与测试,但现有社区暂不受影响,AutoModerator也不会被替换。这是一次受限但真实的平台治理能力扩展。

审核入口先从新社区扩大

Reddit表示,Rules Hub当天起面向全部新建社区开放,并已在约700个版主团队中测试。产品的核心变化不是增加一个内容生成助手,而是让模型参与规则执行:系统尝试理解帖文与评论是否违反社区设定的规则意图。开放范围仍被刻意限制在新社区,说明Reddit正把它作为可控部署,而非一次性改写全站审核体系。

规则语义取代部分静态匹配

此前,AutoModerator主要由各社区通过wiki配置关键词、模式和正则表达式,并保留版本历史以便回滚。该方式可预测、可审计,却难以处理同义改写、语境依赖和规避性表达。Rules Hub引入LLM后,审核逻辑可能从“是否出现某个字符串”转向“内容是否触及规则所禁止的行为”。Reddit披露,2025年下半年版主移除的内容中已有68.6%由自动化系统处理,新增模型层接入的是一个已有大规模自动化基础的工作流。

复杂治理仍不能只交给模型

最强的反面证据是,Reddit明确表示大型、复杂社区尚未准备就绪,现有社区也不会立即迁移。对限制AI生成内容的版主访谈同样显示,自动识别并不稳定,执行仍常依赖耗时的人工启发式判断。因而,这次开放更像是在低迁移成本的新社区中验证语义审核,而非证明LLM已能可靠替代复杂社区的治理和申诉机制。

接下来关注什么

下一步可观察的证据包括:Reddit是否把Rules Hub扩展至既有大型社区;是否披露误杀、漏审、人工复核和版主申诉数据;以及工具能否覆盖多语言、快速变化的社区规则。若扩展后自动化处理比例上升且版主回滚与申诉负担不增,将强化语义审核正在成为平台基础能力的判断;若部署长期停留在新社区,判断将被削弱。

信源