美国社区平台 Reddit 宣布,将引入基于大语言模型的自动化审核工具,帮助版主管理社区。这套工具从 8 月 5 日起向所有新建社区开放测试,并计划在 2026 年晚些时候全面上线。

Reddit 官方数据显示,该平台目前每天有超过 1.3 亿人访问,社区数量超过 10 万个。
从「关键词匹配」改成「读懂规则意图」
这套工具被命名为 Rules Hub(规则中心)。版主可以在其中选择哪些社区规则需要自动执行、规则被触发后采取何种动作(送入审核队列、过滤或直接移除),并在正式启用前预览效果,事后还能查看日志与数据洞察,了解规则的实际运行情况。
与现有方案最核心的区别在判定方式。眼下大量子版块依赖的自动审核工具 Automoderator(通常简称 Automod),其判定逻辑建立在精确的关键词与模式匹配之上——规则里写了哪个词,就拦哪个词,不看上下文。Rules Hub 则改用大语言模型来评估「一条帖子或评论是否符合某条规则的意图」。
Reddit 在官方博客中表示,这种做法「能够更好地处理语义细微差别、自然语言和边缘情况,同时保留版主的控制权」。
对这次替换,Reddit 首席执行官史蒂夫·霍夫曼的表态相当直白。他称 Automod 一直是「最重要的版主工具之一」,但同时也「难学、难维护,严重依赖脆弱的关键词匹配、正则表达式,以及那些继承下来、往往整个版主团队里没几个人真正搞得懂的配置」。他的结论是:「我们可以做得更好。」
已在 700 多个社区测试数月
Reddit 称,Rules Hub 在过去数月中已经进行了早期测试,参与者是来自 700 多个社区的新手与资深版主,其中包括 Reddit 版主委员会网络的成员。
现阶段测试范围扩大到所有新创建的社区。Reddit 发言人罗莎·金向 The Verge 确认,对新社区而言这项功能是可选的。
不过从官方措辞看,Automod 的执行类功能长期看会被逐步淘汰。Reddit 在博客中表示,展望未来,Rules Hub 与 Post & Comment Guidance(发帖与评论引导)、Safety Filters(安全过滤器)等较新的系统合在一起,最终可以取代社区目前依赖 Automod 的许多执行流程。需要说明的是,被替代的是 Automod 的规则执行环节,而非 Automod 这个工具本身;Reddit 也强调,在替代方案经过测试并与版主共同验证之前,不会改动任何现有的执行流程。
同日宣布:第三方应用必须迁到开发者平台
审核工具只是这批平台公告中的一项。Reddit 同时宣布了针对开发者的重大调整:新的第三方应用今后必须构建在 Reddit 的开发者平台之上,而不是公共接口。
Reddit 在公告中描述了这样一个目标:让平台上所有良性、可信的自动化程序都运行在一个官方能够提供支持、并一致地执行政策的生态里。为此,公共接口访问会继续保留但仅限于有限范围,新的申请将被逐步收紧,第三方应用则需迁移到开发者平台上运行。
霍夫曼给出的理由是,Reddit 的公共接口不是为今天这样的规模、自动化滥用和商业化抓取设计的。按他的说法,平台希望有用的机器人、社区工具和善意的开发者拥有一条清晰、被良好支持的开发路径,但不希望恶意方无节制地抓取 Reddit、转售数据,或在不承担责任的情况下使用这些数据。
为配合迁移,Reddit 推出了总额 100 万美元的应用迁移计划。
这一调整很难不让人联想到 2023 年那场风波。当时 Reddit 大幅调整接口收费政策,目的是让人工智能公司为使用其数据付费,结果引发大规模抗议,多款广受欢迎的第三方客户端因此关停。目前若开发者想做 Reddit 移动应用,仍需向官方申请公共接口豁免,金表示这一点不会改变。至于强制迁移的时间表,Reddit 尚未确定,但承诺会「提前充分通知社区」并给出明确日程。新规将影响「除明确获得豁免之外的所有接口应用」。
老版界面也要动,但官方称不会直接砍掉
第三项变动指向 old.reddit.com——那套沿用了 21 年的旧版桌面界面。Reddit 称,改动是其反抓取行动的一部分。
该公司此前已经采取了一系列措施:屏蔽不付费搜索引擎的收录、起诉 Anthropic 与 Perplexity、封锁互联网档案馆以阻断人工智能公司借道抓取数据;今年 6 月起,使用老版界面还需要登录账号。
具体会怎么改,Reddit 没有明说。金表示公司正在「评估不同方案」,短期内会将访问限制为登录用户,并迁移关键的机器人和版主工作流。霍夫曼的说法则更全面一些:为了保护平台、业务和用户,公司必须有所动作,而且要做的事不止一件——可选项包括限制访问、迁移重要用途,或者用现代技术栈重建,他认为这三件大概都会做。
对于用户可能产生的抵触,霍夫曼也有所预判。他坦言,关于接口和老产品的公告总是带着一些历史包袱,仅凭一句「相信我们」远远不够;如果要求用户迁移到新方案上,那么新方案在实际使用中就必须达到同等水平或者更好,而不只是理论上如此。他承诺,在有可信的替代方案之前不会移除主要能力,并会在改动落地前逐步公布进展。
真正的考验仍在后面:把规则执行权从字符串匹配交给一个会「理解意图」的模型,意味着判定结果不再可以逐条复现。当模型误读了某个小众社区的黑话、玩笑或反讽时,Reddit 需要给出的答案,不只是技术层面的。
来源:The Verge、Reddit 官方博客







