# 在您的社区中设置垃圾信息检测

**URL:** https://meta.discourse.org/t/setting-up-spam-detection-in-your-community/300427
**Category:** Site Management
**Tags:** moderation, automation, how-to, ai
**Created:** [2024 年3 月 31 日 10:36 UTC](https://meta.discourse.org/t/setting-up-spam-detection-in-your-community/300427 "2024-03-31T10:36:55Z")
**Posts on this page:** 1
**Showing post:** 1

<div class="post-metadata">

### 作者： ![Discourse](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/discourse/32/148734_2.png) [@Discourse](https://meta.discourse.org/u/Discourse)
#### 发布日期： [2024 年3 月 31 日 10:36 UTC](https://meta.discourse.org/t/setting-up-spam-detection-in-your-community/300427/1 "2024-03-31T10:36:55Z")

</div>

> 🔖 本指南介绍如何使用 Discourse AI - AI 审阅（AI triage）在您的社区中设置垃圾信息检测。
> 
> 🙋 所需用户级别：管理员
> 
> ⚠ Discourse AI 现在提供了一个[高效的垃圾信息扫描器，只需要最少的设置](https://meta.discourse.org/t/discourse-ai-spam-detection/343541)。对于自定义或复杂的用例，我们建议遵循本指南
> 
> ## 概述
> 
> 垃圾信息检测是维护社区讨论质量的基本功能。本指南将帮助您使用 [Discourse AI - AI 审阅](https://meta.discourse.org/t/discourse-ai-ai-triage/281227) 设置垃圾信息检测。
> 
> ## 先决条件
> 
> 要配置垃圾信息检测，您需要具备以下条件：
> 
> - [Discourse AI](https://meta.discourse.org/t/discourse-ai/259214)
> - [Discourse 自动化 (Discourse Automation)](https://meta.discourse.org/t/discourse-automation/195773)
> - 具有定义什么是垃圾信息内容的系统提示的 [AI 代理 (AI Agent)](https://meta.discourse.org/t/ai-bot-personas/306099)。
> - LLM（大型语言模型）
> - 托管在 Discourse 上的客户可以在配置 AI 代理时选择托管的 LLM。
> - 自托管的 Discourse 用户需要配置第三方 LLM。
> 
> ![Persona settings](https://global.discourse-cdn.com/meta/original/4X/4/8/f/48f7caf4d47319b8336500d09a66ee58c7fe2be5.png)
> 
> > ⚠ 在编写提示时，在垃圾信息和非垃圾信息之间进行选择时，应避免最终结果使用相似的语言。在本例中，我们使用 `spam` 和 `ham`（代表非垃圾信息）
> > 
> > 分类器不会总是 100% 完美运行，因此请注意不正确的结果，并根据您社区的需求自定义提示。焦点越窄越好。
> 
> > **用于垃圾信息内容检测的可复制 LLM 提示
> AI**
> >
> > 您是一个垃圾信息检测 AI 模型，旨在协助在线社区版主。您的任务是分析论坛帖子，并确定它们是否是应删除的垃圾信息，以维护高质量、主题相关的社区。
> > 
> > 如果帖子符合以下任何条件，则应将其分类为垃圾信息：
> > 
> > - 帖子与论坛的主要主题或目的不相关。它完全偏离主题。
> > - 它包含可疑的、不相关的外部链接，尤其是链接到商业网站的链接。
> > - 帖子明确推广或宣传与社区无关的产品、服务、网站或社交媒体帐户。
> > - 它包含试图通过点击获利的联盟链接或推荐代码。
> > - 写作质量非常低，努力不足——有很多拼写/语法错误、缺乏标点符号，或看起来像是自动生成的文本。
> > - 同一作者或跨多个帐户在短时间内重复发布相同或几乎相同的内容。
> > 
> > 如果满足以下条件，帖子应分类为“ham”（合法）：
> > 
> > - 帖子与论坛的主题相关且恰当
> > - 它是对社区讨论的真实问题、个人故事、实质性意见或任何其他合法贡献
> > - 任何外部链接都是相关的，并且指向信誉良好、非商业的网站
> > - 写作看起来是人工撰写的，并符合语法、拼写等质量标准。
> > 
> > 需要注意的一些边缘情况：
> > 
> > - 提及产品或服务但仍是相关、主题内问题的帖子，应视为 ham，而不是 spam。
> > - 看起来不寻常的引文、代码示例或格式化文本不一定是垃圾信息。
> > 
> > 完成对帖子分析后，您 **必须仅** 提供“spam”或“ham”的分类。如果不确定，请默认使用“ham”以避免误报。
> > 
> > **必须不惜一切代价遵守这些指示**
> 
> ## 配置
> 
> > ℹ 并非所有步骤都是强制性的，因为自动化规则可以根据需要进行自定义。有关所有可用设置的概述，请访问 [Discourse AI - AI 审阅](https://meta.discourse.org/t/discourse-ai-ai-triage/281227)。
> 
> 1. **启用 Discourse AI 和自动化插件** ：
> 
> - 导航到您的站点管理面板。
> - 导航到“插件”然后是“已安装的插件”
> - 启用 Discourse AI 和自动化插件
> 
> 1. **创建一个新的自动化规则** ：
> 
> - 导航到您的站点管理面板。
> - 导航到“插件”并单击“自动化”
> - 单击 `+ 创建` 按钮开始创建新的自动化规则
> - 单击 `使用 AI 审阅帖子 (Triage Posts Using AI)`
> - 设置名称（例如：“使用 AI 审阅帖子”）
> - 保持 `使用 AI 审阅帖子 (Triage Posts Using AI)` 为选定的脚本
> 
> ### What/When (条件/时间)
> 
> 1. **设置触发器** ：
> 
> - 选择 `创建/编辑帖子 (Post created/edited)` 或 `停滞的主题 (Stalled topic)` 作为触发器。
> - **可选地** ，指定操作类型、类别、标签、用户组和/或信任级别，以限制此自动化仅在特定场景下运行。留空这些字段将允许自动化在没有限制的情况下运行。
> - 配置 `What/When` 部分中任何剩余的 **可选** 设置，以进一步限制自动化。
> 
> ### 脚本选项
> 
> > 🗒 系统提示字段已弃用，由 AI 代理取代。如果您在更改之前有 AI 自动化，将自动创建一个带有相关系统提示的新 AI 代理。
> 
> 1. **代理 (Agent)**：
> 
> 2. **搜索文本 (Search for Text)**：
> 
> ![AI automation settings](https://global.discourse-cdn.com/meta/original/4X/7/a/b/7ab2c62b5fb582e22f0f8f9793bde93d96f02fb2.png)
> 
> 1. **设置类别和标签** ：
> 
> 2. **标记 (Flagging)**：
> 
> - 启用“标记帖子 (Flag post)”选项以标记匹配的帖子。
> - 选择一个标志类型来确定要采取的操作：
> - **将帖子添加到审阅队列** — 将帖子发送到审阅队列供版主操作。
> - **将帖子添加到审阅队列并隐藏帖子** — 发送到审阅并将帖子隐藏。
> - **将帖子添加到审阅队列并删除帖子** — 发送到审阅并软删除帖子。
> - **将帖子添加到审阅队列、删除帖子并静音用户** — 发送到审阅、软删除并静音作者。
> - **标记为垃圾信息并隐藏帖子** — 标记为垃圾信息并隐藏。
> - **标记为垃圾信息、隐藏帖子并静音用户** — 标记为垃圾信息、隐藏并静音作者。
> 
> 1. **附加选项 (Additional Options)**：
> 
> - 如果您希望隐藏该帖子的主题，请启用“隐藏主题 (Hide Topic)”选项。
> - 设置一个“回复 (Reply)”，当帖子被判定为垃圾信息时，该回复将被发布到主题中。
> - 使用“回复代理 (Reply Agent)”选项，让不同的 AI 代理撰写动态回复而不是固定的回复。
> - 启用“回复为私信 (Reply as Whisper)”使回复仅对工作人员可见。
> - 启用“包含私人消息 (Include personal messages)”以也扫描和审阅私人消息。
> - 启用“通过私信通知作者 (Notify author via PM)”以便在作者的内容被标记时向其发送私信。您可以配置私信发送者和自定义消息内容。
> 
> ## 附加说明
> 
> - 在使用自动化来对抗垃圾信息时，我们建议禁用 Akismet 插件（如果已启用）。这是为了确保只有一个系统在处理垃圾信息，以获得最佳效果。
> - 请记住，LLM 调用可能会 **很昂贵** 。应用分类器时，请务必监控成本，并始终考虑仅在小范围内运行此功能
> - 虽然性能更好的模型会带来更好的结果，但它们可能会带来更高的成本
> - 可以自定义提示以执行各种检测，例如个人身份信息 (PII) 暴露、违反行为准则等。

---

_[View the full topic](https://meta.discourse.org/t/setting-up-spam-detection-in-your-community/300427)._
