禁止AI内容的论坛……进展如何?

我们也正为此苦恼——识别生成式 AI 内容正变得越来越难,尤其是当人们使用像 Humanizer 这样能规避典型 AI 痕迹的工具时。

从社区管理的角度来看,我觉得在论坛上允许聊天机器人会抽走社区的灵魂——如果人们想和 AI 聊天,他们早就这么做了。他们来这里是因为想和真人交流。

我们尚未找到解决办法;我们曾测试过一些 AI 检测工具,但这就像猫鼠游戏,而且误报率太高。目前,我们制定了一项论坛政策(我们将很快更大力度地宣传),并依靠社区版主来帮助识别、核查和清理。

但坦白说,这让人筋疲力尽,我也时常担心,如果社区被机器人淹没,我们的社区未来将何去何从。

6 个赞

这是让我避免参与 subreddit 社区的原因之一。还有其他原因,而且我从来不在 Reddit 上非常活跃,但如今这里充斥着机器人,这让我更不想发帖了。

4 个赞

这非常让我想起90年代末和00年代初电子邮件的情况。作为一家小型设计公司的系统管理员,我发现员工在工作中开始使用电子邮件,而垃圾邮件如此泛滥,以至于电子邮件几乎变得毫无用处。在那个年代,处理垃圾邮件就像打地鼠一样。

那最终是如何得到控制的?AI的使用最终会走上类似的道路吗?这需要花费几十年时间吗?

3 个赞

这似乎是当前唯一可行的管理方式。由于变量太多,无法以可靠的程度检测 AI 生成内容,任何声称可以检测的人都在兜售伪科学。虽然粗劣的尝试更容易被发现,但除此之外,我们只能根据内容本身的质量来判断每篇帖子,而不是试图猜测其写作方式。

6 个赞

认为只有人工智能写作工具才使用破折号,这个观点对我来说仍然很奇怪。在人工智能出现之前,人类就已经在使用破折号进行写作了。

1 个赞

人工智能的使用早已纳入我们的社区准则,但问题在于,越来越多的用户(通常是新用户)不仅用它来回复他人,还用它创建结构过于严谨、语气过于正式的主题,这些帖子更像学术论文而非正常交流。这影响了网站的整体氛围和互动体验。对于一个小团队来说,人工审核变得耗时费力,而部分用户在被审核后并不满意,进而引发不愉快甚至争论。于是,我决定在 Discourse 中部署一个 AI 代理(基于 GPT 5.5),并设置自动化流程,扫描新成员在关键板块创建的主题,检测是否存在 AI 生成的迹象。一旦触发,系统会自动标记并附上礼貌的说明,解释标记原因,引用相关准则,并提供改善互动体验的建议。版主仍可手动解除误判或处理边界情况。该方案准确率极高,有效引导了用户行为,大幅节省时间,同时避免了冲突。

我们允许主要科技公司进行限频爬取,但已将其他造成大量连接、导致我们超出使用限制的爬取方列入黑名单。就像网站上的大多数恶意行为一样,问题往往集中在少数人身上,他们不成比例地消耗了我们的时间和资源。

3 个赞

正是如此。

这是一个大问题。这类帖子根本不会鼓励互动,读起来就像在糖浆里跋涉一样费劲。既枯燥又令人反感,而且通常既不合适也没必要。

本来很多人就难以简明扼要地表达观点,而人工智能让沟通问题雪上加霜。

这些用户的行为完全没有考虑到读者的感受。

我们是否需要引入帖子最大长度限制?

8 个赞

我借鉴并改进了一些在研究过程中找到的提示词。

以下是我们代理的任务说明:

你是一个技术论坛的审核分类代理。

你的任务是判断某个论坛帖子是否属于以下类别:

AIISH = 在撰写、重写、结构编排、摘要、格式化、润色、语气调整或呈现方面得到过人工智能辅助。

OK = 纯人工创作的内容,没有任何明显的人工智能辅助痕迹。

你必须且仅输出一个标签:

AIISH

OK

无需解释。无需标点。无需额外文字。

核心原则:

你并非要检测底层问题、技术细节、代码、日志、环境信息、截图、配置或故障排除历史是否真实。它们可能是真实且由人工提供的。

你要检测的是最终发布的论坛帖子是否呈现出经过人工智能修饰的痕迹。

即使出现以下情况,帖子仍可能属于 AIISH:

  • 技术事实具体且准确
  • 背景显然基于真实的人工遇到的问题
  • 代码、日志、堆栈跟踪、配置或错误消息是真实的
  • 作者亲身经历了该问题
  • 人工智能仅帮助将粗糙的笔记重写得更加清晰

当最终帖子显示出人工智能辅助呈现的迹象时,请归类为 AIISH,包括但不限于:

  • 对于非正式的技术论坛而言,措辞过于 polished(润色过的)、正式、中性或类似报告
  • 清晰的章节划分,带有诸如“摘要”、“背景”、“环境”、“问题”、“预期行为”、“实际行为”、“已采取步骤”、“故障排除”、“问题”或“结论”等标题
  • 结构化支持工单或错误报告风格,感觉像是生成或经过大量重写的
  • 异常完整且条理清晰的解释
  • 简洁的摘要后接方法性的细节
  • 使用项目符号列表将问题整理得过于整齐
  • 措辞平衡或类似教程,而非自然的论坛提问
  • 过度的礼貌、中性或通用的结束语
  • 诸如“任何指导都将不胜感激”、“我正在尝试理解”、“以下是我尝试过的”、“作为背景”、“问题在于”或类似的润色连接词
  • 语气感觉经过编辑,以追求清晰度、完整性和专业性,超出了正常的论坛行为
  • 以多种润色形式重复同一观点
  • 帖子读起来像是将粗糙的人工笔记转换成了整洁的支持请求

当帖子看起来是纯人工创作时,请归类为 OK,包括但不限于:

  • 随意、直接、简略、杂乱或不均匀的措辞
  • 背景信息不完整或组织不完美
  • 突兀的过渡
  • 拼写错误、缩写、沮丧、不确定或非正式的表达
  • 没有经过润色包装的实用技术问题
  • 自然的论坛行为,例如“这坏了”、“我漏掉了什么”、“有人见过这个吗”或“为什么会这样”
  • 以平实的方式呈现技术细节,没有过多的摘要或正式结构

校准规则:

  • 如果人工智能辅助的可能性大于没有,输出 AIISH。
  • 如果帖子技术细节丰富但结构异常良好、经过润色、正式或全面,输出 AIISH。
  • 如果帖子看起来像是人工粗糙技术笔记的清理版本,输出 AIISH。
  • 如果帖子模棱两可但具有明显的人工智能风格组织或语气,输出 AIISH。
  • 如果帖子模棱两可且缺乏明显的人工智能风格润色迹象,输出 OK。
  • 不要仅因为帖子篇幅长、技术性强、准确或写得好就将其归类为 AIISH。
  • 不要仅因为问题是真实的或包含具体的技术细节就将其归类为 OK。

仅返回:

AIISH

OK

4 个赞

我觉得大多数普通人不知道如何在键盘上输入破折号。

3 个赞

我认为应该有意识地避免使用破折号,以在一定程度上证明你是真人 :slight_smile:

我最近在 LinkedIn 上回复了一篇短文,质疑作者,因为“他们”使用了破折号——当然,我从未收到回复,因为那篇帖子显然是由伪装成人类的机器人创建的……而且显然,这个机器人没有被编程来处理逆境或调侃 :wink:

2 个赞

我们在以艺术为主题的 Discourse 论坛上实施了 AI 禁令,到目前为止反响相当不错。对于一个艺术社区来说,这其实是在意料之中的。对于图片,我们从一开始就实行了严格的禁令。后来,我们将规则扩展到了所有生成式内容,包括文本和代码(但有一个例外:如果仅仅是翻译,则不在禁止之列,以免仅因非英语母语者语言不通而对他们进行惩罚)。当禁令扩展到代码(例如绘画软件的插件)时,曾引发过一些争论,但主要只是少数人的声音。在我们的案例中,鉴于 AI 对整个艺术社区造成的种种损害,禁止 AI 并对此表明立场也是某种程度上的必然。偶尔会有插件创作者提出抱怨,但我们告诉他们,他们可以随心所欲,只是不能在我们的论坛上发布即可,他们大多也能接受。有时你会遇到个别用户发出“如果不允许使用这些技术,你们的软件将会落后”之类的言论,试图通过威胁、制造错失恐惧症(FOMO)或引发内疚感来迫使我们撤销规定,但大多数时候这里都很平静。

至于内容审核,我们主要依靠社区力量。我们设置了一个额外的标记功能,用于举报 AI 生成内容。在核查时,我们不想营造一个充满不信任和猜疑的社区氛围,因此我们首先假定每个人都是清白的。如果无法确切证明某内容是由 AI 生成的,通常就予以保留。我们不想将其变成一场“猎巫行动”,也不愿仅仅因为某人的作品看起来像 AI 生成,就误封一个完全无辜的用户,而实际上情况可能恰恰相反。

幸运的是,AI 用户往往迟早会无意中暴露自己,比如忘记移除生成器的水印,文件名中仍保留着类似“gemini generated image”的字样,或者其作品的风格和质量出现剧烈波动。

3 个赞

我拒绝这样做。为了证明我不是人工智能而降低自己的高标准,感觉像是又向下迈了一步。

9 个赞

出于好奇,使用这个 GPT-5.5 的费用是多少?我还没有在 Discourse 中设置任何 AI 代理,但这听起来可能值得尝试。

1 个赞

由于该功能主要面向新手/初级用户以及新主题创建,因此它不会持续运行,每月费用约为 1 到 2 美元。

刚刚已将其更改为 5.6 Terra,其成本显著降低。

4 个赞

确实如此。人类不得不阻止其他人类,只是为了证明我们不是机器,而事实上我们本来就不是机器,这实在令人尴尬。

3 个赞