nickdb
(Nick)
103
如果一个人无法区分“自己撰写内容并使用 AI 进行校对”和“给 AI 一个‘核心思想’,然后让它用冗长且并未改善信息传达效果的文本和结构进行包装”,那么讨论就缺乏基础。
工具的存在是为了改进某样东西。如果所谓的“改进”仅仅是消除构建一个经过深思熟虑的话题所需的时间和精力,那么为什么其他人还要投入时间和精力去深思熟虑地回复并提供指导呢?
你不妨直接去问 AI,当然他们之前已经这么做了,但并没有得到他们想要的回答。
互动是任何社区的核心。当你写满三页纸,而不是用一段清晰简洁的段落来表达时,对于那些本可能会参与互动的成员来说,这会让他们瞬间失去兴趣。
这就是我们制定明确准则的原因。
当然,我们也承认语言可能是一个问题,因此需要例外情况。这也是我们刚刚实施 Discourse 完整自动翻译栈(由 GPT 作为大语言模型驱动)的原因——它消除了协作中的语言障碍。
我们设定的标准是:该网站是为人类和人际讨论服务的。适量使用 AI 来改善这种互动动态并非坏事,但如果整篇内容都是 AI 生成的,负责审查此类内容的代理会自动将其退回。
我们费尽心思解释这一立场存在的原因,并引导任何人以建设性的方式应对,当他们触碰到这些护栏时。在大多数情况下,这很有效,人们也理解其中的原因。但俗话说,众口难调。
对社区规则提出异议,就像受邀去别人家吃饭,却批评那里的装饰和食物一样。参加聚会并非义务,而家规的存在是为了整个社区的福祉,而不是为了迁就个人的特定喜好。
这类内容会影响整个网站的基调,并直接影响谁会选择访问和留下。每个社区都不同,在一个社区中行之有效的方法在另一个社区中可能行不通。如果一个社区已经与其成员的需求脱节,这一点很快就会变得显而易见,这是我们绝不会因为个人偏好和观点而忽视的风向标。
1 个赞
Mevo
104
所以,这确实是一个关于形式的问题,即内容看起来和读起来是什么感觉(“基调”)。是否接受发布“AI 生成内容”,由各论坛自行决定。也许更理想的做法是:由人类撰写摘要或引言,并附上链接指向 AI 生成的内容(和/或完整的 AI 对话记录)。
或者,在我看来,“点击展开”功能似乎是最理想的。
在人类呈现之后,再在那里展示 AI 生成的内容。每个人都可以自由选择是否点击。或者不点 
或者,如前所述,你似乎非常关注“谁”写了这些文字。如果与 AI 模型进行了足够的来回交流、提供背景信息、引导方向、提出异议、提出后续问题等,那么结果就是使用该工具的人类“生产”出来的。+校对+ 发现结果有趣且质量足够高从而发布,这本身是有价值的。
我看到的另一个问题是,将所有“AI 生成内容”都视为仅由单句提示词产生的结果(这当然会激怒用户)。这种“自己写+校对”与“必然是垃圾”的二元对立观点,似乎是一种相当狭隘的看法。正确地使用 AI 作为工具/伙伴来完善自己的想法、进行研究、扩展内容、双重检查,这与仅输入 5 个单词的提示词截然不同。如果操作得当,它会带来极佳的效果。
除非你坚持认为内容“必须”是 100% 由人类生成的(如果用户“重写”了 AI 的输出,那它会被接受吗,还是算作弊?)
这已经偏离了最初的议题,更多是关于“论坛中的 AI 使用”(这很可能也是一个值得讨论的话题)。
1 个赞
mbauman
(Matt Bauman)
105
或者,你知道的,你也可以对一个你既未受邀、甚至未曾进入过的“家”的规则提出反对并进行批评。 
Mevo
106
你是在说我吗,Matt?我并没有在批评任何人的规则(而且我已经说得很清楚了:是否接受发布“AI生成内容”,由各论坛自行决定)。我谈论的是发布AI生成内容这一普遍现象。我想,关于@nickdb在这个问题上持“基础立场”这一点,我可能会问他:从他的角度来看,是否存在值得发布的优质AI生成内容?我并不是否认也存在(大量)低质量的AI生成内容。
mbauman
(Matt Bauman)
108
无论其本身是否受版权保护,所有商业提供商都明确将此类所有权和权利授予提出请求的人类。例如,来自 OpenAI 的服务条款:
内容所有权。在您与 OpenAI 之间,且在适用法律允许的范围内,您 (a) 保留对输入内容的拥有权,并 (b) 拥有输出内容的所有权。我们特此将我们可能拥有的对输出内容的所有权利、权益和利益转让给您。
是的,Mevo,显然,那指的是你对 Nick 在其社区中立场的分歧……但这现在已经完全偏离主题了。
2 个赞
nickdb
(Nick)
109
这完全关乎文字本身。如果是一个由人类撰写但质量低劣的主题,我们同样会迅速进行干预处理。
但现实是,这种情况很少发生。
并不罕见的是,有人选择充当交互式生成式搜索机器人的代理。这些机器人提供的产品非常一致,但其输出质量与数量的比例未能达标,反而增加了更多噪音,掩盖了有价值的内容。
回到正题,人工智能不仅在将人们从寻找优质社区论坛的道路上引开,它还在通过其人类代理这一“后门”进入社区,使得论坛变得不那么有吸引力,互动性也降低了。
仅代表个人观点。
2 个赞
原帖标题是“还有其他人注意到支持论坛的社区活跃度急剧下降吗?”
所以,Matt 的论坛是一个“支持论坛”的例子。虽然它还有其他内容,但它本质上也是一个支持论坛。显然,Helga 的论坛同样是一个支持论坛。
虽然这可能属实,但我不确定这是否是导致社区活跃度“急剧”下降的原因。我的理由是……在使用论坛时,一直存在着各种令人烦恼的问题:喷子、垃圾信息发送者、自以为是的用户、试图垄断网络某一角落的用户、糟糕的管理、偏袒等等,数不胜数。
然而,随着人工智能近期的普及(它已经内置于谷歌中),我将人工智能视为支持论坛的直接竞争对手。
我只能代表我自己说话,但如果过去我需要语法示例或帮助查找错误,我会去搜索 Stack Exchange。如果搜索无果,我就会穿上“火焰防护服”(做好被批评的准备)……在论坛里提问。
然后我会等待
有了人工智能,无需等待,搜索也替你完成了
如果我运营一个支持论坛,我会思考如何应对这种直接竞争。我如何提供更好的产品?我如何利用这一点来助我一臂之力?我又如何将我的产品与人工智能区分开来?
仅代表个人观点(JMHO)
3 个赞
nickdb
(Nick)
111
有道理。
为了更清楚,我们也是一个“支持”论坛。
之所以特意加引号,是因为这个定位其实更偏向灰色地带,但这仍然是吸引用户来到我们这里的重要因素之一。
1 个赞
顺便说一句,Nick,我刚才只是发表了一个笼统的观点,并不是在直接回应你的评论(尽管我引用了你)。
我理解你的意思。YouTube 上到处都是 AI 生成的内容,这对该平台来说是一个巨大的问题。你会看到一个听起来很有趣的视频,点进去看,发现制作得非常精良,但结果……呃……居然是 AI 生成的。
这很烦人,然后你就点走了。
我相信在论坛这种形式下,同样的情况也同样让人恼火。
1 个赞
Mevo
113
啊,对。“显然”如果那不算批评,至少也是一次“不同意见”。而且那还专门针对的是他的社区。当然,每个人在可能的情况下都应该把这看得非常个人化。可以肯定的是,他指的不是我在试图解释那些他与之发生过“激烈争吵”的人的观点。那些他似乎并不相信,甚至没有真正试图去理解的人。但谁在乎相互理解呢,对吧?论坛和对话显然不是关于彼此交流的。
我很抱歉。我大错特错了,因为我现在知道这些情况无论如何都太罕见了,甚至不值得考虑。但其中一些相关用户的反应足以让人用“反复”(他的原话)这个词来取笑他们。我是说,这些人“似乎对现实及相关概念有着根本不同的理解”(又是他的原话。而且“那个立场”,因为引用明显指向了这一点)。
我的错。理解是被高估了。至少对某些人来说是如此。非常感谢你的澄清
(尽管这一切,嗯,都很明显)。现在我想起来为什么我有一段时间没有在这里阅读或发帖了,而且我打算现在就重新开始这样做 
mbauman
(Matt Bauman)
114
哇,我也真的很抱歉。我觉得这段你来我往的讨论完美地诠释了我上面那条评论的意思——通过解释“为什么”(就内容本身而言),有助于确保大家不会过度反对或觉得这是针对他们个人。
HAWK
(Hawk)
115
我认为这就是问题所在……
我认为这种行为会导致“蛇吞象”(自我吞噬)的局面。如果所有人都阻止那些经过更新、准确的人类内容去刷新模型,我们就不能指望回复的质量能有多好。
大家怎么看?
我认为他们已经获取了我们所有的数据,而计划是将人类交互隔离到核心层面。模型已经开始在没有人类干预的情况下进行训练:RLAIF、RLVR、RLVF、DLMA 或 Inverse-Q。
这可能解释了为什么前沿模型的语言和整体沟通方式看起来很棒,但实际上却显得怪异奇怪。
在过去几年里,我退出了社交媒体和几乎所有的聊天。然后我买了很多书、一些乐器,并回到了模拟音乐播放器或收音机。我计划尽快开始淘碟并入手黑胶唱机,并希望在某天彻底停止使用互联网。
嗯,我认为总会有一些安全的地方可以待,但不在开放的互联网上。
没错,但那是跳出固有思维框架后的结果。从数据角度来看,它们管理着几乎无限的资源,而人类所能保留或知晓的,不过是其中微不足道的一小部分。
HAWK
(Hawk)
119
没错,但那个资源是我们提供的。如果我们关闭论坛,我们就无法重新生成这个数据源。
1 个赞
好吧,我会深入探讨一下;如果你觉得或者团队觉得这偏离了主题,请将其拆分。我支持楼主(OP),也理解我的观点可能偏离了关于支持论坛活跃度以及使用 AI 对这类特定网站/群体活动的影响这一技术讨论。
我理解你的观点,而且这非常合理。我一直很重视你的动机(motus),我真心希望未来能像你设想和描述的那样发展。你的互动让我想起了那些我最信任的亲近之人。
我认为事情的发展是这样的:人类 喂养 生成供所有人使用的工具的数据源。但如果这个工具是由其他人(而不是像你们这样的人)制作的,我认为他们可能会滥用(比如垃圾机器人),并激励更多微妙的方式来 喂养 重新生成他们的商业数据源。
不再是通过互动,因为互动正在被压缩(minified),而这正是原始理念的一部分。利用大量人来训练模型以完成验证码,然后让他们付费来优化该工具,直到该工具变得毫无用处,因为它可以像现在这样自我训练。
在某个阶段,这样做更便宜,也更好。有一些论文对此进行了研究,我之前提到的缩写是目前最准确的实际训练方法。我链接了一篇论文,但那些缩写才是关键。
这是社会性的,具有不同的变体、测试和实验。我记得几年前很多人都在孤立自己。我既喜欢沉默,也喜欢对话。我记得以前和别人交谈要简单得多;如今这种情况发生的频率降低了,而且方式也越来越琐碎。
如果有人在特定故事的语境之外提到某事,会让人感到不舒服。而这恰恰是给我们提供最多反馈和整体价值的地方。保持古怪是没问题的。
也许新的训练形式可以直接通过身体来实现。大型科技公司的专利提到了通过锻炼来挖掘数据。几乎每个人都会为了全民基本收入(UBI)而这样做;他们几年前扫描了虹膜,而在气候崩溃之后,这可能成为新的体面之事。
尽管我对你们所有人怀有敬意,但我想并理解,分析这种视角可能会令人痛苦,因为你们在这里所做的一切都依赖于人们像过去那样使用互联网。
未来不在我们手中,而在我们个人和社区的手中。我们需要允许自己看到真相;几家公司的计算能力是无法估量的。
当我们谈论这些时,他们正在处理世界上几乎每个互联网用户的所有数据。公开的、私人的,一切。我们完全不知道他们可以用他们的私有模型和提示词做什么。
冰山在水下。而且,欣赏星星和月亮将永远是美好的。从我卑微的视角来看,保持或恢复简单性是第一条抵抗法则。
1 个赞