Ähnliches mache ich auch, habe das hier schon mal in verwandten Themen gepostet.
Ein von KI generierter oder verarbeiteter Beitrag hat immer Merkmale, die ihn als solchen entlarven.
Wir leiten neue Themenbeiträge von Nutzern mit geringem Vertrauenslevel durch einen Agenten, der sie als möglicherweise KI-generiert markiert. Der Nutzer erhält dann eine höfliche Nachricht vom Bot, die erklärt, warum dies geschieht, und Vorschläge macht, wie er vorgehen sollte. Gleichzeitig können wir das Flag übergehen oder den Beitrag komplett löschen.
Es funktioniert, aber die Realität ist, dass eine Welle von Leuten einfach einen Chatverlauf in das Forum kopiert und einfügt – was nicht erwünscht ist.
Das Ergebnis ist lediglich eine Wand aus Wörtern, die von einer KI zusammengefasst wird, während Menschen zu bloßen Stellvertretern werden.
Besser wäre eine Null-Toleranz-Politik. Eine Ausnahme wären Sprachprobleme, aber dank automatischer Übersetzung ist das nicht mehr nötig. Richtlinien müssen außerdem sichtbar sein. Wenn diese Moderation im Hintergrund abläuft, geht das Bewusstsein dafür verloren.