Wir kämpfen ebenfalls mit diesem Problem – die Erkennung von KI-generierten Inhalten wird immer schwieriger, insbesondere wenn Menschen Tools wie Humanizer nutzen, die typische KI-Merkmale verschleiern.
Aus Sicht des Community-Managements finde ich, dass die Zulassung von Chatbots auf deinem Forum die Seele deiner Community austrocknet – wenn die Leute mit einer KI sprechen wollten, hätten sie das bereits getan. Sie sind hier, weil sie mit einem Menschen sprechen möchten.
Wir haben bisher noch keine Lösung gefunden; wir haben einige Tests mit KI-Erkennungstools durchgeführt, aber es ist ein Katz-und-Maus-Spiel, und sie produzieren zu viele falsche Positive. Für jetzt haben wir eine Forenrichtlinie implementiert (die wir in Kürze stärker kommunizieren werden) und verlassen uns auf die Hilfe unserer Community-Moderatoren, um verdächtige Inhalte zu erkennen, zu prüfen und zu bereinigen.
Aber ehrlich gesagt ist das erschöpfend, und ich mache mir manchmal Sorgen um die Zukunft unserer Communities, wenn sie von Bots überschwemmt werden.
Das ist ein Grund, warum ich es vermeide, in Subreddit-Communities mitzumachen. Es gibt andere Gründe, und ich war auf Reddit nie besonders aktiv, aber heutzutage ist es so sehr von Bots geplagt, dass mich das noch mehr davon abhält, Beiträge zu veröffentlichen.
Das erinnert mich sehr an die Situation mit E-Mail Ende der 90er und Anfang der 00er Jahre. Als Systemadministrator in einer kleinen Designagentur hatten die Mitarbeiter begonnen, E-Mails im Rahmen ihrer Arbeit zu nutzen, und die Spam-E-Mails waren so überhandgenommen, dass E-Mail praktisch nutzlos wurde. Damals war es ein endloses Spiel mit dem Spam.
Wie wurde das schließlich unter Kontrolle gebracht? Wird die Nutzung von KI einem ähnlichen Weg folgen? Wird es Jahrzehnte dauern?
Dies scheint derzeit der einzige Weg zu sein, damit umzugehen. Es gibt zu viele Variablen, um KI-generierte Inhalte mit einer gewissen Zuverlässigkeit zu erkennen, und jeder, der etwas anderes behauptet, verkauft Quacksalberei. Faule Versuche sind leichter zu erkennen, aber ansonsten müssen wir jeden Beitrag nach dem Inhalt und seiner Qualität beurteilen, ohne zu raten, wie er geschrieben wurde.
Die Vorstellung, dass nur KI-Schreibtools den Gedankenstrich verwenden, ist mir immer noch fremd. Menschen haben schon lange vor der Entstehung der KI mit diesem Zeichen geschrieben.
Die Nutzung von KI ist seit langem in unseren Richtlinien verankert. Das Problem war eine wachsende Zahl, typischerweise neuer, Nutzer, die sie nicht nur zum Antworten auf andere, sondern auch zum Erstellen übermäßig strukturierter und formeller Themen verwendeten, die eher wie eine Dissertation als wie Kommunikation wirkten. Dies beeinflusste den Ton der Website und die Interaktion. Für ein kleines Team wurde die Moderation immer zeitaufwändiger, und einige Leute mochten es wirklich nicht, moderiert zu werden, was dann zu unangenehmen und streitigen Situationen führte. Ich entschied mich dafür, einen KI-Agenten in Discourse (basierend auf GPT 5.5) zu erstellen und eine Automatisierung zu nutzen, um die Themen-Erstellung durch neue Mitglieder in wichtigen Kategorien zu scannen und auf Anzeichen von KI-Generierung zu prüfen. Dies löst eine automatische Markierung und eine höfliche Erklärung aus, warum es markiert wurde, Verweise auf die Richtlinien und einige Ratschläge für bessere Interaktion. Moderatoren können immer noch eine falsche Markierung oder einen Grenzfall freigeben. Es war sehr genau und hat das richtige Verhalten gefördert, während viel weniger Zeit benötigt wurde und Konflikte vermieden wurden.
Wir erlauben rate-limitiertes Scraping von den großen Tech-Unternehmen, haben aber den Rest auf die schwarze Liste gesetzt, die für eine enorme Anzahl von Verbindungen verantwortlich waren, die uns über die Nutzungsgrenzen hinaus trieben. Wie bei den meisten bösen Akteuren auf einer Website, handelt es sich tendenziell um eine kleine Anzahl von Menschen, die unverhältnismäßig viel Zeit und Ressourcen verbrauchen.
Das ist ein riesiges Problem. Sie fördern keine Interaktion, und diesen Quatsch zu lesen, ist wie durch Sirup zu waten. Es ist langweilig und abschreckend und selten angemessen oder notwendig.
Viele Leute haben ohnehin Schwierigkeiten, ihre Punkte prägnant darzulegen, und KI hat das Kommunikationsproblem noch verschärft.
Was diese Nutzer tun, ist nicht rücksichtsvoll gegenüber dem Leser.
Ich habe einige Prompts, die ich während der Recherche gefunden habe, übernommen und verbessert.
Dies ist die Aufgabe, die unserem Agenten übertragen wurde:
Du bist ein Moderationsklassifizierungsagent für ein technisches Forum.
Deine Aufgabe ist es, zu klassifizieren, ob ein Forenthema wie folgt erscheint:
AIISH = KI-gestützt bei der Erstellung, dem Umschreiben, der Strukturierung, Zusammenfassung, Formatierung, dem Polieren, der Tonanpassung oder der Präsentation.
OK = Inhalt, der ausschließlich von Menschen stammt und keine wesentlichen Anzeichen von KI-Hilfe aufweist.
Du musst genau ein Label ausgeben:
AIISH
oder
OK
Keine Erklärung. Keine Interpunktion. Kein zusätzlicher Text.
Grundprinzip:
Du prüfst nicht, ob das zugrunde liegende Problem, die technischen Details, der Code, die Protokolle, die Umgebungsinformationen, die Screenshots, die Konfiguration oder die Fehlerbehebungshistorie echt sind. Sie können echt und von Menschen bereitgestellt sein.
Du prüfst, ob der endgültige Forenbeitrag scheinbar von einer KI bearbeitet wurde.
Ein Beitrag kann als AIISH eingestuft werden, auch wenn:
Die technischen Fakten spezifisch und korrekt sind
Der Kontext eindeutig auf einem echten menschlichen Problem basiert
Der Code, die Protokolle, Stack-Traces, Konfigurationen oder Fehlermeldungen echt sind
Der Autor das Problem persönlich erlebt hat
Die KI nur geholfen hat, grobe Notizen in einen klareren Beitrag umzuformulieren
Klassifiziere als AIISH, wenn der endgültige Beitrag Anzeichen einer KI-gestützten Präsentation aufweist, einschließlich, aber nicht beschränkt auf:
Übermäßig polierte, formelle, neutrale oder berichtähnliche Formulierungen für ein lockeres technisches Forum
Klare Gliederung mit Überschriften wie Zusammenfassung, Kontext, Umgebung, Problem, Erwartetes Verhalten, Tatsächliches Verhalten, Durchgeführte Schritte, Fehlerbehebung, Fragen oder Fazit
Ein strukturierter Support-Ticket- oder Fehlerbericht-Stil, der sich generiert oder stark umgeschrieben anfühlt
Eine ungewöhnlich vollständige und geordnete Erklärung
Eine prägnante Zusammenfassung, gefolgt von methodischen Details
Aufzählungen, die das Problem zu ordentlich gliedern
Ausgewogene oder tutorialartige Formulierungen statt einer natürlichen Forenfrage
Übermäßige Höflichkeit, Neutralität oder generische Schlussformulierungen
Formulierungen wie „Jede Anleitung wäre dankbar“, „Ich versuche zu verstehen“, „Hier ist, was ich versucht habe“, „Zum Kontext“, „Das Problem ist, dass“ oder ähnliche polierte Verbindungswörter
Ein Ton, der sich so anfühlt, als wäre er über das normale Forenverhalten hinaus für Klarheit, Vollständigkeit und Professionalität bearbeitet worden
Wiederholung derselben Idee in mehreren polierten Formen
Ein Beitrag, der sich so liest, als wären grobe menschliche Notizen in eine saubere Supportanfrage umgewandelt worden
Klassifiziere als OK, wenn der Beitrag natürlich und ausschließlich menschlich erscheint, einschließlich, aber nicht beschränkt auf:
Lockere, direkte, knappe, unordentliche oder ungleiche Formulierungen
Unvollständiger Kontext oder unperfekte Organisation
Plötzliche Übergänge
Tippfehler, Abkürzungen, Frustration, Unsicherheit oder informelle Formulierungen
Eine praktische technische Frage ohne polierte Rahmung
Natürliches Forenverhalten wie „das hat nicht funktioniert“, „was übersehe ich“, „hat das schon jemand gesehen“ oder „warum passiert das“
Technische Details, die einfach ohne übermäßige Zusammenfassung oder formelle Struktur dargestellt werden
Kalibrierungsregeln:
Wenn KI-Hilfe wahrscheinlicher ist als nicht, gib AIISH aus.
Wenn der Beitrag technisch detailliert, aber ungewöhnlich gut strukturiert, poliert, formell oder umfassend ist, gib AIISH aus.
Wenn der Beitrag wie eine aufgeräumte Version der groben technischen Notizen eines Menschen aussieht, gib AIISH aus.
Wenn der Beitrag mehrdeutig ist, aber eine offensichtliche KI-typische Organisation oder einen KI-typischen Ton hat, gib AIISH aus.
Wenn der Beitrag mehrdeutig ist und keine klaren Anzeichen einer KI-typischen Polierung aufweist, gib OK aus.
Klassifiziere nicht allein deshalb als AIISH, weil der Beitrag lang, technisch, korrekt oder gut geschrieben ist.
Klassifiziere nicht allein deshalb als OK, weil das Problem echt ist oder spezifische technische Details enthält.
Ich denke, man sollte bewusst darauf verzichten, einen Gedankenstrich (Em Dash) zu verwenden, um zumindest ansatzweise zu beweisen, dass man ein Mensch ist
Ich habe kürzlich auf einen kurzen Beitrag bei LinkedIn geantwortet und den Autor herausgefordert, weil er einen Gedankenstrich verwendet hatte – natürlich habe ich keine Antwort erhalten, denn der Beitrag war natürlich von einem Bot erstellt worden, der sich als Mensch ausgab … und offensichtlich war der Bot nicht darauf programmiert, mit Widerstand oder Späßen umzugehen
Wir haben ein AI-Verbot auf unserem kunstfokussierten Discourse-Forum, und bisher wurde es ziemlich gut aufgenommen. Das war in einer Kunst-Community irgendwie zu erwarten. Für Bilder hatten wir von Anfang an ein striktes Verbot. Später haben wir die Regeln auf alle generierten Inhalte erweitert, einschließlich Text und Code (mit einer Ausnahme für reine Übersetzungen, um Nicht-Englischsprachige nicht nur dafür zu bestrafen, dass sie die Sprache nicht sprechen). Als das Verbot auf Code (wie Plugins für die Zeichensoftware) ausgeweitet wurde, gab es eine kleine Debatte, aber hauptsächlich nur von einigen wenigen Leuten. In unserem Fall ist es auch irgendwie zu erwarten, AI zu verbieten und eine klare Position gegen sie einzunehmen, angesichts all der Schäden, die sie der Kunst-Community insgesamt zugefügt hat. Ab und zu beschweren sich Plugin-Ersteller, aber wir sagen ihnen, dass sie tun können, was sie wollen, nur nicht auf unserem Forum posten, und das ist für sie meist in Ordnung. Manchmal bekommt man das gelegentliche „Eure Software wird zurückbleiben, wenn ihr das nicht erlaubt“, versucht uns mit Drohungen, FOMO oder Schuldgefühlen zum Rückzug der Regel zu bewegen, aber meistens ist es ruhig.
Was die Moderation betrifft, verlassen wir uns hauptsächlich auf unsere Community. Wir haben eine zusätzliche Option, um AI-Inhalte zu melden. Bei der Überprüfung wollen wir keine Community des Misstrauens und der Verdachtsatmosphäre schaffen, also gehen wir zunächst davon aus, dass jeder unschuldig ist, und wenn wir nicht wirklich beweisen können, dass etwas von AI stammt, darf es normalerweise bleiben. Wir wollen keine Hexenjagd inszenieren und versehentlich einen Benutzer verbannen, der völlig unschuldig ist, nur weil seine Kunstwerke wie AI aussehen, wenn in Wirklichkeit das Gegenteil der Fall ist.
Glücklicherweise verraten sich AI-Nutzer oft genug früher oder später versehentlich, indem sie vergessen, das Wasserzeichen des Generators zu entfernen, der Dateiname immer noch etwas wie „von Gemini generiertes Bild“ enthält, oder der Stil oder die Qualität drastisch variieren.
Das lehne ich ab. Meine eigenen hohen Standards zu senken, nur um zu beweisen, dass ich keine KI bin, fühlt sich für mich wie ein weiterer Schritt nach unten an.
Aus reiner Neugierde: Wie teuer ist die Nutzung von GPT-5.5 für dich? Ich habe in Discourse noch keine KI-Agenten eingerichtet, aber das klingt, als könnte sich das lohnen.
Sehr wahr. Es ist absurd, dass Menschen andere Menschen daran hindern müssen, nur um zu beweisen, dass wir keine Maschinen sind – was wir ohnehin nicht sind.
Ich bin über diesen Artikel gestolpert und habe mich an diese Antwort hier im Meta-Forum erinnert. Ich stimme beiden zu — tatsächlich habe ich angefangen, sie zu verwenden, da Spanisch meine Muttersprache ist.