Haben Sie KI-basierte Spam-Probleme?

In letzter Zeit bekomme ich viele KI-Spammer, und es ist zeitaufwendig, sie durchzugehen.

Beim aktuellen Spammer, den ich mir ansehe, ist der Text in perfektem Englisch verfasst, es ist ein VPN, die E-Mail-Adresse ist in StopForumSpam gelistet, und ich kann erkennen, dass der Inhalt kopiert/eingefügt wurde, da das verwendete Gedankenstrichzeichen auf Tastaturen nicht vorhanden ist. Das alles musste ich jedoch manuell überprüfen und habe heute Morgen noch mehrere weitere zu prüfen.

Brainstorming einer weiteren Idee:

Wenn ein Beitrag gespeichert wird, könnte Discourse zusätzliche Daten in einem JSONB-Feld für diesen Beitrag aufzeichnen:

  • IP-Adresse
  • ist_vpn? — eine Abfrage in MaxMind, um die Organisation zu finden und zu sehen, ob es sich um ein VPN handelt (z. B. PacketHub S.A.)
  • Eine schnelle Abfrage der E-Mail-Adresse in StopForumSpam
  • Ein Vergleich der Anzahl der Zeichen, die in den Editor ausgegeben wurden, mit der Anzahl der ausgabeerzeugenden Zeichen, die eingegeben wurden (ohne Pfeiltasten, Strg usw.). Zum Beispiel hat der Benutzer 1.000 Zeichen im Rohinhalt ausgegeben, aber nur 10 Mal Tasten gedrückt, die eine Ausgabe erzeugen (was darauf hindeutet, dass der Inhalt eingefügt wurde und der Benutzer dann vielleicht ein Wort bearbeitet hat).
  • Anzahl der Male, die Inhalte mit Tastenkombinationen oder Rechtsklick kopiert oder ausgeschnitten wurden.
  • Anzahl der Male, die Inhalte mit Tastenkombinationen oder Rechtsklick eingefügt wurden. Die Differenz zwischen den Kopier-/Einfüge-Zahlen würde einen weiteren Hinweis liefern.

Moderatoren könnten diese Daten zu Beiträgen in einer kleinen Tabelle einsehen. Ungewöhnliche Werte könnten hervorgehoben werden, damit verdächtige Beiträge auffallen.

Es gibt wahrscheinlich keine perfekte Methode zur automatischen Erkennung, aber mehr Informationen würden den Moderationsprozess beschleunigen.

4 „Gefällt mir“