最近AIスパマーが多くて、一つ一つ確認するのが大変です。
現在確認しているスパマーは、完璧な英語で書かれており、VPNを使用し、メールアドレスはStopForumSpamに登録されており、キーボードに存在しないダッシュ文字が使われていることから、コピー&ペーストされたコンテンツだと判断できます。これらすべてを自分で手動で確認する必要があり、今朝もまだいくつか確認すべきものがあります。
別のアイデアをブレインストーミングします。
投稿が保存された際に、Discourseは投稿のJSONBフィールドに以下の追加データを記録できます。
- IPアドレス
- is_vpn? — maxmindで組織を検索し、VPNかどうかを確認します(例:PacketHub S.A.)。
- StopForumSpamでメールアドレスを簡単に検索します。
- エディタに出力された文字数と、出力生成文字の入力回数の比較(矢印キー、Ctrlなどは除く)。例えば、ユーザーが生のコンテンツに1,000文字を出力したが、出力生成キーの入力は10回だけだった場合(コンテンツが貼り付けられ、ユーザーが単語を編集した可能性を示唆)。
- キーボードショートカットまたは右クリックを使用してコンテンツがコピーまたはカットされた回数。
- キーボードショートカットまたは右クリックを使用してコンテンツが貼り付けられた回数。コピー/ペースト回数の差が、さらなる手がかりとなります。
モデレーターは、投稿でそのデータを小さなテーブルで表示できます。異常な値はハイライト表示され、疑わしい投稿が目立つようになります。
検出を自動化する完璧な方法はないかもしれませんが、より多くの情報があれば、モデレーションプロセスを迅速化できます。