Últimamente estoy recibiendo muchos spammers de IA, y me lleva mucho tiempo revisarlos.
Con el spammer actual que estoy revisando, el texto está escrito en perfecto inglés, es una VPN, la dirección de correo electrónico está en StopForumSpam y puedo decir que el contenido fue copiado/pegado porque el guion que se utilizó no existe en los teclados. Tuve que comprobar todo eso manualmente y todavía tengo varios más que revisar esta mañana.
Pensando en otra idea:
Cuando se guarda una publicación, Discourse podría registrar datos adicionales en un campo JSONB en esa publicación:
- Dirección IP
- ¿es_vpn? — una búsqueda en maxmind para encontrar la organización y ver si es una VPN (por ejemplo, PacketHub S.A.)
- Una búsqueda rápida de la dirección de correo electrónico en StopForumSpam
- Una comparación del número de caracteres generados en el editor frente al número de caracteres que producen salida escritos (excluyendo teclas como flecha, ctrl, etc.). Por ejemplo, el usuario generó 1.000 caracteres en el contenido sin formato, pero solo presionó teclas que producen salida 10 veces (lo que sugiere que el contenido fue pegado y el usuario luego podría haber editado una palabra).
- Número de veces que el contenido fue copiado o cortado usando atajos de teclado o clic derecho.
- Número de veces que el contenido fue pegado usando atajos de teclado o clic derecho. La diferencia en los números de copia/pegado proporcionaría otra pista.
Los moderadores podrían ver esos datos en las publicaciones en una pequeña tabla. Los valores inusuales podrían resaltarse para que las publicaciones sospechosas destaquen.
Probablemente no exista un método perfecto para automatizar la detección, pero tener más información aceleraría el proceso de moderación.