C’est un peu ce que je fais, et j’en ai déjà parlé dans des sujets connexes ici, quelque part.
Un message généré ou traité par une IA porte toujours des traces qui le trahissent.
Nous analysons les nouveaux messages des utilisateurs ayant un faible niveau de confiance à l’aide d’un agent qui les signale comme potentiellement générés par une IA ou non. L’utilisateur reçoit alors un message poli de la part du bot expliquant pourquoi et suggérant ce qu’il devrait faire, tandis que nous pouvons soit annuler le signalement, soit supprimer le message.
Ça fonctionne, mais la réalité, c’est une vague de gens qui copient-collent simplement une conversation dans le forum, ce qui n’est pas souhaitable.
Cela ne fait que produire un mur de texte résumé par une IA, et les humains deviennent de simples intermédiaires.
Il vaut mieux adopter une politique de tolérance zéro, à l’exception des problèmes de langue, mais avec la traduction automatique, cela n’est plus nécessaire. Les politiques doivent aussi être visibles : si cette modération se fait en coulisses, on perd la prise de conscience du problème.