Forum che vietano i contenuti generati dall'IA… Come sta andando?

Anche noi stiamo faticando con questo problema: individuare i contenuti generati dall’IA è sempre più difficile, soprattutto se le persone utilizzano strumenti come Humanizer che aiutano a evitare i tipici segnali dell’IA.

Dal punto di vista della gestione della community, ho la sensazione che permettere l’uso di chatbot sul tuo forum svuoti l’anima della tua community: se le persone volessero parlare con un’IA, l’avrebbero già fatto. Sono qui perché vogliono parlare con un essere umano.

Non abbiamo ancora trovato una soluzione; abbiamo fatto alcuni test con rilevatori di IA, ma è un gioco del gatto e del topo e producono anche troppi falsi positivi. Per ora, abbiamo implementato una policy del forum (che inizieremo a comunicare più fortemente a breve) e ci affidiamo all’aiuto dei nostri moderatori della community per individuare, verificare e pulire i contenuti.

Ma francamente, è esaustante, e a volte mi preoccupo per il futuro delle nostre community se verranno invase dai bot.

6 Mi Piace

Questo è un motivo che mi porta ad evitare di partecipare alle comunità dei subreddit. Ci sono altri motivi e non sono mai stato molto attivo su Reddit, ma al giorno d’oggi è così infestato da bot che mi allontana ancora di più dal pubblicare.

4 Mi Piace

Questo mi ricorda molto la situazione delle email alla fine degli anni '90 e all’inizio degli anni 2000. Come amministratore di sistema di una piccola agenzia di design, il personale aveva iniziato a utilizzare le email nel corso del loro lavoro e lo spam era così prolifico che rendeva le email quasi inutilizzabili. In quei giorni era come giocare a schiacciare le talpe con lo spam.

Come fu portato sotto controllo? L’uso dell’IA seguirà alla fine un percorso simile? Ci vorranno decenni?

3 Mi Piace

Al momento, questo sembra essere l’unico modo per gestirlo: ci sono troppe variabili per rilevare i contenuti generati dall’IA con un certo grado di affidabilità, e chiunque affermi il contrario sta vendendo fuffa. I tentativi pigri sono più facili da individuare, ma altrimenti dobbiamo giudicare ogni messaggio in base al merito del suo contenuto, senza cercare di indovinare come sia stato scritto.

6 Mi Piace

«…»

L’idea che solo gli strumenti di scrittura AI utilizzino il trattino lungo mi sembra ancora strana. Gli esseri umani hanno scritto con quel segno prima dell’avvento dell’IA.

1 Mi Piace

L’uso dell’IA è presente nelle nostre linee guida da tempo; il problema era un numero crescente di utenti, solitamente nuovi, che la utilizzavano non solo per rispondere agli altri, ma per creare discussioni eccessivamente strutturate e formali, più simili a una tesi che a una vera comunicazione. Questo influiva sul tono del sito e sul coinvolgimento degli utenti. Moderare diventava sempre più un processo che richiedeva molto tempo per un team piccolo, e alcune persone non apprezzavano affatto la moderazione, rendendo l’ambiente sgradevole e propenso alle discussioni. Ho deciso di creare un agente IA su Discourse (basato su GPT 5.5) e di utilizzare un’automazione per scansionare la creazione di discussioni da parte dei nuovi membri nelle categorie chiave, valutando la presenza di segni di generazione da parte dell’IA. Questo attiva un segnalazione automatica e una spiegazione gentile sul motivo della segnalazione, con riferimenti alle linee guida e alcuni consigli per un migliore coinvolgimento. I moderatori possono comunque liberare una segnalazione errata o un caso borderline. È risultato molto accurato e ha favorito il comportamento corretto utilizzando molto meno tempo ed evitando conflitti.

Permettiamo lo scraping con limiti di frequenza alle principali aziende tecnologiche, ma abbiamo inserito nel blacklist il resto, responsabili di un numero enorme di connessioni che ci avevano fatto superare i limiti di utilizzo. Come per la maggior parte dei cattivi attori su un sito, tende a essere un piccolo numero di persone che consumano in modo sproporzionato tempo e risorse.

4 Mi Piace

Esatto.

È un problema enorme. Non incentivano l’interazione e leggere questa roba è come cercare di camminare nel miele: è noioso, scoraggiante e raramente appropriato o necessario.

Molte persone faticano a esprimere il loro punto in modo conciso, e l’IA ha creato un problema di comunicazione ancora peggiore.

Quello che fanno questi utenti non è mostrare considerazione per il lettore.

Dobbiamo introdurre un controllo sulla lunghezza massima dei post?

8 Mi Piace

Ho preso in prestito e migliorato alcuni prompt trovati durante la ricerca.

Ecco cosa viene richiesto al nostro agente:

Sei un agente di classificazione della moderazione per un forum tecnico.

Il tuo compito è classificare se un argomento del forum sembra:

AIISH = assistito da IA nella scrittura, riscrittura, strutturazione, sintesi, formattazione, affinamento, regolazione del tono o presentazione.

OK = contenuto esclusivamente umano, senza segni significativi di assistenza da parte dell’IA.

Devi restituire esattamente un’etichetta:

AIISH

oppure

OK

Nessuna spiegazione. Nessuna punteggiatura. Nessun testo aggiuntivo.

Principio fondamentale:

Non stai rilevando se il problema di base, i dettagli tecnici, il codice, i log, le informazioni sull’ambiente, gli screenshot, la configurazione o la cronologia di risoluzione dei problemi siano reali. Possono essere reali e forniti da un essere umano.

Stai rilevando se il post finale del forum sembra essere stato modellato dall’IA.

Un post può essere AIISH anche quando:

  • I fatti tecnici sono specifici e accurati
  • Il contesto si basa chiaramente su un problema umano reale
  • Il codice, i log, gli stack trace, la configurazione o i messaggi di errore sono genuini
  • L’autore ha vissuto personalmente il problema
  • L’IA ha solo aiutato a riscrivere appunti grezzi in un post più chiaro

Classifica come AIISH quando il post finale mostra segni di presentazione assistita da IA, tra cui ma non limitato a:

  • Un linguaggio eccessivamente raffinato, formale, neutro o simile a un rapporto per un forum tecnico informale
  • Una suddivisione chiara in sezioni con intestazioni come Riepilogo, Contesto, Ambiente, Problema, Comportamento Atteso, Comportamento Reale, Passaggi Effettuati, Risoluzione dei Problemi, Domande o Conclusione
  • Uno stile simile a un ticket di supporto o un report di bug che sembra generato o pesantemente riscritto
  • Una spiegazione insolitamente completa e ordinata
  • Un riassunto conciso seguito da dettagli metodici
  • Elenco puntato che organizza il problema in modo troppo ordinato
  • Una formulazione equilibrata o simile a un tutorial piuttosto che una domanda naturale del forum
  • Eccessiva cortesia, neutralità o linguaggio di chiusura generico
  • Frasi come “Ogni indicazione sarebbe apprezzata”, “Sto cercando di capire”, “Ecco cosa ho provato”, “Per contesto”, “Il problema è che” o simili connettivi raffinati
  • Un tono che sembra modificato per chiarezza, completezza e professionalità oltre il comportamento normale del forum
  • Ripetizione della stessa idea in diverse forme raffinate
  • Un post che sembra appunti umani grezzi convertiti in una richiesta di supporto pulita

Classifica come OK quando il post sembra esclusivamente umano, tra cui ma non limitato a:

  • Un linguaggio informale, diretto, conciso, disordinato o irregolare
  • Contesto incompleto o organizzazione imperfetta
  • Transizioni brusche
  • Errori di battitura, abbreviazioni, frustrazione, incertezza o formulazioni informali
  • Una domanda tecnica pratica senza una cornice raffinata
  • Comportamento naturale del forum come “questo si è rotto”, “cosa mi sto perdendo”, “qualcuno ha visto questo” o “perché succede questo”
  • Dettagli tecnici presentati in modo semplice senza eccessiva sintesi o struttura formale

Regole di calibrazione:

  • Se l’assistenza dell’IA è più probabile che non, restituisci AIISH.
  • Se il post è tecnicamente dettagliato ma insolitamente ben strutturato, raffinato, formale o completo, restituisci AIISH.
  • Se il post sembra una versione ripulita degli appunti tecnici grezzi di un umano, restituisci AIISH.
  • Se il post è ambiguo ma ha un’organizzazione o un tono evidenti stile IA, restituisci AIISH.
  • Se il post è ambiguo e manca di chiari segni di raffinamento stile IA, restituisci OK.
  • Non classificare come AIISH solo perché il post è lungo, tecnico, accurato o ben scritto.
  • Non classificare come OK solo perché il problema è reale o contiene dettagli tecnici specifici.

Restituisci solo:

AIISH

oppure

OK

5 Mi Piace

Credo che la maggior parte delle persone comuni non sappia come digitare un trattino lungo sulla tastiera.

4 Mi Piace

Penso che si dovrebbe evitare consapevolmente di usare il trattino lungo, per dimostrare in qualche modo di essere umani :slight_smile:

Ho recentemente risposto a un breve post su LinkedIn, sfidando l’autore perché aveva usato un trattino lungo: ovviamente non ho mai ricevuto una risposta, perché ovviamente il post era stato creato da un bot che si fingeva umano… e chiaramente il bot non era stato programmato per gestire l’avversità o le provocazioni :wink:

3 Mi Piace

Il nostro Discourse, focalizzato sull’arte, ha una politica di divieto all’IA e finora è stata accolta piuttosto bene. Questo era in un certo senso prevedibile da parte di una comunità artistica. Per le immagini, abbiamo applicato un divieto rigoroso fin dall’inizio. In seguito, abbiamo esteso le regole a tutti i contenuti generati, inclusi testo e codice (con un’eccezione per le semplici traduzioni, per non penalizzare i non anglofoni solo per non parlare la lingua). Quando il divieto è stato esteso al codice (come i plugin per il software di pittura), si è scatenato un piccolo dibattito, ma principalmente da parte di poche persone. Nel nostro caso, è anche in un certo senso prevedibile vietare l’IA e prendere posizione contro di essa, dopo tutti i danni che ha causato alla comunità artistica nel suo complesso. Ogni tanto, i creatori di plugin si lamentano, ma noi diciamo loro che possono fare quello che vogliono, purché non lo pubblichino sul nostro forum, e loro per lo più accettano. A volte ricevi la solita minaccia del tipo “il vostro software rimarrà indietro se non permettete questo”, cercando di intimidirci, sfruttare la paura di essere tagliati fuori (FOMO) o farci sentire in colpa per invertire la regola, ma per lo più il clima è tranquillo.

Per quanto riguarda la moderazione, ci affidiamo principalmente alla nostra comunità. Abbiamo una segnalazione aggiuntiva per denunciare i contenuti generati dall’IA. Quando si tratta di verificare, non vogliamo creare una comunità basata sulla sfiducia e sul sospetto, quindi assumiamo che tutti siano innocenti fino a prova contraria e, quando non riusciamo a dimostrare con certezza che qualcosa sia generato dall’IA, il contenuto può normalmente rimanere. Non vogliamo trasformare la cosa in una caccia alle streghe e bannare accidentalmente un utente completamente innocente solo perché la sua opera d’arte sembra generata dall’IA, quando in realtà è il contrario.

Fortunatamente, spesso gli utenti dell’IA prima o poi si scoprono da soli, dimenticando di rimuovere la filigrana del generatore, lasciando nel nome del file qualcosa come “immagine generata da Gemini”, oppure perché lo stile o la qualità variano drasticamente.

4 Mi Piace

Rifiuto di farlo. Abbassare i miei stessi standard elevati per provare di non essere un’IA mi sembra un ulteriore passo indietro.

10 Mi Piace

Per curiosità, quanto ti costa l’utilizzo di questo GPT-5.5? Non ho ancora configurato agenti AI su Discourse, ma sembra che possa valerne la pena.

2 Mi Piace

Poiché l’utilizzo è molto specifico per nuovi utenti base e per la creazione di nuovi argomenti, non è in esecuzione costante, quindi il costo è di 1-2 dollari al mese.

Ho appena modificato la configurazione a 5.6 terra, che ha un costo significativamente più basso.

5 Mi Piace

Molto vero. È imbarazzante che gli umani debbano fermare altri umani solo per dimostrare di non essere macchine, cosa che non siamo in ogni caso.

4 Mi Piace

Mi sono imbattuto in questo articolo e ho ricordato questa risposta qui su Meta. Concordo con entrambi — anzi, essendo lo spagnolo la mia lingua madre, ho iniziato a usarlo.

1 Mi Piace