Nel 2024 (link), abbiamo introdotto le didascalia delle immagini con IA in Discourse AI. Si è rivelata utile soprattutto per l’accessibilità, ma dipendeva dal fatto che gli utenti ricordassero di cliccare su “Didascalia con IA” quando scrivevano un post.
Abbiamo ora riprogettato il sistema di didascalia delle immagini in modo che queste possano essere generate in background per le immagini dei post, memorizzate separatamente dal contenuto grezzo del post (il testo effettivo scritto dall’autore rimane invariato), e visualizzate dove sono utili: per gli screen reader, la ricerca e le lightbox delle immagini.
Con questa versione, le didascalia delle immagini possono ora essere generate automaticamente in background dopo la creazione di un post. Ecco una breve anteprima ![]()
Come funziona
Le didascalia delle immagini con IA sono ora associate alle immagini dei post senza inserire il testo generato nel post stesso. Questo mantiene le didascalia disponibili per l’accessibilità e la ricerca, senza aggiungere testo visibile extra nel corpo di ogni post.
Quando le didascalia sono disponibili, Discourse:
- aggiunge la didascalia IA alle immagini dei post per gli screen reader
- mostra la didascalia nella lightbox dell’immagine
- include il testo della didascalia nell’indicizzazione della ricerca
- consente agli utenti di modificare le didascalia dall’anteprima del composer quando modificano un post
- supporta didascalia specifiche per locale per i contenuti localizzati
Alcune screenshot nel caso i video non siano il tuo forte:
Visibile nella lightbox
Modificabile nel composer
Cercabile
Configurazione
Questa funzionalità si trova nella nuova area di funzionalità IA Didascalia Immagini in Discourse AI, spostata dalla precedente area di funzionalità IA Assistente IA in una sua area dedicata.
Per utilizzarla, avrai bisogno di:
discourse_ai_enabledai_post_image_captions_enabled- un
ai_image_caption_agentfunzionante
L’agente di didascalia delle immagini selezionato deve avere il caricamento delle immagini abilitato e deve utilizzare un LLM con capacità visive. Se la funzionalità è abilitata ma l’agente non è pronto, Discourse mostrerà un problema amministrativo per facilitare l’individuazione dei problemi di configurazione.
Post esistenti
Esiste anche un lavoro di backfill opzionale per le immagini dei post esistenti.
Il backfill è disabilitato per impostazione predefinita, in modo che le comunità possano scegliere se generare didascalia per i post più vecchi e a quale velocità. Questo può essere configurato con:
ai_post_image_captions_backfill_hourly_rateai_post_image_captions_backfill_max_age_days
Provaci 
Per le comunità ospitate da Discourse
i nostri modelli sono già in grado di elaborare immagini. Se desideri rendere le immagini dei post più utili per le persone che utilizzano screen reader, abilita la funzionalità e il backfill (vedi Post esistenti sopra)
Come menzionato sopra, per le comunità self-hosted, assicurati che il tuo agente di didascalia delle immagini utilizzi un modello con capacità visive.
FAQ
D: Quali sono i limiti?
R: C’è un limite configurabile di 10 immagini per post. I Whisper e i messaggi privati vengono ignorati.





