Il nostro bot andava in timeout finché non abbiamo impostato il ragionamento su minimo. Grazie!
Onestamente, trovo GPT-5 generalmente troppo lento e non vale ovviamente il tempo di risposta aggiuntivo.
Come ti sei trovato con il tuo bot di supporto?
Ho provato gpt-5 usando Chat GPT, che è una cosa molto diversa rispetto all’API, e richiede quel lungo tempo di ragionamento per dare risposte leggermente migliori rispetto a 4o, o o1. Quando deve rispondere velocemente, non è migliore di 4.1.
Sono abbastanza sicuro che la situazione sia simile, o peggiore a causa della mancanza di strumenti e del prompting, quando si utilizza l’API. Ma non lo so per certo, perché gpt-5 è dolorosamente lento e in un ambiente di forum deve rispondere quasi alla velocità della luce.
In termini di prestazioni dei contenuti, aneddoticamente, sembra che gpt-5 fornisca risposte tecniche notevolmente migliori rispetto a gpt-4o. Non sono sicuro di come quantificarlo, ma mi ha davvero impressionato.
Sto ottenendo risultati variabili in termini di tempo di risposta. Sembra che, sperimentando stamattina, gpt-5 sia più lento in media, ma non di molto, e ci sono stati alcuni casi in cui la risposta è arrivata più velocemente con gpt-5. Sto misurando da 5 secondi a 35 secondi per una risposta.
Stiamo utilizzando RAG e non riesco a capire quale porzione della latenza provenga dalla ricerca RAG rispetto al completamento della chat. Potrebbe essere che a volte scelga di non effettuare la ricerca RAG, la ricerca avvenga più velocemente o qualcosa venga memorizzato nella cache (nella ricerca o nel completamento).
Tipicamente sceglieremmo risposte migliori rispetto a una risposta più veloce perché fornire ai clienti cattivi consigli tecnici è costoso. Fino a un certo punto, però, se va in timeout, l’esperienza utente è molto negativa.
GPT-5 raccomanda principalmente gpt-5-mini per il nostro caso d’uso, ed eventualmente gpt-5 in alcune circostanze. Sembra interessante ma complicato. Hai considerato di passare dinamicamente tra i modelli? Perché OpenAI non lo fa automaticamente? ChatGPT - Compare GPT models performance
Abbiamo dovuto tornare a gpt-4o perché apparentemente gpt-5-mini pensa di poter fare cose che non può fare. Si è offerto con sicurezza di impostare un servizio di monitoraggio allarmi per un cliente e di collegarlo alla loro attrezzatura di allarme domestica. Ha chiesto loro i numeri di ID dell’attrezzatura e ha allucinato come se fosse un concierge che impostava tutto per loro. Il nostro sito web può farlo, ma la chatbot no. Non sembra rispettare le misure di sicurezza nel prompt di sistema come faceva gpt-4o. Dovremo renderlo più rigoroso prima di poterlo far usare alle persone.
Aggiornamento: Si scopre che gpt-5 è molto più bravo a seguire le istruzioni e a rispettare le regole nel prompt rispetto a gpt-5-mini. Se hai intenzione di far rappresentare un bot al tuo marchio, ti consiglio gpt-5 anche se è più lento e 5 volte più costoso. C’è troppo rischio che gpt-5-mini vada fuori controllo.
Ho avuto molta fortuna con GTP-5-mini nei flussi agentici tramite chiamata di strumenti, scrittura di codice e dati strutturati. Generalmente trovo che i dati strutturati siano più facili per le app AI rispetto a quelli non strutturati! .. non quello che mi aspettavo! .. ma i meccanismi di protezione (guardrails) sono più facili .. (code-in-loop, human-in-loop, llm-as-judge, ecc.)
per favore guarda questo per una spiegazione dettagliata delle prestazioni elevate e a basso costo di gpt-5-mini e gpt-4o…
Se qualcuno è interessato a integrare funzionalità di dati strutturati in Discourse come plugin, ecc., mi contatti.
Un’estensione NLP per sql/stats/datascience per Data Explorer è un esempio… Ma potrebbe anche avere uno strumento/plugin/funzionalità che consenta query in linguaggio naturale di file olap sqlLite o duckdb di sola lettura caricati nel container? Solo un pensiero.. ![]()
A proposito, ho aggiunto GPT 5.1 al plugin insieme ad alcune correzioni:
@tom_eric hai chiesto della possibilità di giocare a giochi con altri membri del forum in un altro Topic.
Ho provato questo prompt con Chatbot e sembra funzionare con GPT 5.1, provalo:
@Chatbot facilita una partita di Go 9x9 con @Other_Player e me usando una tabella markdown per visualizzare la scacchiera - fammi iniziare per primo e accetta mosse solo da me e da @Other_Player e solo quando è il nostro turno - visualizza la scacchiera e chiedimi di iniziare…
Oh, grazie. È un’idea davvero creativa.Oh, grazie. È un’idea davvero creativa.
np fammi sapere come va ![]()
Una configurazione di sviluppo leggermente personalizzata mi ha permesso di sperimentare con un Chatbot che gioca a Zork utilizzando questo plugin e Discourse Frotz ![]()
(qui con GPT 5.1 con ragionamento inferiore)
Un po’ di tempo dopo:
Accumulando un bel punteggio! E:
(Scusate, la configurazione è un po’ troppo complessa da condividere semplicemente qui).
Wow! Non avevo idea che fosse possibile. Immagino che quasi tutto sia possibile con buoni prompt ![]()
I menu a discesa dei modelli di chatbot ora hanno gpt 5.2 e 5.2 pro - e per 5.2 c’è ora un livello di ragionamento xhigh se ami bruciare token e devastare l’ambiente ![]()
Potresti anche notare che gli utenti del plugin di Matematica possono ora facilmente far sì che il Chatbot discuta di matematica con equazioni matematiche ben renderizzate senza aggiungere nulla al prompt di sistema…
Ho spostato il pulsante di avvio in una posizione molto più ordinata in basso a destra (eccetto per PWA/app iOS): fammi sapere se non funziona come previsto.
Questo era sempre inteso per semplificare il CSS pur venendo incontro a quelle fastidiose barre di controllo su iOS, ma non potevo più conviverci, mi offendeva gli occhi
![]()
@ThisSource questa è stata la prima chatbot AI per Discourse e sta ancora funzionando :).
Lieto di annunciare il mio primo sponsor aziendale continuativo di Chatbot, Surety, che ora occupa la nuova sezione Project Sponsor del README.
Surety ha la missione di fornire monitoraggio di allarmi di sicurezza di livello professionale e automazione domestica ai fai-da-te nel modo più trasparente ed efficiente possibile, contrastando la tendenza nel settore della sicurezza domestica.
Grazie Surety!
Se desideri diventare uno sponsor di uno dei miei progetti, dai un’occhiata a: Sponsor @merefield on GitHub Sponsors · GitHub ![]()
Riepilogo delle PR recenti — 1–3 agosto 2026
Diverse PR correlate sono state integrate in Discourse Chatbot e nei suoi plugin di estensione.
Punti salienti
- Introdotte strategie avanzate di ragionamento locale, tra cui verifica e revisione, best-of-two e ragionamento guidato dall’incertezza.
- Aggiunti i modelli OpenAI più recenti e il nuovo parametro max reasoning effort.
- Aggiunto un filtro semantico per le domande bloccate basato sulla similarità degli embedding.
- Consente significativi risparmi, poiché utilizza gli embedding per bloccare gli argomenti che non si desidera il bot gestisca, senza consumare token LLM.
- Consolidate le implementazioni base e RAG in un’unica classe DiscourseChatbot::Bot.
- Sostituite le impostazioni delle modalità bot con selettori di strumenti integrati basati sul livello di fiducia.
- Rinominata l’API di estensione da “Function” a “Tool”.
- Sostituito lo strumento calcolatore basato su SafeRuby con l’evaluatore di espressioni Dentaku, soggetto a vincoli: questo rappresenta un grande miglioramento in termini di sicurezza, poiché, nonostante il nome, SafeRuby presenta vulnerabilità.
- Adottato il caricamento Zeitwerk in Chatbot e nei suoi plugin di estensione.
- Spostati gli strumenti specifici per la posizione nel plugin Early Access Locations (sponsorizzatemi per riottenere l’accesso)
- Migliorato il recupero dagli errori del calcolatore e il supporto per la notazione comune di π/e.
- Aggiornato il README
- Portato il plugin principale dalla versione 1.8.0 alla 2.4.1.
Discourse Chatbot
-
#162 — FIX: Preservare lo stato di ragionamento dell’API Responses (FIX: Preserve Responses API reasoning state - Pull Request #162 - merefield/discourse-chatbot - GitHub)
Rendere affidabili il ragionamento dell’API Responses e le continuazioni degli strumenti, introdotti limiti configurabili per iterazioni e token,
migliorata la validazione della provenienza degli URL, preservate le risposte parziali utili e impedito che risposte vuote o malformate
vengano accettate. -
#163 — FEATURE: Aggiungere strategie avanzate di ragionamento locale (FEATURE: Add advanced local reasoning strategies - Pull Request #163 - merefield/discourse-chatbot - GitHub)
Aggiunte strategie di ragionamento semplici, verifica e revisione, best-of-two e guidato dall’incertezza per Chat Completions, con
richieste ausiliarie limitate e record di audit visibili al personale. -
#164 — FEATURE: Aggiungere i modelli OpenAI più recenti (FEATURE: Add current OpenAI models - Pull Request #164 - merefield/discourse-chatbot - GitHub)
Aggiornati i selettori dei modelli con le varianti più recenti GPT-5.x e Pro, instradati i modelli appropriati attraverso l’API
Responses e aggiunto il max reasoning effort. -
#165 — FIX: Migliorare le indicazioni per il retry del calcolatore (FIX: Improve calculator retry guidance - Pull Request #165 - merefield/discourse-chatbot - GitHub)
Forniti ai modelli una sintassi del calcolatore più chiara e indicazioni di recupero in modo che i fallimenti correggibili vengano ritentati appropriatamente. -
#166 — FEATURE: Aggiungere un filtro semantico per le domande bloccate (FEATURE: Add semantic blocked-question gate - Pull Request #166 - merefield/discourse-chatbot - GitHub)
Aggiunto un filtro opzionale basato su embedding in grado di identificare gli argomenti bloccati definiti amministrativamente e restituire risposte predefinite prima di invocare il modello principale. Include caching, audit per il personale, comportamento fail-open e supporto per modelli di embedding personalizzati. -
#167 — DEV: Sostituire SafeRuby e adottare il caricamento Zeitwerk (DEV: Replace SafeRuby and adopt Zeitwerk loading - Pull Request #167 - merefield/discourse-chatbot - GitHub)
Sostituito l’evaluatore SafeRuby vendored con Dentaku, allineati namespace e nomi dei file con Zeitwerk e
modernizzata la configurazione di caricamento e linting del plugin. Si è scoperto che SafeRuby presentava vulnerabilità, da cui la migrazione. -
#168 — DEV: Estrarre le funzioni Locations da Chatbot (DEV: Extract Locations functions from Chatbot - Pull Request #168 - merefield/discourse-chatbot - GitHub)
Rimossi gli strumenti e le impostazioni specifici per la posizione dal plugin principale, consentendo loro di essere forniti indipendentemente da discourse-locations. -
#169 — FEATURE: Sostituire le modalità bot con la selezione degli strumenti basata sul livello di fiducia
(FEATURE: Replace bot modes with trust-level tool selection - Pull Request #169 - merefield/discourse-chatbot - GitHub)
Questa è stata la principale razionalizzazione architetturale:- Sostituiti i bot base e RAG separati con DiscourseChatbot::Bot.
- Aggiunti selettori di strumenti integrati per ciascun livello di fiducia.
- Reso un selettore vuoto equivalente a un bot semplice, privo di strumenti.
- Integrate Vision e pittura nel sistema di selezione degli strumenti.
- Lasciati gli strumenti dei plugin forniti esternamente al di fuori dei selettori integrati.
- Rinominata la terminologia Function, le impostazioni e le classi in Tool.
- Riordinati, raggruppati e nascosti condizionalmente le impostazioni.
- Aggiunto il trattamento delle migrazioni per le configurazioni esistenti.
- Resa sicura la concorrenza nelle deduzioni dei quote.
- Corretti i limiti di caratteri delle risposte, la selezione del logging e la lettura di PDF binari.
-
#170 — FIX: Migliorare il recupero dello strumento calcolatore (FIX: Improve calculator tool recovery - Pull Request #170 - merefield/discourse-chatbot - GitHub)
Normalizzate espressioni comuni come Math::PI, Math.PI, Math::E, Math.E e π nella sintassi compatibile con Dentaku.
Le chiamate non valide ripetute senza cambiamenti vengono ora rifiutate con indicazioni operative. -
#171 — DEV: Aggiornare la documentazione di chatbot (DEV: Refresh chatbot documentation - Pull Request #171 - merefield/discourse-chatbot - GitHub)
Aggiornato il README per l’architettura unificata di bot e strumenti, le strategie di ragionamento, le domande bloccate, il comportamento del calcolatore, i limiti, le quote, gli endpoint personalizzati, il supporto per immagini/PDF e le impostazioni correnti. Il supporto Vision non è più descritto come sperimentale.
Plugin complementari
-
discourse-locations #4 — FIX: Aggiornare le estensioni di posizione di Chatbot per l’API degli strumenti (https://github.com/merefield/discourse-locations-early-access/pull/4)
Migrati gli integrazioni di posizione estratti a DiscourseChatbot::Tool, posizionati sotto Locations::Chatbot::Tools e
aggiornati per il bot unificato. -
Esempio di estensione Function #1 — FIX: Aggiornare l’estensione di esempio per l’API degli strumenti di Chatbot (FIX: Update example extension for Chatbot tool API - Pull Request #1 - merefield/discourse-chatbot-function-extension-example - GitHub)
Aggiornato il plugin di esempio per dimostrare DiscourseChatbot::Tool, il caricamento Zeitwerk, le impostazioni e le traduzioni orientate agli strumenti e
i test di comportamento focalizzati senza codice di compatibilità legacy.
@Karthik_K1 guarda lo screenshot nell’ultimo post
Un chatbot risolve questo problema in modo molto conveniente:
Ovviamente, se non puoi installare plugin di terze parti, questo ti sarà di scarsa utilità.
Ho appena apportato alcune ottimizzazioni alla cache, che dovrebbero ridurre i costi di utilizzo di Chatbot.



