Discourse Chatbot đŸ€–

Notre bot expirait jusqu’à ce que nous ayons dĂ©fini le raisonnement sur minimal. Merci !

1 « J'aime »

Pour ĂȘtre honnĂȘte, je trouve que GPT-5 est gĂ©nĂ©ralement trop lent et ne vaut manifestement pas le temps de rĂ©ponse supplĂ©mentaire.

Comment l’avez-vous trouvĂ© pour votre bot de support ?

J’ai essayĂ© gpt-5 via Chat GPT, ce qui est trĂšs diffĂ©rent de via l’API, et il lui faut ce long temps de raisonnement pour donner des rĂ©ponses lĂ©gĂšrement meilleures que ce que 4o ou o1 donneraient. Quand il doit rĂ©pondre rapidement, il n’est pas meilleur que 4.1.

Je suis tout Ă  fait sĂ»r que la situation est similaire, voire pire, en raison du manque d’outils et de requĂȘtes, lors de l’utilisation de l’API. Mais je ne sais pas avec certitude, car gpt-5 est douloureusement lent et dans un environnement de forum, il doit rĂ©pondre Ă  la vitesse de la lumiĂšre.

1 « J'aime »

En termes de performance du contenu, de maniĂšre anecdotique, il semble que gpt-5 donne des rĂ©ponses techniques sensiblement meilleures que gpt-4o. Je ne suis pas sĂ»r de la maniĂšre de quantifier cela, mais cela m’a vraiment impressionnĂ©.

J’obtiens des rĂ©sultats variables quant au temps de rĂ©ponse. Il semble, d’aprĂšs mes expĂ©riences de ce matin, que gpt-5 soit plus lent en moyenne, mais pas trop, et il y a eu des cas oĂč la rĂ©ponse est arrivĂ©e plus rapidement avec gpt-5. Je mesure entre 5 secondes et 35 secondes pour une rĂ©ponse.

Nous utilisons RAG et je ne peux pas dire quelle partie de la latence provient de la recherche RAG par rapport à l’achùvement du chat. Il se peut que parfois il choisisse de ne pas effectuer de recherche RAG, que la recherche soit plus rapide, ou que quelque chose soit mis en cache (dans la recherche ou l’achùvement).

Nous choisirions gĂ©nĂ©ralement de meilleures rĂ©ponses plutĂŽt qu’une rĂ©ponse plus rapide, car donner de mauvais conseils techniques aux clients coĂ»te cher. Jusqu’à un certain point cependant, si cela expire, c’est une trĂšs mauvaise expĂ©rience utilisateur.

GPT-5 recommande principalement gpt-5-mini pour notre cas d’utilisation, et d’escalader vers gpt-5 dans certaines circonstances. Cela semble intĂ©ressant mais compliquĂ©. Avez-vous envisagĂ© de passer dynamiquement d’un modĂšle Ă  l’autre ? Pourquoi OpenAI ne le fait-il pas automatiquement ? ChatGPT - Compare GPT models performance

1 « J'aime »

Nous avons dĂ» revenir Ă  gpt-4o car apparemment gpt-5-mini pense pouvoir faire des choses qu’il ne peut pas faire. Il a proposĂ© avec assurance de configurer un service de surveillance d’alarme pour un client et de le connecter Ă  son Ă©quipement d’alarme domestique. Il leur a demandĂ© des numĂ©ros d’identification d’équipement et a hallucinĂ© comme s’il s’agissait d’un concierge qui mettait tout en place pour eux. Notre site web peut le faire, mais le chatbot ne le peut pas. Il ne semble pas respecter les garde-fous du prompt systĂšme comme le faisait gpt-4o. Nous devrons le renforcer avant de pouvoir le laisser utiliser par les gens.

Mise Ă  jour : Il s’avĂšre que gpt-5 est bien meilleur pour suivre les instructions et respecter les rĂšgles du prompt que gpt-5-mini. Si vous allez laisser un bot reprĂ©senter votre marque, je recommande gpt-5 mĂȘme s’il est plus lent et 5 fois plus cher. Il y a trop de risques que gpt-5-mini dĂ©raille.

1 « J'aime »

J’ai eu beaucoup de chance avec GTP-5-mini dans les flux agentiques via l’appel d’outils, l’écriture de code et les donnĂ©es structurĂ©es. Je trouve gĂ©nĂ©ralement que les donnĂ©es structurĂ©es sont plus faciles pour les applications d’IA que les donnĂ©es non structurĂ©es !.. ce Ă  quoi je ne m’attendais pas ! mais les garde-fous sont plus faciles
 (code-en-boucle, humain-en-boucle, llm-comme-juge, etc.)

veuillez regarder ceci pour une analyse détaillée des performances élevées et à faible coût de gpt-5-mini et gpt-4o


Si quelqu’un est intĂ©ressĂ© Ă  intĂ©grer des capacitĂ©s de donnĂ©es structurĂ©es dans Discourse sous forme de plugin, etc., veuillez me contacter.

Une extension NLP pour sql/stats/datascience pour Data Explorer en est un exemple
 Mais il pourrait Ă©galement y avoir un outil/plugin/fonctionnalitĂ© qui permet des requĂȘtes en langage naturel sur des fichiers olap sqlLite ou duckdb en lecture seule chargĂ©s dans le conteneur ? juste une pensĂ©e.. :thinking:

Au fait, j’ai ajoutĂ© GPT 5.1 au plugin ainsi que quelques corrections :

1 « J'aime »

@tom_eric vous avez posĂ© des questions sur la possibilitĂ© de jouer Ă  des jeux avec d’autres membres du forum sur un autre sujet.

J’ai essayĂ© cette invite avec Chatbot et il semble que cela fonctionne avec GPT 5.1, essayez-le :

@Chatbot facilite une partie de Go 9x9 avec @Other_Player et moi en utilisant un tableau markdown pour afficher le plateau - laissez-moi commencer et n’acceptez les coups que de moi et de @Other_Player et seulement quand c’est notre tour - affichez le plateau et demandez-moi de commencer


1 « J'aime »

Oh, merci. C’est une idĂ©e vraiment crĂ©ative. Oh, merci. C’est une idĂ©e vraiment crĂ©ative.

1 « J'aime »

De rien, fais-moi savoir comment ça se passe :+1:

Une configuration de dĂ©veloppement lĂ©gĂšrement personnalisĂ©e m’a permis d’expĂ©rimenter avec un Chatbot jouant Ă  Zork en utilisant ce plugin et Discourse Frotz :wink:

(ici avec GPT 5.1 sur un raisonnement plus faible)

Un peu plus tard :

Accumulant un score impressionnant ! Et :

:open_mouth:

(Veuillez m’excuser, la configuration est un peu trop complexe pour ĂȘtre simplement partagĂ©e ici).

1 « J'aime »

Wow ! Je ne savais pas que c’était possible. Je suppose que presque tout est possible avec de bonnes invites :sweat_smile:

1 « J'aime »

Les menus dĂ©roulants des modĂšles de chatbot proposent dĂ©sormais gpt 5.2 et 5.2 pro - et pour 5.2, il existe dĂ©sormais un niveau de raisonnement xhigh si vous aimez brĂ»ler des jetons et dĂ©vaster l’environnement :sweat_smile:

Vous remarquerez peut-ĂȘtre Ă©galement que les utilisateurs du plugin Maths peuvent dĂ©sormais facilement amener le chatbot Ă  discuter de maths avec des Ă©quations mathĂ©matiques joliment rendues sans rien ajouter Ă  l’invite systĂšme


1 « J'aime »

J’ai dĂ©placĂ© le bouton de lancement vers un emplacement beaucoup plus soignĂ© en bas Ă  droite (sauf pour l’application/PWA iOS) - faites-moi savoir si cela ne fonctionne pas comme prĂ©vu.

C’était toujours l’intention de simplifier le css tout en s’adaptant Ă  ces barres de contrĂŽle ennuyeuses sur iOS, mais je ne pouvais plus le supporter, cela offensait mes yeux :face_vomiting: :sweat_smile:

@ThisSource c’était le premier agent conversationnel IA pour Discourse et il fonctionne toujours :).

Ravi de vous annoncer mon premier sponsor commercial continu pour Chatbot, Surety, qui occupe désormais la nouvelle section Project Sponsor du README.

Surety a pour mission de fournir une surveillance d’alarme de sĂ©curitĂ© de qualitĂ© professionnelle et une automatisation de la maison aux bricoleurs de la maniĂšre la plus transparente et efficace possible, allant Ă  contre-courant dans l’industrie de la sĂ©curitĂ© domestique.

Merci Surety !

@37Rb

Si vous souhaitez devenir sponsor de l’un de mes projets, consultez : Sponsor @merefield on GitHub Sponsors · GitHub :folded_hands:

2 « J'aime »

RĂ©sumĂ© des PR rĂ©centes — 1–3 aoĂ»t 2026

Plusieurs PR connexes ont Ă©tĂ© fusionnĂ©es dans Discourse Chatbot et ses plugins d’extension.

Points forts

  • Introduction de stratĂ©gies de raisonnement local avancĂ©es, notamment verify-and-revise, best-of-two et raisonnement guidĂ© par l’incertitude.
  • Ajout des modĂšles OpenAI actuels et du nouveau paramĂštre max reasoning effort.
  • Ajout d’une porte de blocage sĂ©mantique pour les questions bloquĂ©es, utilisant la similaritĂ© des embeddings.
    • Économies significatives car cela utilise des embeddings pour bloquer les sujets que vous ne souhaitez pas que le bot traite, sans vous coĂ»ter de tokens LLM.
  • Consolidation des implĂ©mentations de base et RAG en un seul DiscourseChatbot::Bot.
  • Remplacement des paramĂštres de mode bot par des sĂ©lecteurs d’outils intĂ©grĂ©s basĂ©s sur le niveau de confiance.
  • Renommage de l’API d’extension de “Function” Ă  “Tool”.
  • Remplacement de l’outil calculateur basĂ© sur SafeRuby par l’évaluateur d’expressions Dentaku contraint - c’est une grande amĂ©lioration en matiĂšre de sĂ©curitĂ©, car malgrĂ© son nom, SafeRuby prĂ©sente des vulnĂ©rabilitĂ©s.
  • Adoption du chargement Zeitwerk dans Chatbot et ses plugins d’extension.
  • DĂ©placement des outils spĂ©cifiques Ă  l’emplacement dans le plugin Locations Early Access (sponsorisez-moi pour retrouver l’accĂšs)
  • AmĂ©lioration de la rĂ©cupĂ©ration d’erreurs du calculateur et prise en charge des notations π/e courantes.
  • Mise Ă  jour du README
  • Passage de la version principale du plugin de 1.8.0 Ă  2.4.1.

Discourse Chatbot

  • #162 — CORRECTION : PrĂ©server l’état de raisonnement de l’API Responses (FIX: Preserve Responses API reasoning state - Pull Request #162 - merefield/discourse-chatbot - GitHub)
    Rendre le raisonnement de l’API Responses et les continuations d’outils fiables, introduire des limites configurables d’itĂ©ration et de tokens,
    amĂ©liorer la validation de la provenance des URL, prĂ©server les rĂ©ponses partielles utiles, et empĂȘcher l’acceptation de rĂ©ponses vides ou mal formĂ©es.

  • #163 — FONCTIONNALITÉ : Ajouter des stratĂ©gies de raisonnement local avancĂ©es (FEATURE: Add advanced local reasoning strategies - Pull Request #163 - merefield/discourse-chatbot - GitHub)
    Ajout de stratĂ©gies de raisonnement simples, verify-and-revise, best-of-two et guidĂ© par l’incertitude pour les Chat Completions, avec
    des requĂȘtes auxiliaires limitĂ©es et des journaux d’audit visibles par le personnel.

  • #164 — FONCTIONNALITÉ : Ajouter les modĂšles OpenAI actuels (FEATURE: Add current OpenAI models - Pull Request #164 - merefield/discourse-chatbot - GitHub)
    Mise Ă  jour des sĂ©lecteurs de modĂšles avec les nouvelles variantes GPT-5.x et Pro, routage des modĂšles appropriĂ©s via l’API Responses
    et ajout du max reasoning effort.

  • #165 — CORRECTION : AmĂ©liorer les conseils de nouvelle tentative du calculateur (FIX: Improve calculator retry guidance - Pull Request #165 - merefield/discourse-chatbot - GitHub)
    Fournir aux modÚles une syntaxe de calculateur plus claire et des conseils de récupération afin que les échecs correctibles soient retravaillés de maniÚre appropriée.

  • #166 — FONCTIONNALITÉ : Ajouter une porte de blocage sĂ©mantique pour les questions bloquĂ©es (FEATURE: Add semantic blocked-question gate - Pull Request #166 - merefield/discourse-chatbot - GitHub)
    Ajout d’une porte optionnelle basĂ©e sur les embeddings capable d’identifier les sujets bloquĂ©s dĂ©finis administrativement et de retourner des rĂ©ponses prĂ©dĂ©finies avant d’invoquer le modĂšle principal. Elle inclut la mise en cache, l’audit par le personnel, un comportement fail-open et la prise en charge de modĂšles d’embedding personnalisĂ©s.

  • #167 — DEV : Remplacer SafeRuby et adopter le chargement Zeitwerk (DEV: Replace SafeRuby and adopt Zeitwerk loading - Pull Request #167 - merefield/discourse-chatbot - GitHub)
    Remplacement de l’évaluateur SafeRuby intĂ©grĂ© par Dentaku, alignement des espaces de noms et des noms de fichiers avec Zeitwerk, et
    modernisation de la configuration de chargement et de lint du plugin. Il s’est avĂ©rĂ© qu’il y avait des vulnĂ©rabilitĂ©s dans SafeRuby, d’oĂč la migration.

  • #168 — DEV : Extraire les fonctions Locations de Chatbot (DEV: Extract Locations functions from Chatbot - Pull Request #168 - merefield/discourse-chatbot - GitHub)
    Suppression des outils et paramĂštres spĂ©cifiques Ă  l’emplacement du plugin principal, permettant qu’ils soient fournis indĂ©pendamment par discourse-locations.

  • #169 — FONCTIONNALITÉ : Remplacer les modes bot par la sĂ©lection d’outils basĂ©e sur le niveau de confiance
    (FEATURE: Replace bot modes with trust-level tool selection - Pull Request #169 - merefield/discourse-chatbot - GitHub)
    C’était la rationalisation architecturale principale :

    • Remplacement des bots de base et RAG sĂ©parĂ©s par DiscourseChatbot::Bot.
    • Ajout de sĂ©lecteurs d’outils intĂ©grĂ©s pour chaque niveau de confiance.
    • Un sĂ©lecteur vide est Ă©quivalent Ă  un bot simple sans outil.
    • IntĂ©gration de Vision et de la peinture dans le systĂšme de sĂ©lection d’outils.
    • Les outils de plugins fournis externalement restent en dehors des sĂ©lecteurs intĂ©grĂ©s.
    • Renommage de la terminologie Function, des paramĂštres et des classes en Tool.
    • RĂ©organisation, regroupement et masquage conditionnel des paramĂštres.
    • Ajout de la gestion de migration pour les configurations existantes.
    • Rendre les dĂ©ductions de quota sĂ»res face Ă  la concurrence.
    • Correction des limites de caractĂšres des rĂ©ponses, de la sĂ©lection des journaux et de la lecture PDF binaire.
  • #170 — CORRECTION : AmĂ©liorer la rĂ©cupĂ©ration de l’outil calculateur (FIX: Improve calculator tool recovery - Pull Request #170 - merefield/discourse-chatbot - GitHub)
    Normalisation d’expressions familiĂšres telles que Math::PI, Math.PI, Math::E, Math.E et π en syntaxe compatible Dentaku.
    Les appels invalides inchangés répétés sont maintenant rejetés avec des conseils actionnables.

  • #171 — DEV : Actualiser la documentation du chatbot (DEV: Refresh chatbot documentation - Pull Request #171 - merefield/discourse-chatbot - GitHub)
    Mise Ă  jour du README pour l’architecture unifiĂ©e du bot et des outils, les stratĂ©gies de raisonnement, les questions bloquĂ©es, le comportement du calculateur, les limites, les quotas, les points de terminaison personnalisĂ©s, la prise en charge des images/PDF et les paramĂštres actuels. La prise en charge de Vision n’est plus dĂ©crite comme expĂ©rimentale.

Plugins compagnons

2 « J'aime »

2 « J'aime »

@Karthik_K1 veuillez jeter un Ɠil Ă  la capture d’écran dans le dernier message

Le chatbot résout ce problÚme de maniÚre trÚs rentable :

Évidemment, si vous ne pouvez pas installer de plugins tiers, cela vous sera d’une aide limitĂ©e.

1 « J'aime »