Notre bot expirait jusquâĂ ce que nous ayons dĂ©fini le raisonnement sur minimal. Merci !
Pour ĂȘtre honnĂȘte, je trouve que GPT-5 est gĂ©nĂ©ralement trop lent et ne vaut manifestement pas le temps de rĂ©ponse supplĂ©mentaire.
Comment lâavez-vous trouvĂ© pour votre bot de support ?
Jâai essayĂ© gpt-5 via Chat GPT, ce qui est trĂšs diffĂ©rent de via lâAPI, et il lui faut ce long temps de raisonnement pour donner des rĂ©ponses lĂ©gĂšrement meilleures que ce que 4o ou o1 donneraient. Quand il doit rĂ©pondre rapidement, il nâest pas meilleur que 4.1.
Je suis tout Ă fait sĂ»r que la situation est similaire, voire pire, en raison du manque dâoutils et de requĂȘtes, lors de lâutilisation de lâAPI. Mais je ne sais pas avec certitude, car gpt-5 est douloureusement lent et dans un environnement de forum, il doit rĂ©pondre Ă la vitesse de la lumiĂšre.
En termes de performance du contenu, de maniĂšre anecdotique, il semble que gpt-5 donne des rĂ©ponses techniques sensiblement meilleures que gpt-4o. Je ne suis pas sĂ»r de la maniĂšre de quantifier cela, mais cela mâa vraiment impressionnĂ©.
Jâobtiens des rĂ©sultats variables quant au temps de rĂ©ponse. Il semble, dâaprĂšs mes expĂ©riences de ce matin, que gpt-5 soit plus lent en moyenne, mais pas trop, et il y a eu des cas oĂč la rĂ©ponse est arrivĂ©e plus rapidement avec gpt-5. Je mesure entre 5 secondes et 35 secondes pour une rĂ©ponse.
Nous utilisons RAG et je ne peux pas dire quelle partie de la latence provient de la recherche RAG par rapport Ă lâachĂšvement du chat. Il se peut que parfois il choisisse de ne pas effectuer de recherche RAG, que la recherche soit plus rapide, ou que quelque chose soit mis en cache (dans la recherche ou lâachĂšvement).
Nous choisirions gĂ©nĂ©ralement de meilleures rĂ©ponses plutĂŽt quâune rĂ©ponse plus rapide, car donner de mauvais conseils techniques aux clients coĂ»te cher. JusquâĂ un certain point cependant, si cela expire, câest une trĂšs mauvaise expĂ©rience utilisateur.
GPT-5 recommande principalement gpt-5-mini pour notre cas dâutilisation, et dâescalader vers gpt-5 dans certaines circonstances. Cela semble intĂ©ressant mais compliquĂ©. Avez-vous envisagĂ© de passer dynamiquement dâun modĂšle Ă lâautre ? Pourquoi OpenAI ne le fait-il pas automatiquement ? ChatGPT - Compare GPT models performance
Nous avons dĂ» revenir Ă gpt-4o car apparemment gpt-5-mini pense pouvoir faire des choses quâil ne peut pas faire. Il a proposĂ© avec assurance de configurer un service de surveillance dâalarme pour un client et de le connecter Ă son Ă©quipement dâalarme domestique. Il leur a demandĂ© des numĂ©ros dâidentification dâĂ©quipement et a hallucinĂ© comme sâil sâagissait dâun concierge qui mettait tout en place pour eux. Notre site web peut le faire, mais le chatbot ne le peut pas. Il ne semble pas respecter les garde-fous du prompt systĂšme comme le faisait gpt-4o. Nous devrons le renforcer avant de pouvoir le laisser utiliser par les gens.
Mise Ă jour : Il sâavĂšre que gpt-5 est bien meilleur pour suivre les instructions et respecter les rĂšgles du prompt que gpt-5-mini. Si vous allez laisser un bot reprĂ©senter votre marque, je recommande gpt-5 mĂȘme sâil est plus lent et 5 fois plus cher. Il y a trop de risques que gpt-5-mini dĂ©raille.
Jâai eu beaucoup de chance avec GTP-5-mini dans les flux agentiques via lâappel dâoutils, lâĂ©criture de code et les donnĂ©es structurĂ©es. Je trouve gĂ©nĂ©ralement que les donnĂ©es structurĂ©es sont plus faciles pour les applications dâIA que les donnĂ©es non structurĂ©es !.. ce Ă quoi je ne mâattendais pas ! mais les garde-fous sont plus faciles⊠(code-en-boucle, humain-en-boucle, llm-comme-juge, etc.)
veuillez regarder ceci pour une analyse dĂ©taillĂ©e des performances Ă©levĂ©es et Ă faible coĂ»t de gpt-5-mini et gpt-4oâŠ
Si quelquâun est intĂ©ressĂ© Ă intĂ©grer des capacitĂ©s de donnĂ©es structurĂ©es dans Discourse sous forme de plugin, etc., veuillez me contacter.
Une extension NLP pour sql/stats/datascience pour Data Explorer en est un exemple⊠Mais il pourrait Ă©galement y avoir un outil/plugin/fonctionnalitĂ© qui permet des requĂȘtes en langage naturel sur des fichiers olap sqlLite ou duckdb en lecture seule chargĂ©s dans le conteneur ? juste une pensĂ©e.. ![]()
Au fait, jâai ajoutĂ© GPT 5.1 au plugin ainsi que quelques corrections :
@tom_eric vous avez posĂ© des questions sur la possibilitĂ© de jouer Ă des jeux avec dâautres membres du forum sur un autre sujet.
Jâai essayĂ© cette invite avec Chatbot et il semble que cela fonctionne avec GPT 5.1, essayez-le :
@Chatbot facilite une partie de Go 9x9 avec @Other_Player et moi en utilisant un tableau markdown pour afficher le plateau - laissez-moi commencer et nâacceptez les coups que de moi et de @Other_Player et seulement quand câest notre tour - affichez le plateau et demandez-moi de commencerâŠ
Oh, merci. Câest une idĂ©e vraiment crĂ©ative. Oh, merci. Câest une idĂ©e vraiment crĂ©ative.
De rien, fais-moi savoir comment ça se passe ![]()
Une configuration de dĂ©veloppement lĂ©gĂšrement personnalisĂ©e mâa permis dâexpĂ©rimenter avec un Chatbot jouant Ă Zork en utilisant ce plugin et Discourse Frotz ![]()
(ici avec GPT 5.1 sur un raisonnement plus faible)
Un peu plus tard :
Accumulant un score impressionnant ! Et :
(Veuillez mâexcuser, la configuration est un peu trop complexe pour ĂȘtre simplement partagĂ©e ici).
Wow ! Je ne savais pas que câĂ©tait possible. Je suppose que presque tout est possible avec de bonnes invites ![]()
Les menus dĂ©roulants des modĂšles de chatbot proposent dĂ©sormais gpt 5.2 et 5.2 pro - et pour 5.2, il existe dĂ©sormais un niveau de raisonnement xhigh si vous aimez brĂ»ler des jetons et dĂ©vaster lâenvironnement ![]()
Vous remarquerez peut-ĂȘtre Ă©galement que les utilisateurs du plugin Maths peuvent dĂ©sormais facilement amener le chatbot Ă discuter de maths avec des Ă©quations mathĂ©matiques joliment rendues sans rien ajouter Ă lâinvite systĂšmeâŠ
Jâai dĂ©placĂ© le bouton de lancement vers un emplacement beaucoup plus soignĂ© en bas Ă droite (sauf pour lâapplication/PWA iOS) - faites-moi savoir si cela ne fonctionne pas comme prĂ©vu.
CâĂ©tait toujours lâintention de simplifier le css tout en sâadaptant Ă ces barres de contrĂŽle ennuyeuses sur iOS, mais je ne pouvais plus le supporter, cela offensait mes yeux
![]()
@ThisSource câĂ©tait le premier agent conversationnel IA pour Discourse et il fonctionne toujours :).
Ravi de vous annoncer mon premier sponsor commercial continu pour Chatbot, Surety, qui occupe désormais la nouvelle section Project Sponsor du README.
Surety a pour mission de fournir une surveillance dâalarme de sĂ©curitĂ© de qualitĂ© professionnelle et une automatisation de la maison aux bricoleurs de la maniĂšre la plus transparente et efficace possible, allant Ă contre-courant dans lâindustrie de la sĂ©curitĂ© domestique.
Merci Surety !
Si vous souhaitez devenir sponsor de lâun de mes projets, consultez : Sponsor @merefield on GitHub Sponsors · GitHub ![]()
RĂ©sumĂ© des PR rĂ©centes â 1â3 aoĂ»t 2026
Plusieurs PR connexes ont Ă©tĂ© fusionnĂ©es dans Discourse Chatbot et ses plugins dâextension.
Points forts
- Introduction de stratĂ©gies de raisonnement local avancĂ©es, notamment verify-and-revise, best-of-two et raisonnement guidĂ© par lâincertitude.
- Ajout des modĂšles OpenAI actuels et du nouveau paramĂštre max reasoning effort.
- Ajout dâune porte de blocage sĂ©mantique pour les questions bloquĂ©es, utilisant la similaritĂ© des embeddings.
- Ăconomies significatives car cela utilise des embeddings pour bloquer les sujets que vous ne souhaitez pas que le bot traite, sans vous coĂ»ter de tokens LLM.
- Consolidation des implémentations de base et RAG en un seul DiscourseChatbot::Bot.
- Remplacement des paramĂštres de mode bot par des sĂ©lecteurs dâoutils intĂ©grĂ©s basĂ©s sur le niveau de confiance.
- Renommage de lâAPI dâextension de âFunctionâ Ă âToolâ.
- Remplacement de lâoutil calculateur basĂ© sur SafeRuby par lâĂ©valuateur dâexpressions Dentaku contraint - câest une grande amĂ©lioration en matiĂšre de sĂ©curitĂ©, car malgrĂ© son nom, SafeRuby prĂ©sente des vulnĂ©rabilitĂ©s.
- Adoption du chargement Zeitwerk dans Chatbot et ses plugins dâextension.
- DĂ©placement des outils spĂ©cifiques Ă lâemplacement dans le plugin Locations Early Access (sponsorisez-moi pour retrouver lâaccĂšs)
- AmĂ©lioration de la rĂ©cupĂ©ration dâerreurs du calculateur et prise en charge des notations Ï/e courantes.
- Mise Ă jour du README
- Passage de la version principale du plugin de 1.8.0 Ă 2.4.1.
Discourse Chatbot
-
#162 â CORRECTION : PrĂ©server lâĂ©tat de raisonnement de lâAPI Responses (FIX: Preserve Responses API reasoning state - Pull Request #162 - merefield/discourse-chatbot - GitHub)
Rendre le raisonnement de lâAPI Responses et les continuations dâoutils fiables, introduire des limites configurables dâitĂ©ration et de tokens,
amĂ©liorer la validation de la provenance des URL, prĂ©server les rĂ©ponses partielles utiles, et empĂȘcher lâacceptation de rĂ©ponses vides ou mal formĂ©es. -
#163 â FONCTIONNALITĂ : Ajouter des stratĂ©gies de raisonnement local avancĂ©es (FEATURE: Add advanced local reasoning strategies - Pull Request #163 - merefield/discourse-chatbot - GitHub)
Ajout de stratĂ©gies de raisonnement simples, verify-and-revise, best-of-two et guidĂ© par lâincertitude pour les Chat Completions, avec
des requĂȘtes auxiliaires limitĂ©es et des journaux dâaudit visibles par le personnel. -
#164 â FONCTIONNALITĂ : Ajouter les modĂšles OpenAI actuels (FEATURE: Add current OpenAI models - Pull Request #164 - merefield/discourse-chatbot - GitHub)
Mise Ă jour des sĂ©lecteurs de modĂšles avec les nouvelles variantes GPT-5.x et Pro, routage des modĂšles appropriĂ©s via lâAPI Responses
et ajout du max reasoning effort. -
#165 â CORRECTION : AmĂ©liorer les conseils de nouvelle tentative du calculateur (FIX: Improve calculator retry guidance - Pull Request #165 - merefield/discourse-chatbot - GitHub)
Fournir aux modÚles une syntaxe de calculateur plus claire et des conseils de récupération afin que les échecs correctibles soient retravaillés de maniÚre appropriée. -
#166 â FONCTIONNALITĂ : Ajouter une porte de blocage sĂ©mantique pour les questions bloquĂ©es (FEATURE: Add semantic blocked-question gate - Pull Request #166 - merefield/discourse-chatbot - GitHub)
Ajout dâune porte optionnelle basĂ©e sur les embeddings capable dâidentifier les sujets bloquĂ©s dĂ©finis administrativement et de retourner des rĂ©ponses prĂ©dĂ©finies avant dâinvoquer le modĂšle principal. Elle inclut la mise en cache, lâaudit par le personnel, un comportement fail-open et la prise en charge de modĂšles dâembedding personnalisĂ©s. -
#167 â DEV : Remplacer SafeRuby et adopter le chargement Zeitwerk (DEV: Replace SafeRuby and adopt Zeitwerk loading - Pull Request #167 - merefield/discourse-chatbot - GitHub)
Remplacement de lâĂ©valuateur SafeRuby intĂ©grĂ© par Dentaku, alignement des espaces de noms et des noms de fichiers avec Zeitwerk, et
modernisation de la configuration de chargement et de lint du plugin. Il sâest avĂ©rĂ© quâil y avait des vulnĂ©rabilitĂ©s dans SafeRuby, dâoĂč la migration. -
#168 â DEV : Extraire les fonctions Locations de Chatbot (DEV: Extract Locations functions from Chatbot - Pull Request #168 - merefield/discourse-chatbot - GitHub)
Suppression des outils et paramĂštres spĂ©cifiques Ă lâemplacement du plugin principal, permettant quâils soient fournis indĂ©pendamment par discourse-locations. -
#169 â FONCTIONNALITĂ : Remplacer les modes bot par la sĂ©lection dâoutils basĂ©e sur le niveau de confiance
(FEATURE: Replace bot modes with trust-level tool selection - Pull Request #169 - merefield/discourse-chatbot - GitHub)
CâĂ©tait la rationalisation architecturale principale :- Remplacement des bots de base et RAG sĂ©parĂ©s par DiscourseChatbot::Bot.
- Ajout de sĂ©lecteurs dâoutils intĂ©grĂ©s pour chaque niveau de confiance.
- Un sélecteur vide est équivalent à un bot simple sans outil.
- IntĂ©gration de Vision et de la peinture dans le systĂšme de sĂ©lection dâoutils.
- Les outils de plugins fournis externalement restent en dehors des sélecteurs intégrés.
- Renommage de la terminologie Function, des paramĂštres et des classes en Tool.
- Réorganisation, regroupement et masquage conditionnel des paramÚtres.
- Ajout de la gestion de migration pour les configurations existantes.
- Rendre les déductions de quota sûres face à la concurrence.
- Correction des limites de caractÚres des réponses, de la sélection des journaux et de la lecture PDF binaire.
-
#170 â CORRECTION : AmĂ©liorer la rĂ©cupĂ©ration de lâoutil calculateur (FIX: Improve calculator tool recovery - Pull Request #170 - merefield/discourse-chatbot - GitHub)
Normalisation dâexpressions familiĂšres telles que Math::PI, Math.PI, Math::E, Math.E et Ï en syntaxe compatible Dentaku.
Les appels invalides inchangés répétés sont maintenant rejetés avec des conseils actionnables. -
#171 â DEV : Actualiser la documentation du chatbot (DEV: Refresh chatbot documentation - Pull Request #171 - merefield/discourse-chatbot - GitHub)
Mise Ă jour du README pour lâarchitecture unifiĂ©e du bot et des outils, les stratĂ©gies de raisonnement, les questions bloquĂ©es, le comportement du calculateur, les limites, les quotas, les points de terminaison personnalisĂ©s, la prise en charge des images/PDF et les paramĂštres actuels. La prise en charge de Vision nâest plus dĂ©crite comme expĂ©rimentale.
Plugins compagnons
-
discourse-locations #4 â CORRECTION : Mettre Ă jour les extensions de localisation du Chatbot pour lâAPI Tool (https://github.com/merefield/discourse-locations-early-access/pull/4)
Migration des intégrations de localisation extraites vers DiscourseChatbot::Tool, placement sous Locations::Chatbot::Tools,
et mise à jour pour le bot unifié. -
Exemple dâextension Function #1 â CORRECTION : Mettre Ă jour lâextension exemple pour lâAPI Tool du Chatbot (FIX: Update example extension for Chatbot tool API - Pull Request #1 - merefield/discourse-chatbot-function-extension-example - GitHub)
Mise à jour du plugin exemple pour démontrer DiscourseChatbot::Tool, le chargement Zeitwerk, les paramÚtres et
traductions orientés outil, et les tests de comportement ciblés sans code de compatibilité legacy.
@Karthik_K1 veuillez jeter un Ćil Ă la capture dâĂ©cran dans le dernier message
Le chatbot résout ce problÚme de maniÚre trÚs rentable :
Ăvidemment, si vous ne pouvez pas installer de plugins tiers, cela vous sera dâune aide limitĂ©e.



