Nuestro bot estaba fallando hasta que establecimos el razonamiento en mínimo. ¡Gracias!
La verdad es que encuentro que GPT-5 es, en general, demasiado lento y no justifica claramente el tiempo de respuesta adicional.
¿Qué te ha parecido para tu bot de soporte?
He probado gpt-5 usando Chat GPT, que es algo muy diferente a través de la API, y necesita ese largo tiempo de razonamiento para dar respuestas ligeramente mejores de las que daría 4o, o 01. Cuando tiene que responder rápido, no es mejor que 4.1.
Estoy bastante seguro de que la situación es similar, o peor, debido a la falta de herramientas y de indicaciones (prompting), cuando se usa la API. Pero no lo sé con seguridad, porque gpt-5 es dolorosamente lento y en un entorno de foro debe responder casi a la velocidad de la luz.
En términos de rendimiento del contenido, anecdóticamente, parece que gpt-5 está dando respuestas técnicas notablemente mejores que gpt-4o. No estoy seguro de cómo cuantificar eso, pero me impresionó mucho.
Estoy obteniendo resultados variables en cuanto al tiempo que tarda en responder. Parece, por los experimentos de esta mañana, que gpt-5 es más lento en promedio, pero no demasiado, y hubo algunos casos en los que la respuesta llegó más rápido con gpt-5. Estoy midiendo entre 5 segundos y 35 segundos para obtener una respuesta.
Estamos usando RAG y no puedo decir qué parte de la latencia proviene de la búsqueda RAG frente a la finalización del chat. Podría ser que a veces no opte por la búsqueda RAG, que la búsqueda sea más rápida o que algo esté en caché (en la búsqueda o en la finalización).
Normalmente elegiríamos mejores respuestas en lugar de una respuesta más rápida porque dar malos consejos técnicos a los clientes es costoso. Hasta cierto punto, sin embargo, si se agota el tiempo de espera, es una muy mala experiencia de usuario.
GPT-5 recomienda principalmente gpt-5-mini para nuestro caso de uso, y escalar a gpt-5 en algunas circunstancias. Suena bien pero complicado. ¿Has considerado cambiar entre modelos dinámicamente? ¿Por qué OpenAI no hace eso automáticamente? ChatGPT - Compare GPT models performance
Tuvimos que volver a gpt-4o porque aparentemente gpt-5-mini cree que puede hacer cosas que no puede. Se ofreció con confianza a configurar un servicio de monitoreo de alarmas para un cliente y conectarlo a su equipo de alarma doméstico. Les pidió números de identificación del equipo y alucinó como si fuera un conserje configurándolo todo para ellos. Nuestro sitio web puede hacer eso, pero el chatbot no. No parece estar respetando las barreras de seguridad en el prompt del sistema como lo hacía gpt-4o. Tendremos que ajustarlo antes de poder dejar que la gente lo use.
Actualización: Resulta que gpt-5 es mucho mejor siguiendo instrucciones y respetando reglas en el prompt que gpt-5-mini. Si vas a dejar que un bot represente tu marca, recomiendo gpt-5 aunque sea más lento y 5 veces más caro. Existe demasiado riesgo de que gpt-5-mini se salga de control.
He tenido muy buena suerte con GTP-5-mini en flujos agenticos a través de llamadas a herramientas, escritura de código y datos estructurados. Generalmente encuentro que los datos estructurados son más fáciles para las aplicaciones de IA que los no estructurados. ¡No era lo que esperaba! Pero las barreras de protección son más fáciles… (código en bucle, humano en bucle, llm-como-juez, etc.)
Miren esto para una explicación detallada del rendimiento de alto nivel y bajo costo de gpt-5-mini y gpt-4o…
Si alguien está interesado en incorporar capacidades de datos estructurados en Discourse como un complemento, etc., por favor, póngase en contacto.
Una extensión de PNL para sql/estadísticas/ciencia de datos para Data Explorer es un ejemplo… Pero también podría tener una herramienta/complemento/función que permita consultas en lenguaje natural de archivos olap sqlLite o duckdb de solo lectura cargados en el contenedor. Solo una idea… ![]()
Por cierto, he añadido GPT 5.1 al complemento junto con algunas correcciones:
@tom_eric preguntaste sobre la capacidad de jugar con otros miembros del foro en otro Tema.
Probé este prompt con Chatbot y parece funcionar con GPT 5.1, pruébalo:
@Chatbot facilita una partida de Go de 9x9 con @Other_Player y yo usando una tabla de markdown para representar el tablero. Deja que yo empiece y solo acepta jugadas mías y de @Other_Player y solo cuando sea nuestro turno. Muestra el tablero y pídeme que inicie…
Oh, gracias. Esa es una idea realmente creativa.Oh, gracias. Esa es una idea realmente creativa.
de nada, avísame cómo te va ![]()
Una configuración de desarrollo ligeramente personalizada me permitió experimentar con un Chatbot jugando Zork usando este complemento y Discourse Frotz ![]()
(aquí con GPT 5.1 con menor razonamiento)
Un poco más tarde:
¡Acumulando una puntuación considerable! Y:
(Disculpas, la configuración es un poco demasiado compleja para compartirla aquí).
¡Guau! No tenía idea de que eso fuera posible. Supongo que casi cualquier cosa es posible con buenos prompts ![]()
Los menús desplegables del modelo de Chatbot ahora tienen gpt 5.2 y 5.2 pro, y para 5.2 ahora hay un nivel de razonamiento xhigh si te encanta quemar tokens y devastar el medio ambiente ![]()
También es posible que notes que los usuarios del complemento de Matemáticas ahora pueden hacer que el Chatbot hable de matemáticas con ecuaciones matemáticas bien renderizadas sin añadir nada a la indicación del sistema…
He movido el botón de lanzamiento a una ubicación mucho más ordenada en la parte inferior derecha (excepto para PWA/aplicación de iOS): háganme saber si no funciona como se esperaba.
Siempre fue la intención simplificar el CSS mientras se adaptaba a esas molestas barras de control en iOS, pero ya no podía soportarlo, me ofendía la vista
![]()
@ThisSource este fue el primer chatbot de IA para Discourse y todavía está funcionando :).
Encantado de anunciar mi primer patrocinador de negocio continuo de Chatbot, Surety, que ahora ocupa la nueva sección Patrocinador del Proyecto del README.
Surety tiene la misión de proporcionar monitoreo de alarmas de seguridad de nivel profesional y automatización del hogar a los aficionados al bricolaje de la manera más transparente y eficiente posible, yendo en contra de la tendencia en la industria de la seguridad del hogar.
¡Gracias Surety!
Si deseas convertirte en patrocinador de uno de mis proyectos, echa un vistazo a: Sponsor @merefield on GitHub Sponsors · GitHub ![]()
Resumen de PR recientes — 1–3 de agosto de 2026
Se han fusionado varias PR relacionadas en Discourse Chatbot y sus plugins de extensión.
Aspectos destacados
- Se introdujeron estrategias avanzadas de razonamiento local, incluyendo verificar y revisar, mejor de dos, y razonamiento guiado por incertidumbre.
- Se añadieron los modelos actuales de OpenAI y el nuevo esfuerzo máximo de razonamiento.
- Se añadió una puerta de preguntas bloqueadas semánticas usando similitud de embeddings.
- ahorros significativos, ya que usa embeddings para bloquear temas que no desea que el bot maneje sin costarle tokens de LLM.
- Se consolidaron las implementaciones básicas y de RAG en un único DiscourseChatbot::Bot.
- Se reemplazaron los ajustes de modo del bot con selectores de herramientas integradas por nivel de confianza.
- Se renombró la API de extensión de “Function” a “Tool”.
- Se reemplazó la herramienta calculadora basada en SafeRuby con el evaluador de expresiones restringido Dentaku: esto es una gran mejora en seguridad, ya que, a pesar de su nombre, SafeRuby tiene vulnerabilidades.
- Se adoptó la carga con Zeitwerk en Chatbot y sus plugins de extensión.
- Se movieron las herramientas específicas de ubicación al plugin de acceso anticipado Locations (patrocíname para recuperar el acceso)
- Se mejoró la recuperación de errores del calculador y el soporte para notaciones comunes de π/e.
- Se actualizó el README
- Se avanzó el plugin principal de la versión 1.8.0 a la 2.4.1.
Discourse Chatbot
-
#162 — CORRECCIÓN: Preservar el estado de razonamiento de la API de Respuestas (FIX: Preserve Responses API reasoning state - Pull Request #162 - merefield/discourse-chatbot - GitHub)
Hizo que el razonamiento de la API de Respuestas y las continuaciones de herramientas fueran fiables, introdujo límites configurables de iteración y tokens,
mejoró la validación de procedencia de URL, preservó respuestas parciales útiles y evitó que se aceptaran respuestas en blanco o mal formadas. -
#163 — CARACTERÍSTICA: Añadir estrategias avanzadas de razonamiento local (FEATURE: Add advanced local reasoning strategies - Pull Request #163 - merefield/discourse-chatbot - GitHub)
Se añadieron estrategias de razonamiento simple, verificar y revisar, mejor de dos y guiado por incertidumbre para Completaciones de Chat, con
solicitudes auxiliares acotadas y registros de auditoría visibles para el personal. -
#164 — CARACTERÍSTICA: Añadir modelos actuales de OpenAI (FEATURE: Add current OpenAI models - Pull Request #164 - merefield/discourse-chatbot - GitHub)
Se actualizaron los selectores de modelos con las variantes más recientes de GPT-5.x y Pro, se enrutarón los modelos apropiados a través de la API de
Respuestas y se añadió el esfuerzo máximo de razonamiento. -
#165 — CORRECCIÓN: Mejorar la guía de reintento del calculador (FIX: Improve calculator retry guidance - Pull Request #165 - merefield/discourse-chatbot - GitHub)
Se proporcionó a los modelos una sintaxis de calculador más clara y una guía de recuperación para que los fallos corregibles se reintenten adecuadamente. -
#166 — CARACTERÍSTICA: Añadir puerta de preguntas bloqueadas semánticas (FEATURE: Add semantic blocked-question gate - Pull Request #166 - merefield/discourse-chatbot - GitHub)
Se añadió una puerta opcional basada en embeddings que puede identificar temas bloqueados definidos administrativamente y devolver respuestas predefinidas antes de invocar al modelo principal. Incluye caché, auditoría para el personal, comportamiento de fallo abierto y soporte para modelos de embedding personalizados. -
#167 — DEV: Reemplazar SafeRuby y adoptar la carga con Zeitwerk (DEV: Replace SafeRuby and adopt Zeitwerk loading - Pull Request #167 - merefield/discourse-chatbot - GitHub)
Se reemplazó el evaluador SafeRuby incluido con Dentaku, se alinearon espacios de nombres y nombres de archivos con Zeitwerk, y
se modernizó la configuración de carga y lint del plugin. Resultó haber vulnerabilidades en SafeRuby, de ahí la migración. -
#168 — DEV: Extraer funciones de Locations de Chatbot (DEV: Extract Locations functions from Chatbot - Pull Request #168 - merefield/discourse-chatbot - GitHub)
Se eliminaron las herramientas y ajustes específicos de ubicación del plugin principal, permitiendo que sean proporcionados independientemente por discourse-locations. -
#169 — CARACTERÍSTICA: Reemplazar modos de bot con selección de herramientas por nivel de confianza
(FEATURE: Replace bot modes with trust-level tool selection - Pull Request #169 - merefield/discourse-chatbot - GitHub)
Esta fue la principal racionalización arquitectónica:- Se reemplazaron los bots básicos y de RAG separados con DiscourseChatbot::Bot.
- Se añadieron selectores de herramientas integrados para cada nivel de confianza.
- Se hizo que un selector vacío fuera equivalente a un bot simple y sin herramientas.
- Se integraron Visión y pintura en el sistema de selección de herramientas.
- Se dejaron las herramientas de plugins suministrados externamente fuera de los selectores integrados.
- Se renombró la terminología, ajustes y clases de Function a Tool.
- Se reordenaron, agruparon y ocultaron condicionalmente los ajustes.
- Se añadió manejo de migración para configuraciones existentes.
- Se hicieron las deducciones de cuota seguras ante concurrencia.
- Se corrigieron los límites de caracteres de respuesta, la selección de registro y la lectura de PDF binarios.
-
#170 — CORRECCIÓN: Mejorar la recuperación de la herramienta calculadora (FIX: Improve calculator tool recovery - Pull Request #170 - merefield/discourse-chatbot - GitHub)
Se normalizaron expresiones familiares como Math::PI, Math.PI, Math::E, Math.E y π a sintaxis compatible con Dentaku.
Las llamadas inválidas repetidas sin cambios ahora se rechazan con guía accionable. -
#171 — DEV: Actualizar documentación del chatbot (DEV: Refresh chatbot documentation - Pull Request #171 - merefield/discourse-chatbot - GitHub)
Se actualizó el README para la arquitectura unificada de bot y herramientas, estrategias de razonamiento, preguntas bloqueadas, comportamiento del calculador, límites, cuotas, puntos finales personalizados, soporte de imagen/PDF y ajustes actuales. El soporte de Visión ya no se describe como experimental.
Plugins complementarios
-
discourse-locations #4 — CORRECCIÓN: Actualizar extensiones de ubicación del Chatbot para la API de herramientas (https://github.com/merefield/discourse-locations-early-access/pull/4)
Se migraron las integraciones de ubicación extraídas a DiscourseChatbot::Tool, se colocaron bajo Locations::Chatbot::Tools y
se actualizaron para el bot unificado. -
Ejemplo de extensión de Function #1 — CORRECCIÓN: Actualizar extensión de ejemplo para la API de herramientas del Chatbot (FIX: Update example extension for Chatbot tool API - Pull Request #1 - merefield/discourse-chatbot-function-extension-example - GitHub)
Se actualizó el plugin de ejemplo para demostrar DiscourseChatbot::Tool, carga con Zeitwerk, ajustes y
tradiciones orientadas a herramientas, y pruebas de comportamiento enfocadas sin código de compatibilidad con versiones anteriores.
@Karthik_K1 echa un vistazo a la captura de pantalla en la última publicación
El chatbot resuelve este problema de forma casi completa y rentable:
Obviamente, si no puedes instalar plugins de terceros, esto te será de poca ayuda.
Acabo de implementar algunas optimizaciones de caché, lo que debería reducir el coste de usar el chatbot.



