Nosso bot estava demorando muito até que definimos o raciocínio como mínimo. Obrigado!
Sinceramente, estou achando o GPT-5 geralmente muito lento e não vale claramente o tempo adicional de resposta.
Como você o achou para o seu bot de suporte?
Eu experimentei o gpt-5 usando o Chat GPT, que é uma coisa realmente muito diferente do que via API, e ele precisa desse longo tempo de raciocínio para dar respostas ligeiramente melhores do que o 4o ou o o1 dariam. Quando ele tem que responder rápido, não é melhor que o 4.1.
Tenho certeza de que a situação é semelhante, ou pior, devido à falta de ferramentas e de prompts, ao usar a API. Mas não sei ao certo, porque o gpt-5 é dolorosamente lento e, em um ambiente de fórum, ele deve responder perto da velocidade da luz.
Em termos de desempenho de conteúdo,Anecdoticamente, parece que o gpt-5 está fornecendo respostas técnicas notavelmente melhores que o gpt-4o. Não tenho certeza de como quantificar isso, mas me impressionou muito.
Estou obtendo resultados variados no tempo de resposta. Parece, a partir de experimentos esta manhã, que o gpt-5 é mais lento em média, mas não muito, e houve alguns casos em que a resposta veio mais rápido com o gpt-5. Estou medindo de 5 segundos a 35 segundos para uma resposta.
Estamos usando RAG e não consigo dizer qual parte da latência vem da pesquisa RAG em vez da conclusão do chat. Pode ser que às vezes ele opte por não fazer a pesquisa RAG, a pesquisa aconteça mais rápido, ou algo esteja em cache (na pesquisa ou na conclusão).
Normalmente escolheríamos respostas melhores em vez de uma resposta mais rápida, porque dar conselhos técnicos ruins aos clientes é caro. Até certo ponto, no entanto, se expirar, essa é uma experiência de usuário muito ruim.
O GPT-5 recomenda principalmente o gpt-5-mini para nosso caso de uso e escala para o gpt-5 em algumas circunstâncias. Parece interessante, mas complicado. Você considerou alternar entre modelos dinamicamente? Por que a OpenAI não faz isso automaticamente? ChatGPT - Compare GPT models performance
Tivemos que voltar para o gpt-4o porque, aparentemente, o gpt-5-mini acha que pode fazer coisas que não pode. Ele se ofereceu com confiança para configurar um serviço de monitoramento de alarmes para um cliente e conectá-lo ao equipamento de alarme de sua casa. Ele pediu os números de ID do equipamento e alucinou como se fosse um concierge configurando tudo para eles. Nosso site pode fazer isso, mas o chatbot não. Ele não parece estar respeitando as barreiras de proteção no prompt do sistema como o gpt-4o fazia. Precisaremos aprimorá-lo antes de podermos permitir que as pessoas o usem.
Atualização: Acontece que o gpt-5 é muito melhor em seguir instruções e respeitar regras no prompt do que o gpt-5-mini. Se você vai deixar um bot representar sua marca, recomendo o gpt-5, embora seja mais lento e 5 vezes mais caro. Há muito risco de o gpt-5-mini sair dos trilhos.
Tenho tido muita sorte com o GTP-5-mini em fluxos agenticos via chamada de ferramentas, escrita de código e dados estruturados. Geralmente acho dados estruturados mais fáceis para aplicativos de IA do que não estruturados! .. não era o que eu esperava! .. mas as salvaguardas são mais fáceis .. (código em loop, humano em loop, llm-como-juiz, etc)
Por favor, assista a isto para um passo a passo de alto desempenho e baixo custo do gpt-5-mini e gpt-4o…
Se alguém estiver interessado em incorporar recursos de dados estruturados no Discourse como um plugin, etc., por favor, entre em contato.
Uma extensão de PNL para sql/estatísticas/ciência de dados para o Data Explorer é um exemplo.. Mas também poderia possivelmente ter uma ferramenta/plugin/recurso que permita consultas em linguagem natural de arquivos olap sqlLite ou duckdb somente leitura carregados no contêiner? Apenas um pensamento.. ![]()
A propósito, adicionei o GPT 5.1 ao plugin, juntamente com algumas correções:
@tom_eric você perguntou sobre a capacidade de jogar com outros membros do fórum em outro Tópico.
Eu tentei este prompt com o Chatbot e parece funcionar com o GPT 5.1, experimente:
@Chatbot facilite um jogo de Go 9x9 com @Other_Player e eu usando uma tabela markdown para renderizar o tabuleiro - deixe-me começar e aceite jogadas apenas de mim e de @Other_Player e somente quando for a nossa vez - renderize o tabuleiro e peça-me para começar…
Ah, obrigado. Essa é uma ideia realmente criativa.Ah, obrigado. Essa é uma ideia realmente criativa.
de nada, me avise como isso funciona ![]()
Uma configuração de desenvolvimento ligeiramente personalizada me permitiu experimentar com um Chatbot jogando Zork usando este plugin e o Discourse Frotz ![]()
(aqui com GPT 5.1 com raciocínio mais baixo)
Um pouco mais tarde:
Acumulando uma pontuação considerável! E:
(Desculpe, a configuração é um pouco complexa demais para ser simplesmente compartilhada aqui).
Uau! Eu não tinha ideia de que isso era possível. Acho que praticamente tudo é possível com bons prompts ![]()
Os menus suspensos de modelo de Chatbot agora têm gpt 5.2 e 5.2 pro - e para o 5.2 há agora um nível de raciocínio xhigh se você adora queimar tokens e devastar o meio ambiente ![]()
Você também pode notar que os usuários do Plugin de Matemática agora podem facilmente fazer com que o Chatbot discuta matemática com equações matemáticas renderizadas de forma agradável sem adicionar nada ao prompt do sistema…
Movi o botão de lançamento para um local muito mais organizado no canto inferior direito (exceto para PWA/aplicativo iOS) - me avise se não estiver funcionando como o esperado.
Isso sempre foi planejado para simplificar o css enquanto acomodava aquelas barras de controle irritantes no iOS, mas eu não conseguia mais conviver com aquilo, estava ofendendo meus olhos
![]()
@ThisSource este foi o primeiro Chatbot de IA para Discourse e ainda está funcionando :).
Tenho o prazer de anunciar meu primeiro patrocinador de negócios contínuo do Chatbot, a Surety, que agora ocupa a nova seção Patrocinador do Projeto do README.
A missão da Surety é fornecer monitoramento de alarmes de segurança de nível profissional e automação residencial para usuários de “faça você mesmo” da maneira mais transparente e eficiente possível, contrariando a tendência na indústria de segurança residencial.
Obrigado, Surety!
Se você gostaria de se tornar um patrocinador de um dos meus projetos, dê uma olhada em: Sponsor @merefield on GitHub Sponsors · GitHub ![]()
Resumo recente dos PRs — 1 a 3 de agosto de 2026
Vários PRs relacionados foram mesclados no Discourse Chatbot e em seus plugins de extensão.
Destaques
- Introduzidas estratégias avançadas de raciocínio local, incluindo verificar-e-revisar, melhor-de-dois e raciocínio guiado por incerteza.
- Adicionados os modelos atuais da OpenAI e o novo esforço máximo de raciocínio.
- Adicionada uma porta de bloqueio semântico de perguntas usando similaridade de embeddings.
- economias significativas, pois usa embeddings para bloquear tópicos que você não deseja que o bot lide, sem custar tokens de LLM.
- Consolidadas as implementações básicas e de RAG em um único DiscourseChatbot::Bot.
- Substituídas as configurações de modo do bot por seletores de ferramentas integradas por nível de confiança.
- Renomeada a API de extensão de “Function” para “Tool”.
- Substituída a ferramenta calculadora baseada em SafeRuby pelo avaliador de expressões restrito Dentaku - esta é uma grande melhoria em segurança, pois, apesar do nome, há vulnerabilidades no SafeRuby.
- Adotado o carregamento Zeitwerk no Chatbot e em seus plugins de extensão.
- Movidas ferramentas específicas de localização para o plugin Locations Early Access (patrocine-me para recuperar o acesso)
- Melhorada a recuperação de erros do calculador e suporte para notação comum de π/e.
- Atualizado o README
- Avançada a versão principal do plugin de 1.8.0 para 2.4.1.
Discourse Chatbot
-
#162 — CORREÇÃO: Preservar estado de raciocínio da API de Respostas (FIX: Preserve Responses API reasoning state - Pull Request #162 - merefield/discourse-chatbot - GitHub)
Tornou o raciocínio da API de Respostas e as continuações de ferramentas confiáveis, introduziu limites configuráveis de iteração e tokens,
melhorou a validação de procedência de URLs, preservou respostas parciais úteis e impediu que respostas em branco ou malformadas
fossem aceitas. -
#163 — RECURSO: Adicionar estratégias avançadas de raciocínio local (FEATURE: Add advanced local reasoning strategies - Pull Request #163 - merefield/discourse-chatbot - GitHub)
Adicionadas estratégias de raciocínio simples, verificar-e-revisar, melhor-de-dois e guiado por incerteza para Completões de Chat, com
solicitações auxiliares limitadas e registros de auditoria visíveis para a equipe. -
#164 — RECURSO: Adicionar modelos atuais da OpenAI (FEATURE: Add current OpenAI models - Pull Request #164 - merefield/discourse-chatbot - GitHub)
Atualizados os seletores de modelos com variantes mais recentes GPT-5.x e Pro, roteados modelos apropriados através da API de Respostas
e adicionado esforço máximo de raciocínio. -
#165 — CORREÇÃO: Melhorar orientação de retry do calculador (FIX: Improve calculator retry guidance - Pull Request #165 - merefield/discourse-chatbot - GitHub)
Fornecida aos modelos sintaxe de calculador mais clara e orientação de recuperação para que falhas corrigíveis sejam retentadas adequadamente. -
#166 — RECURSO: Adicionar porta de bloqueio semântico de perguntas (FEATURE: Add semantic blocked-question gate - Pull Request #166 - merefield/discourse-chatbot - GitHub)
Adicionada uma porta opcional baseada em embeddings que pode identificar tópicos bloqueados definidos administrativamente e retornar respostas pré-definidas antes de invocar o modelo principal. Inclui cache, auditoria da equipe, comportamento fail-open e suporte a modelos de embedding personalizados. -
#167 — DEV: Substituir SafeRuby e adotar carregamento Zeitwerk (DEV: Replace SafeRuby and adopt Zeitwerk loading - Pull Request #167 - merefield/discourse-chatbot - GitHub)
Substituído o avaliador SafeRuby fornecido pelo Dentaku, alinhados namespaces e nomes de arquivos com Zeitwerk, e modernizada a configuração de carregamento e lint do plugin. Acabou por haver vulnerabilidades no SafeRuby, daí a migração. -
#168 — DEV: Extrair funções de Localização do Chatbot (DEV: Extract Locations functions from Chatbot - Pull Request #168 - merefield/discourse-chatbot - GitHub)
Removidas ferramentas e configurações específicas de localização do plugin principal, permitindo que sejam fornecidas independentemente pelo discourse-locations. -
#169 — RECURSO: Substituir modos do bot por seleção de ferramentas por nível de confiança
(FEATURE: Replace bot modes with trust-level tool selection - Pull Request #169 - merefield/discourse-chatbot - GitHub)
Esta foi a principal racionalização arquitetônica:- Substituídos os bots básicos e RAG separados por DiscourseChatbot::Bot.
- Adicionados seletores de ferramentas integrados para cada nível de confiança.
- Tornado um seletor vazio equivalente a um bot simples, sem ferramentas.
- Integradas Visão e pintura no sistema de seleção de ferramentas.
- Deixadas ferramentas de plugin fornecidas externamente fora dos seletores integrados.
- Renomeada terminologia, configurações e classes de Function para Tool.
- Reordenadas, colocalizadas e ocultadas condicionalmente configurações.
- Adicionado tratamento de migração para configurações existentes.
- Tornadas deduções de quota seguras para concorrência.
- Corrigidos limites de caracteres de resposta, seleção de log e leitura de PDF binário.
-
#170 — CORREÇÃO: Melhorar recuperação da ferramenta calculadora (FIX: Improve calculator tool recovery - Pull Request #170 - merefield/discourse-chatbot - GitHub)
Normalizadas expressões familiares como Math::PI, Math.PI, Math::E, Math.E, e π para sintaxe compatível com Dentaku.
Chamadas inválidas repetidas inalteradas agora são rejeitadas com orientação acionável. -
#171 — DEV: Atualizar documentação do chatbot (DEV: Refresh chatbot documentation - Pull Request #171 - merefield/discourse-chatbot - GitHub)
Atualizado o README para a arquitetura unificada de bot e ferramentas, estratégias de raciocínio, perguntas bloqueadas, comportamento do calculador, limites, quotas, endpoints personalizados, suporte a imagem/PDF e configurações atuais. O suporte a Visão não é mais descrito como experimental.
Plugins companheiros
-
discourse-locations #4 — CORREÇÃO: Atualizar extensões de localização do Chatbot para API de ferramentas (https://github.com/merefield/discourse-locations-early-access/pull/4)
Migradas as integrações de localização extraídas para DiscourseChatbot::Tool, colocadas sob Locations::Chatbot::Tools, e atualizadas para o bot unificado. -
Exemplo de extensão Function #1 — CORREÇÃO: Atualizar extensão de exemplo para API de ferramentas do Chatbot (FIX: Update example extension for Chatbot tool API - Pull Request #1 - merefield/discourse-chatbot-function-extension-example - GitHub)
Atualizado o plugin de exemplo para demonstrar DiscourseChatbot::Tool, carregamento Zeitwerk, configurações e
traduções orientadas a ferramentas, e teste de comportamento focado sem código de compatibilidade legado.
@Karthik_K1 por favor, dê uma olhada na captura de tela da última mensagem
Um chatbot resolve esse problema de forma econômica:
Obviamente, se você não puder instalar plugins de terceiros, isso será de pouca ajuda.
Acabei de implementar algumas otimizações de cache, o que deve reduzir o custo de uso do Chatbot.



