Visão Geral
As conversas sobre ai desta semana no #meta.discourse.org giraram em torno de controlar e entender o custo do AI + uso em segundo plano, apertando as expectativas de segurança em relação às entradas de resumo e melhorando a UX e integrações em todo o conjunto de recursos do Discourse AI.
No lado dos custos/ops, o Discourse lançou cotas baseadas em dólares estimados para o uso do Discourse AI (além dos limites de tokens), facilitando o orçamento entre provedores (veja Cotas baseadas em custo para Discourse AI e o guia complementar Configurando cotas de uso de LLM no Discourse AI). Os administradores também compararam notas sobre chamadas periódicas à API de AI que podem ocorrer mesmo quando você não está usando ativamente os recursos de IU de AI, devido a trabalhos em segundo plano como embeddings e preenchimentos de resumo (veja O Discourse chama APIs de AI em segundo plano e confirmação de Falco).
No front de segurança, houve uma atenção renovada sobre o que exatamente é alimentado nos prompts de resumo—especificamente se comentários HTML incluídos poderiam formar um “canal oculto” para manipulação (veja Comentários HTML também são resumidos por AI, resposta de Falco e preocupações de acompanhamento).
Enquanto isso, várias threads focaram em “fazer funcionar no mundo real”: solução de problemas de erros 500 em sugestões de título de AI e aprendizado de onde encontrar logs de auditoria (veja Thread de suporte Qwen3.7-plus e orientação sobre ai_api_audit_logs), configuração de endpoints internos de AI / sidecars LiteLLM (veja Como usar endpoints internos de AI? e o registro da solução aqui), e hospedagem própria de tradução via API compatível com OpenAI do Ollama (veja Auto-Hospedagem de um LLM de Código Aberto para DiscourseAI, orientação sobre modelo/tokenizador e discussão sobre restrições de tradução aqui).
A UX e o polimento do produto também receberam atenção: uma correção foi proposta para o posicionamento do ícone de sugestão de título de AI (veja O ícone de sugestão de título de AI está posicionado acima do campo de entrada de título), sugestões de AI “inline” levantaram questões de latência/comportamento (veja Integração Inline de Sugestões de AI (no Composer) e questão de latência), e o composer ancorado para conversas com bots de AI foi reativado após ter sido desativado acidentalmente (veja questão e resolução).
Tópicos Interessantes
-
Cotas baseadas em custo para Discourse AI (dólares estimados, não apenas tokens) em #Announcements #ai: sam anunciou uma nova maneira de limitar o uso de AI por custo estimado em dólares por grupo, para ajudar no orçamento entre provedores (anúncio). O recurso se integra ao fluxo de configuração de cota existente (Configurando cotas de uso de LLM no Discourse AI).
-
Resumo de AI inclui comentários HTML (e possíveis preocupações com injeção de prompt) em #Feature ai #ai-summarize: Ed_S levantou o risco de que comentários HTML pudessem se tornar um “canal oculto” para influenciar resumos (preocupação). Falco reconheceu a possibilidade—especialmente com modelos menores/mais antigos—e apontou para a separação de prompt de sistema/usuário como um conceito mitigador (resposta), contra o qual Ed_S reagiu, argumentando que não é um verdadeiro mecanismo contra jailbreaks (acompanhamento).
-
Configuração Qwen3.7-plus: ferramenta de sugestão de título gerando 500s + como depurar com logs de auditoria em Support #ai: bird relatou um erro 500 ao usar geração de título por AI, apesar de outras ferramentas de AI funcionarem (relatório). Falco recomendou consultar
ai_api_audit_logspara diagnósticos mais detalhados (dica), e depois esclareceu como inspecionar a entrada mais recente e que o 500 vinha do Discourse (não do Qwen) (acompanhamento). A thread também apontou para a documentação de geração de imagens quando perguntado se o Discourse AI a suporta (resposta + link, além de Suporte Melhorado à Geração de Imagens no Discourse AI). -
Executando Discourse AI contra endpoints internos (sidecar LiteLLM, listas de permissão de hosts internos, limpeza MCP) em Support #ai: evantobin descreveu como fez a conectividade interna funcionar usando
DISCOURSE_ALLOWED_INTERNAL_HOSTSpara um sidecar LiteLLM em localhost, e mencionou trabalho subsequente para autenticação Vertex AI (detalhes). satonotdead compartilhou uma solução completa usando o IP do gateway interno do Docker, mapeamento de portas e limpeza de ferramentas MCP quebradas (solução). -
Solicitação de recurso / PR: adicionar parâmetro de modelo
{username}aos prompts de sistema de persona de AI em #Feature #ai: 42aross propôs adicionar{username}como um parâmetro de modelo na lista de permissão, para que uma persona de AI possa identificar com confiabilidade o usuário atual no lado do servidor (em vez de ter o LLM inferindo a partir do texto/metadados do tópico) (solicitação + justificativa). Eles também notaram a conclusão do processo CLA (acompanhamento). -
Composer ancorado para conversas com bots de AI: desativado no Meta, depois reativado em #Announcements ai #ai-bot: putty perguntou por que o Meta não mostrava mais a IU do composer ancorado (questão). keegan respondeu que foi desativado acidentalmente e o reativou, notando a mudança para
beta(atualização de status). nicolsdennis fez um acompanhamento com uma questão de produto sobre limitar o comprimento da resposta para conversas com bots (questão). -
Sugestões de AI Inline no composer: consistência + questões de latência/comportamento em #Announcements ai #ai-helper: chapoi discutiu tornar o comportamento consistente entre pontos de entrada de IU semelhantes e pediu feedback (post). nicolsdennis perguntou sobre a latência de ida e volta e se as sugestões são baseadas apenas no título do tópico (questão).
-
Correção de UX: posicionamento do ícone de sugestão de título de AI em ux #ai: chapoi postou uma correção de implementação para o ícone de sugestão de título aparecendo acima do campo de título, pedindo confirmação de efeitos colaterais (correção + link do PR).
-
Mudanças na chave da API Gemini: contas de serviço, preocupações com migração em #Integrations how-to #ai: m_terenui notou as mudanças de segurança relatadas pelo Google em torno das chaves da API Gemini, potencialmente exigindo contas de serviço e migrando chaves antigas, e perguntou o que o Discourse espera que os administradores configurem no futuro (questão). (Referência da thread: Configurar Chaves da API Gemini para Discourse AI)
-
Auto-hospedagem de tradução do Discourse AI com Ollama: escolha de provedor, tokenizador/janela de contexto e por que “endpoints de tradução” não são plug-and-play em #Self-Hosting #ai: mononym perguntou como tentar a tradução do Discourse AI via Ollama e onde estão as configurações da nova IU de administrador (questão). Falco sugeriu usar a API compatível com OpenAI do Ollama, selecionando OpenAI como provedor (orientação), e depois forneceu conselhos práticos de configuração (escolha de tokenizador, janela de contexto) e alertou contra modelos inadequados/antigos (detalhes). A thread também cobriu por que a tradução do Discourse AI não foi projetada como uma simples substituição de endpoint do LibreTranslate e por que o plugin Translator mais antigo ainda pode ser usado “como está” (restrições).
Atividade
-
sam introduziu cotas de custo estimado em dólares para grupos do Discourse AI em #Announcements, apontando os administradores para a documentação mais ampla de cotas (Cotas baseadas em custo para Discourse AI; Configurando cotas de uso de LLM no Discourse AI).
-
Falco esteve ativo em threads de solução de problemas, segurança e auto-hospedagem:
- Discutiu riscos/mitigações em torno de entradas de resumo quando comentários HTML são incluídos (resposta; veja também a preocupação com injeção de prompt aqui e acompanhamento aqui).
- Ajudou a depurar um erro 500 de sugestão de título relacionado ao Qwen apontando para
ai_api_audit_logse aconselhando como inspecionar linhas recentes após reproduzir o erro (dica de log de auditoria; inspecionar linha mais recente + erro 500 do lado do Discourse; ponteiro de geração de imagens aqui; relacionado: Suporte Melhorado à Geração de Imagens no Discourse AI). - Confirmou que chamadas periódicas de AI em segundo plano podem ser esperadas para recursos habilitados como preenchimentos de resumo e embeddings (O Discourse chama APIs de AI em segundo plano; questão original do administrador aqui).
- Orientou auto-hospedeiros usando Ollama via compatibilidade OpenAI e forneceu conselhos de configuração/modelo para tradução (usar provedor OpenAI com Ollama; tokenizador/janela de contexto + advertências de modelo; restrições de design de tradução vs LibreTranslate aqui).
-
chapoi insistiu em UX e consistência:
- Discutiu alinhar o comportamento de sugestão de AI entre superfícies e pediu feedback (Integração Inline de Sugestões de AI (no Composer); questão relacionada de latência/escopo de título aqui).
- Propôs uma correção para o posicionamento do ícone de sugestão de título de AI, vinculando um PR de implementação e solicitando testes de efeitos colaterais (O ícone de sugestão de título de AI está posicionado acima do campo de entrada de título).
-
Ed_S levantou uma preocupação focada em segurança de que resumir comentários HTML poderia ser usado como um canal oculto de manipulação (Comentários HTML também são resumidos por AI) e enfatizou que a separação de prompt de sistema/usuário não é uma garantia rígida contra influência de jailbreak (acompanhamento).
-
42aross propôs uma pequena mudança aditiva para melhorar o modelagem de prompt de persona de AI adicionando
{username}como uma variável suportada (Adicionar {username} como parâmetro de modelo em prompts de sistema de persona de AI; acompanhamento CLA aqui). -
keegan reativou o composer ancorado para conversas com bots de AI após ter sido desligado acidentalmente, e notou a promoção do recurso para
beta(Apresentando um composer ancorado para conversas com bots de AI; questão original aqui). -
evantobin compartilhou detalhes de configuração de rede interna para conectar o Discourse AI a um sidecar LiteLLM usando
DISCOURSE_ALLOWED_INTERNAL_HOSTS(Como usar endpoints internos de AI?; veja também a solução completa posterior aqui). -
m_terenui levantou duas preocupações de administrador/operador:
- Se a abordagem de chave da API Gemini do Google mudou para exigir contas de serviço e o que o Discourse espera que os administradores colem nas configurações (Configurar Chaves da API Gemini para Discourse AI; raiz da thread de tutorial aqui).
- Notou chamadas periódicas do Gemini e perguntou se o Discourse invoca APIs de AI em segundo plano; Falco confirmou que trabalhos em segundo plano podem fazer isso dependendo dos recursos habilitados (O Discourse chama APIs de AI em segundo plano; resposta).
-
putty sinalizou que a IU do composer de bot de AI ancorado parecia desabilitada no Meta e pediu a justificativa (Apresentando um composer ancorado para conversas com bots de AI; resolução aqui).
-
nicolsdennis fez perguntas de produto/ops em duas threads de anúncio:
- Sobre latência e se as sugestões inline são baseadas apenas no título do tópico (Integração Inline de Sugestões de AI (no Composer); discussão relacionada de consistência aqui).
- Sobre restringir o comprimento da resposta do bot de AI na experiência do composer ancorado (Apresentando um composer ancorado para conversas com bots de AI; atualização de status do recurso aqui).
-
bird documentou um problema de integração do Discourse AI usando Qwen3.7-plus onde a sugestão de título retornou um erro 500 (relatório), perguntou como visualizar logs mais profundos (questão) e mais tarde perguntou sobre suporte a geração de imagens (questão; resposta e ponteiro aqui).
-
satonotdead postou uma solução detalhada “funcionou” para endpoints internos de AI, cobrindo roteamento de gateway Docker, exposição de portas e remoção de entradas de ferramentas/servidor MCP quebradas (Como usar endpoints internos de AI?; contexto de configuração anterior aqui).
-
mononym reviveu a thread de auto-hospedagem com perguntas sobre a IU de administrador atual, uso de Ollama para tradução e se um endpoint estilo LibreTranslate poderia ser reutilizado (Auto-Hospedagem de um LLM de Código Aberto para DiscourseAI; questões de provedor/configuração aqui; questão de compatibilidade LibreTranslate aqui). Falco respondeu com orientação de configuração e restrições (configuração compatível com OpenAI; conselho de tokenizador/contexto; por que não LibreTranslate em tradução de AI).
Obrigado por ler, e nos vemos na próxima semana! ![]()