Resumo semanal de tópicos de IA

Visão Geral

As conversas sobre ai desta semana no #meta.discourse.org giraram em torno de controlar e entender o custo do AI + uso em segundo plano, apertando as expectativas de segurança em relação às entradas de resumo e melhorando a UX e integrações em todo o conjunto de recursos do Discourse AI.

No lado dos custos/ops, o Discourse lançou cotas baseadas em dólares estimados para o uso do Discourse AI (além dos limites de tokens), facilitando o orçamento entre provedores (veja Cotas baseadas em custo para Discourse AI e o guia complementar Configurando cotas de uso de LLM no Discourse AI). Os administradores também compararam notas sobre chamadas periódicas à API de AI que podem ocorrer mesmo quando você não está usando ativamente os recursos de IU de AI, devido a trabalhos em segundo plano como embeddings e preenchimentos de resumo (veja O Discourse chama APIs de AI em segundo plano e confirmação de Falco).

No front de segurança, houve uma atenção renovada sobre o que exatamente é alimentado nos prompts de resumo—especificamente se comentários HTML incluídos poderiam formar um “canal oculto” para manipulação (veja Comentários HTML também são resumidos por AI, resposta de Falco e preocupações de acompanhamento).

Enquanto isso, várias threads focaram em “fazer funcionar no mundo real”: solução de problemas de erros 500 em sugestões de título de AI e aprendizado de onde encontrar logs de auditoria (veja Thread de suporte Qwen3.7-plus e orientação sobre ai_api_audit_logs), configuração de endpoints internos de AI / sidecars LiteLLM (veja Como usar endpoints internos de AI? e o registro da solução aqui), e hospedagem própria de tradução via API compatível com OpenAI do Ollama (veja Auto-Hospedagem de um LLM de Código Aberto para DiscourseAI, orientação sobre modelo/tokenizador e discussão sobre restrições de tradução aqui).

A UX e o polimento do produto também receberam atenção: uma correção foi proposta para o posicionamento do ícone de sugestão de título de AI (veja O ícone de sugestão de título de AI está posicionado acima do campo de entrada de título), sugestões de AI “inline” levantaram questões de latência/comportamento (veja Integração Inline de Sugestões de AI (no Composer) e questão de latência), e o composer ancorado para conversas com bots de AI foi reativado após ter sido desativado acidentalmente (veja questão e resolução).


Tópicos Interessantes

  • Cotas baseadas em custo para Discourse AI (dólares estimados, não apenas tokens) em #Announcements #ai: sam anunciou uma nova maneira de limitar o uso de AI por custo estimado em dólares por grupo, para ajudar no orçamento entre provedores (anúncio). O recurso se integra ao fluxo de configuração de cota existente (Configurando cotas de uso de LLM no Discourse AI).

  • Resumo de AI inclui comentários HTML (e possíveis preocupações com injeção de prompt) em #Feature ai #ai-summarize: Ed_S levantou o risco de que comentários HTML pudessem se tornar um “canal oculto” para influenciar resumos (preocupação). Falco reconheceu a possibilidade—especialmente com modelos menores/mais antigos—e apontou para a separação de prompt de sistema/usuário como um conceito mitigador (resposta), contra o qual Ed_S reagiu, argumentando que não é um verdadeiro mecanismo contra jailbreaks (acompanhamento).

  • Configuração Qwen3.7-plus: ferramenta de sugestão de título gerando 500s + como depurar com logs de auditoria em Support #ai: bird relatou um erro 500 ao usar geração de título por AI, apesar de outras ferramentas de AI funcionarem (relatório). Falco recomendou consultar ai_api_audit_logs para diagnósticos mais detalhados (dica), e depois esclareceu como inspecionar a entrada mais recente e que o 500 vinha do Discourse (não do Qwen) (acompanhamento). A thread também apontou para a documentação de geração de imagens quando perguntado se o Discourse AI a suporta (resposta + link, além de Suporte Melhorado à Geração de Imagens no Discourse AI).

  • Executando Discourse AI contra endpoints internos (sidecar LiteLLM, listas de permissão de hosts internos, limpeza MCP) em Support #ai: evantobin descreveu como fez a conectividade interna funcionar usando DISCOURSE_ALLOWED_INTERNAL_HOSTS para um sidecar LiteLLM em localhost, e mencionou trabalho subsequente para autenticação Vertex AI (detalhes). satonotdead compartilhou uma solução completa usando o IP do gateway interno do Docker, mapeamento de portas e limpeza de ferramentas MCP quebradas (solução).

  • Solicitação de recurso / PR: adicionar parâmetro de modelo {username} aos prompts de sistema de persona de AI em #Feature #ai: 42aross propôs adicionar {username} como um parâmetro de modelo na lista de permissão, para que uma persona de AI possa identificar com confiabilidade o usuário atual no lado do servidor (em vez de ter o LLM inferindo a partir do texto/metadados do tópico) (solicitação + justificativa). Eles também notaram a conclusão do processo CLA (acompanhamento).

  • Composer ancorado para conversas com bots de AI: desativado no Meta, depois reativado em #Announcements ai #ai-bot: putty perguntou por que o Meta não mostrava mais a IU do composer ancorado (questão). keegan respondeu que foi desativado acidentalmente e o reativou, notando a mudança para beta (atualização de status). nicolsdennis fez um acompanhamento com uma questão de produto sobre limitar o comprimento da resposta para conversas com bots (questão).

  • Sugestões de AI Inline no composer: consistência + questões de latência/comportamento em #Announcements ai #ai-helper: chapoi discutiu tornar o comportamento consistente entre pontos de entrada de IU semelhantes e pediu feedback (post). nicolsdennis perguntou sobre a latência de ida e volta e se as sugestões são baseadas apenas no título do tópico (questão).

  • Correção de UX: posicionamento do ícone de sugestão de título de AI em ux #ai: chapoi postou uma correção de implementação para o ícone de sugestão de título aparecendo acima do campo de título, pedindo confirmação de efeitos colaterais (correção + link do PR).

  • Mudanças na chave da API Gemini: contas de serviço, preocupações com migração em #Integrations how-to #ai: m_terenui notou as mudanças de segurança relatadas pelo Google em torno das chaves da API Gemini, potencialmente exigindo contas de serviço e migrando chaves antigas, e perguntou o que o Discourse espera que os administradores configurem no futuro (questão). (Referência da thread: Configurar Chaves da API Gemini para Discourse AI)

  • Auto-hospedagem de tradução do Discourse AI com Ollama: escolha de provedor, tokenizador/janela de contexto e por que “endpoints de tradução” não são plug-and-play em #Self-Hosting #ai: mononym perguntou como tentar a tradução do Discourse AI via Ollama e onde estão as configurações da nova IU de administrador (questão). Falco sugeriu usar a API compatível com OpenAI do Ollama, selecionando OpenAI como provedor (orientação), e depois forneceu conselhos práticos de configuração (escolha de tokenizador, janela de contexto) e alertou contra modelos inadequados/antigos (detalhes). A thread também cobriu por que a tradução do Discourse AI não foi projetada como uma simples substituição de endpoint do LibreTranslate e por que o plugin Translator mais antigo ainda pode ser usado “como está” (restrições).


Atividade


Obrigado por ler, e nos vemos na próxima semana! :slight_smile: