Resumen
Las conversaciones sobre ai de esta semana en #meta.discourse.org se centraron en controlar y comprender el coste de la IA + el uso en segundo plano, endureciendo las expectativas de seguridad en torno a las entradas de resumen y mejorando la UX y las integraciones en todo el conjunto de funciones de Discourse AI.
En el lado de costes/operaciones, Discourse lanzó cuotas basadas en dólares estimados para el uso de Discourse AI (además de los límites de tokens), lo que facilita la elaboración de presupuestos entre proveedores (ver Cuotas basadas en costes para Discourse AI y la guía complementaria Configuración de cuotas de uso de LLM en Discourse AI). Los administradores también compararon notas sobre llamadas periódicas a la API de IA que pueden producirse incluso cuando no se están utilizando activamente las funciones de la interfaz de IA, debido a trabajos en segundo plano como incrustaciones y rellenos de resúmenes (ver ¿Discourse llama a las APIs de IA en segundo plano y confirmación de Falco).
En el frente de la seguridad, hubo una renovada atención sobre qué se introduce exactamente en los prompts de resumen, específicamente si la inclusión de comentarios HTML podría formar un “canal oculto” para la manipulación (ver Los comentarios HTML también son resumidos por la IA, respuesta de Falco, y preocupaciones de seguimiento).
Mientras tanto, varios hilos se centraron en “hacer que funcione en el mundo real”: solución de problemas de errores 500 en las sugerencias de título de IA y aprendizaje sobre dónde encontrar registros de auditoría (ver Hilo de soporte para Qwen3.7-plus y orientación sobre ai_api_audit_logs), configuración de puntos finales de IA internos / sidecars de LiteLLM (ver ¿Cómo usar puntos finales de IA internos? y la redacción de la solución aquí), y autoalojamiento de traducción mediante la API compatible con OpenAI de Ollama (ver Autoalojamiento de un LLM de código abierto para DiscourseAI, orientación sobre modelos/tokenizadores, y discusión sobre restricciones de traducción aquí).
La UX y el pulido del producto también recibieron atención: se propuso una corrección para la posición del icono de sugerencia de título de IA (ver El icono de sugerencia de título de IA se coloca sobre el campo de entrada del título), las sugerencias de IA “en línea” plantearon preguntas sobre latencia/comportamiento (ver Integración en línea de Sugerencias de IA (en Composer) y pregunta sobre latencia), y el composidor acoplado para conversaciones con bots de IA se volvió a habilitar después de haber sido desactivado accidentalmente (ver pregunta y resolución).
Temas Interesantes
-
Cuotas basadas en costes para Discourse AI (dólares estimados, no solo tokens) en #Announcements #ai: sam anunció una nueva forma de limitar el uso de IA por coste en dólares estimado por grupo, para ayudar en la elaboración de presupuestos entre proveedores (anuncio). La función se integra en el flujo de configuración de cuotas existente (Configuración de cuotas de uso de LLM en Discourse AI).
-
El resumen de IA incluye comentarios HTML (y posibles preocupaciones de inyección de prompts) en #Feature ai #ai-summarize: Ed_S planteó el riesgo de que los comentarios HTML pudieran convertirse en un “canal oculto” para influir en los resúmenes (preocupación). Falco reconoció la posibilidad, especialmente con modelos pequeños/antiguos, y señaló la separación de prompts de sistema/usuario como un concepto mitigador (respuesta), a lo que Ed_S se opuso argumentando que no es un mecanismo real contra los jailbreaks (seguimiento).
-
Configuración de Qwen3.7-plus: la herramienta de sugerencia de título devuelve errores 500 + cómo depurar con registros de auditoría en Support #ai: bird informó de un error 500 al usar la generación de títulos de IA, a pesar de que otras herramientas de IA funcionaban (informe). Falco recomendó consultar
ai_api_audit_logspara diagnósticos más detallados (consejo), y luego aclaró cómo inspeccionar la entrada más reciente y que el error 500 provenía de Discourse (no de Qwen) (seguimiento). El hilo también apuntó a la documentación de generación de imágenes cuando se preguntó si Discourse AI la soporta (respuesta + enlace, más Mejora del soporte de generación de imágenes en Discourse AI). -
Ejecución de Discourse AI contra puntos finales internos (sidecar LiteLLM, listas de permitidos de host interno, limpieza de MCP) en Support #ai: evantobin describió cómo hacer funcionar la conectividad interna usando
DISCOURSE_ALLOWED_INTERNAL_HOSTSpara un sidecar LiteLLM en localhost, y mencionó trabajo posterior para la autenticación de Vertex AI (detalles). satonotdead compartió una solución completa usando la IP de puerta de enlace interna de Docker, mapeo de puertos y limpieza de herramientas MCP rotas (solución). -
Solicitud de función / PR: añadir parámetro de plantilla
{username}a los prompts de sistema de la persona de IA en #Feature #ai: 42aross propuso añadir{username}como parámetro de plantilla en la lista de permitidos para que una persona de IA pueda identificar fiablemente al usuario actual en el servidor (en lugar de que el LLM lo infiera del texto/metadatos del tema) (solicitud + razón). También señaló haber completado el proceso de CLA (seguimiento). -
Composidor acoplado para conversaciones con bots de IA: desactivado en Meta, luego vuelto a habilitar en #Announcements ai #ai-bot: putty preguntó por qué Meta ya no mostraba la interfaz de usuario del composidor acoplado (pregunta). keegan respondió que se había desactivado accidentalmente y lo volvió a activar, señalando que el cambio se movía a
beta(actualización de estado). nicolsdennis hizo seguimiento con una pregunta de producto sobre limitar la longitud de respuesta para conversaciones de bots (pregunta). -
Sugerencias de IA en línea en el composidor: consistencia + preguntas de latencia/comportamiento en #Announcements ai #ai-helper: chapoi discutió hacer el comportamiento consistente a través de puntos de entrada de UI similares y pidió comentarios (publicación). nicolsdennis preguntó sobre la latencia de ida y vuelta y si las sugerencias se basan únicamente en el título del tema (pregunta).
-
Corrección de UX: posicionamiento del icono de sugerencia de título de IA en ux #ai: chapoi publicó una corrección de implementación para el icono de sugerencia de título que aparecía sobre el campo de título, pidiendo confirmación de efectos secundarios (corrección + enlace a PR).
-
Cambios en las claves de API de Gemini: cuentas de servicio, preocupaciones de migración en #Integrations how-to #ai: m_terenui señaló los cambios de seguridad reportados por Google en torno a las claves de API de Gemini, que potencialmente requieren cuentas de servicio y migración de claves antiguas, y preguntó qué espera Discourse que configuren los administradores de ahora en adelante (pregunta). (Referencia del hilo: Configurar claves de API de Gemini para Discourse AI)
-
Autoalojamiento de traducción de Discourse AI con Ollama: elección de proveedor, tokenizador/ventana de contexto, y por qué los “puntos finales de traducción” no son una solución plug-and-play en #Self-Hosting #ai: mononym preguntó cómo probar la traducción de Discourse AI vía Ollama y dónde residen los ajustes de la nueva interfaz de usuario de administrador (pregunta). Falco sugirió usar la API compatible con OpenAI de Ollama seleccionando OpenAI como proveedor (orientación), y luego proporcionó consejos de configuración prácticos (elección de tokenizador, ventana de contexto) y advirtió contra modelos inadecuados/antiguos (detalles). El hilo también cubrió por qué la traducción de Discourse AI no está diseñada como un simple reemplazo de un punto final de LibreTranslate y por qué el antiguo plugin Translator aún se puede usar “tal cual” (restricciones).
Actividad
-
sam introdujo cuotas de coste en dólares estimado para grupos de Discourse AI en #Announcements, dirigiendo a los administradores a la documentación más amplia de cuotas (Cuotas basadas en costes para Discourse AI; Configuración de cuotas de uso de LLM en Discourse AI).
-
Falco estuvo activo en hilos de solución de problemas, seguridad y autoalojamiento:
- Discutió riesgos/mitigaciones en torno a las entradas de resumen cuando se incluyen comentarios HTML (respuesta; ver también la preocupación de inyección de prompts aquí y el seguimiento aquí).
- Ayudó a depurar un error 500 de sugerencia de título relacionado con Qwen señalando a
ai_api_audit_logsy aconsejando cómo inspeccionar filas recientes después de reproducir el error (consejo de registro de auditoría; inspeccionar fila más reciente + error 500 en lado de Discourse; puntero a generación de imágenes aquí; relacionado: Mejora del soporte de generación de imágenes en Discourse AI). - Confirmó que se pueden esperar llamadas periódicas de IA en segundo plano para funciones habilitadas como rellenos de resumen e incrustaciones (¿Discourse llama a las APIs de IA en segundo plano; pregunta original del administrador aquí).
- Guió a los autoalojadores que usan Ollama mediante compatibilidad con OpenAI y proporcionó consejos de configuración/modelo para traducción (usar proveedor OpenAI con Ollama; tokenizador/ventana de contexto + advertencias de modelo; restricciones de diseño de traducción vs LibreTranslate aquí).
-
chapoi impulsó la UX y la consistencia:
- Discutió alinear el comportamiento de las sugerencias de IA a través de superficies y pidió comentarios (Integración en línea de Sugerencias de IA (en Composer); pregunta relacionada sobre latencia/alcance del título aquí).
- Propuso una corrección para el posicionamiento del icono de sugerencia de título de IA, enlazando una PR de implementación y solicitando pruebas de efectos secundarios (El icono de sugerencia de título de IA se coloca sobre el campo de entrada del título).
-
Ed_S planteó una preocupación centrada en la seguridad de que resumir comentarios HTML podría usarse como un canal oculto de manipulación (Los comentarios HTML también son resumidos por la IA) y enfatizó que la separación de prompts de sistema/usuario no es una garantía sólida contra la influencia de jailbreaks (seguimiento).
-
42aross propuso un pequeño cambio aditivo para mejorar el templating de prompts de personas de IA añadiendo
{username}como una variable admitida (Añadir {username} como parámetro de plantilla en prompts de sistema de personas de IA; seguimiento de CLA aquí). -
keegan volvió a habilitar el composidor acoplado para conversaciones con bots de IA después de que se desactivara accidentalmente, y señaló la promoción de la función hacia
beta(Introducción de un composidor acoplado para conversaciones con bots de IA; pregunta original aquí). -
evantobin compartió detalles de configuración de red interna para conectar Discourse AI a un sidecar LiteLLM usando
DISCOURSE_ALLOWED_INTERNAL_HOSTS(¿Cómo usar puntos finales de IA internos?; ver también la solución completa posterior aquí). -
m_terenui planteó dos preocupaciones de administrador/operador:
- Si el enfoque de claves de API de Gemini de Google ha cambiado para requerir cuentas de servicio y qué espera Discourse que peguen los administradores en la configuración (Configurar claves de API de Gemini para Discourse AI; raíz del hilo de tutorial aquí).
- Notó llamadas periódicas a Gemini y preguntó si Discourse invoca APIs de IA en segundo plano; Falco confirmó que los trabajos en segundo plano pueden hacerlo dependiendo de las funciones habilitadas (¿Discourse llama a las APIs de IA en segundo plano; respuesta).
-
putty señaló que la interfaz de usuario del composidor de bot de IA acoplado parecía deshabilitada en Meta y pidió la razón (Introducción de un composidor acoplado para conversaciones con bots de IA; resolución aquí).
-
nicolsdennis hizo preguntas de producto/operaciones en dos hilos de anuncios:
- Sobre la latencia y si las sugerencias en línea se basan únicamente en el título del tema (Integración en línea de Sugerencias de IA (en Composer); discusión de consistencia relacionada aquí).
- Sobre restringir la longitud de respuesta de los bots de IA en la experiencia del composidor acoplado (Introducción de un composidor acoplado para conversaciones con bots de IA; actualización de estado de la función aquí).
-
bird documentó un problema de integración de Discourse AI usando Qwen3.7-plus donde la sugerencia de título devolvió un error 500 (informe), preguntó cómo ver registros más profundos (pregunta), y más tarde preguntó sobre el soporte de generación de imágenes (pregunta; respuesta y puntero aquí).
-
satonotdead publicó una solución detallada de “ya funciona” para puntos finales de IA internos, cubriendo enrutamiento de puerta de enlace Docker, exposición de puertos y eliminación de entradas de herramientas/servidores MCP rotos (¿Cómo usar puntos finales de IA internos?; contexto de configuración anterior aquí).
-
mononym revivió el hilo de autoalojamiento con preguntas sobre la interfaz de usuario de administrador actual, el uso de Ollama para traducción y si se podría reutilizar un punto final estilo LibreTranslate (Autoalojamiento de un LLM de código abierto para DiscourseAI; preguntas de proveedor/configuración aquí; pregunta de compatibilidad con LibreTranslate aquí). Falco respondió con orientación de configuración y restricciones (configuración compatible con OpenAI; consejo de tokenizador/contexto; por qué no LibreTranslate en traducción de IA).
Gracias por leer, ¡y nos vemos la próxima semana! ![]()