Resumen semanal de temas de IA

Resumen

Las conversaciones sobre ai de esta semana en #meta.discourse.org se centraron en controlar y comprender el coste de la IA + el uso en segundo plano, endureciendo las expectativas de seguridad en torno a las entradas de resumen y mejorando la UX y las integraciones en todo el conjunto de funciones de Discourse AI.

En el lado de costes/operaciones, Discourse lanzó cuotas basadas en dólares estimados para el uso de Discourse AI (además de los límites de tokens), lo que facilita la elaboración de presupuestos entre proveedores (ver Cuotas basadas en costes para Discourse AI y la guía complementaria Configuración de cuotas de uso de LLM en Discourse AI). Los administradores también compararon notas sobre llamadas periódicas a la API de IA que pueden producirse incluso cuando no se están utilizando activamente las funciones de la interfaz de IA, debido a trabajos en segundo plano como incrustaciones y rellenos de resúmenes (ver ¿Discourse llama a las APIs de IA en segundo plano y confirmación de Falco).

En el frente de la seguridad, hubo una renovada atención sobre qué se introduce exactamente en los prompts de resumen, específicamente si la inclusión de comentarios HTML podría formar un “canal oculto” para la manipulación (ver Los comentarios HTML también son resumidos por la IA, respuesta de Falco, y preocupaciones de seguimiento).

Mientras tanto, varios hilos se centraron en “hacer que funcione en el mundo real”: solución de problemas de errores 500 en las sugerencias de título de IA y aprendizaje sobre dónde encontrar registros de auditoría (ver Hilo de soporte para Qwen3.7-plus y orientación sobre ai_api_audit_logs), configuración de puntos finales de IA internos / sidecars de LiteLLM (ver ¿Cómo usar puntos finales de IA internos? y la redacción de la solución aquí), y autoalojamiento de traducción mediante la API compatible con OpenAI de Ollama (ver Autoalojamiento de un LLM de código abierto para DiscourseAI, orientación sobre modelos/tokenizadores, y discusión sobre restricciones de traducción aquí).

La UX y el pulido del producto también recibieron atención: se propuso una corrección para la posición del icono de sugerencia de título de IA (ver El icono de sugerencia de título de IA se coloca sobre el campo de entrada del título), las sugerencias de IA “en línea” plantearon preguntas sobre latencia/comportamiento (ver Integración en línea de Sugerencias de IA (en Composer) y pregunta sobre latencia), y el composidor acoplado para conversaciones con bots de IA se volvió a habilitar después de haber sido desactivado accidentalmente (ver pregunta y resolución).


Temas Interesantes

  • Cuotas basadas en costes para Discourse AI (dólares estimados, no solo tokens) en #Announcements #ai: sam anunció una nueva forma de limitar el uso de IA por coste en dólares estimado por grupo, para ayudar en la elaboración de presupuestos entre proveedores (anuncio). La función se integra en el flujo de configuración de cuotas existente (Configuración de cuotas de uso de LLM en Discourse AI).

  • El resumen de IA incluye comentarios HTML (y posibles preocupaciones de inyección de prompts) en #Feature ai #ai-summarize: Ed_S planteó el riesgo de que los comentarios HTML pudieran convertirse en un “canal oculto” para influir en los resúmenes (preocupación). Falco reconoció la posibilidad, especialmente con modelos pequeños/antiguos, y señaló la separación de prompts de sistema/usuario como un concepto mitigador (respuesta), a lo que Ed_S se opuso argumentando que no es un mecanismo real contra los jailbreaks (seguimiento).

  • Configuración de Qwen3.7-plus: la herramienta de sugerencia de título devuelve errores 500 + cómo depurar con registros de auditoría en Support #ai: bird informó de un error 500 al usar la generación de títulos de IA, a pesar de que otras herramientas de IA funcionaban (informe). Falco recomendó consultar ai_api_audit_logs para diagnósticos más detallados (consejo), y luego aclaró cómo inspeccionar la entrada más reciente y que el error 500 provenía de Discourse (no de Qwen) (seguimiento). El hilo también apuntó a la documentación de generación de imágenes cuando se preguntó si Discourse AI la soporta (respuesta + enlace, más Mejora del soporte de generación de imágenes en Discourse AI).

  • Ejecución de Discourse AI contra puntos finales internos (sidecar LiteLLM, listas de permitidos de host interno, limpieza de MCP) en Support #ai: evantobin describió cómo hacer funcionar la conectividad interna usando DISCOURSE_ALLOWED_INTERNAL_HOSTS para un sidecar LiteLLM en localhost, y mencionó trabajo posterior para la autenticación de Vertex AI (detalles). satonotdead compartió una solución completa usando la IP de puerta de enlace interna de Docker, mapeo de puertos y limpieza de herramientas MCP rotas (solución).

  • Solicitud de función / PR: añadir parámetro de plantilla {username} a los prompts de sistema de la persona de IA en #Feature #ai: 42aross propuso añadir {username} como parámetro de plantilla en la lista de permitidos para que una persona de IA pueda identificar fiablemente al usuario actual en el servidor (en lugar de que el LLM lo infiera del texto/metadatos del tema) (solicitud + razón). También señaló haber completado el proceso de CLA (seguimiento).

  • Composidor acoplado para conversaciones con bots de IA: desactivado en Meta, luego vuelto a habilitar en #Announcements ai #ai-bot: putty preguntó por qué Meta ya no mostraba la interfaz de usuario del composidor acoplado (pregunta). keegan respondió que se había desactivado accidentalmente y lo volvió a activar, señalando que el cambio se movía a beta (actualización de estado). nicolsdennis hizo seguimiento con una pregunta de producto sobre limitar la longitud de respuesta para conversaciones de bots (pregunta).

  • Sugerencias de IA en línea en el composidor: consistencia + preguntas de latencia/comportamiento en #Announcements ai #ai-helper: chapoi discutió hacer el comportamiento consistente a través de puntos de entrada de UI similares y pidió comentarios (publicación). nicolsdennis preguntó sobre la latencia de ida y vuelta y si las sugerencias se basan únicamente en el título del tema (pregunta).

  • Corrección de UX: posicionamiento del icono de sugerencia de título de IA en ux #ai: chapoi publicó una corrección de implementación para el icono de sugerencia de título que aparecía sobre el campo de título, pidiendo confirmación de efectos secundarios (corrección + enlace a PR).

  • Cambios en las claves de API de Gemini: cuentas de servicio, preocupaciones de migración en #Integrations how-to #ai: m_terenui señaló los cambios de seguridad reportados por Google en torno a las claves de API de Gemini, que potencialmente requieren cuentas de servicio y migración de claves antiguas, y preguntó qué espera Discourse que configuren los administradores de ahora en adelante (pregunta). (Referencia del hilo: Configurar claves de API de Gemini para Discourse AI)

  • Autoalojamiento de traducción de Discourse AI con Ollama: elección de proveedor, tokenizador/ventana de contexto, y por qué los “puntos finales de traducción” no son una solución plug-and-play en #Self-Hosting #ai: mononym preguntó cómo probar la traducción de Discourse AI vía Ollama y dónde residen los ajustes de la nueva interfaz de usuario de administrador (pregunta). Falco sugirió usar la API compatible con OpenAI de Ollama seleccionando OpenAI como proveedor (orientación), y luego proporcionó consejos de configuración prácticos (elección de tokenizador, ventana de contexto) y advirtió contra modelos inadecuados/antiguos (detalles). El hilo también cubrió por qué la traducción de Discourse AI no está diseñada como un simple reemplazo de un punto final de LibreTranslate y por qué el antiguo plugin Translator aún se puede usar “tal cual” (restricciones).


Actividad


Gracias por leer, ¡y nos vemos la próxima semana! :slight_smile: