Vue d’ensemble
Les conversations autour de ai sur #meta.discourse.org cette semaine ont porté sur la maîtrise et la compréhension des coûts de l’IA + de l’utilisation en arrière-plan, le resserrement des exigences de sécurité concernant les entrées de résumé, et l’amélioration de l’UX et des intégrations dans l’ensemble des fonctionnalités Discourse AI.
Côté coûts/ops, Discourse a mis en place des quotas basés sur le coût estimé en dollars pour l’utilisation de Discourse AI (en plus des limites de jetons), facilitant ainsi la budgétisation entre les différents fournisseurs (voir Quotas basés sur le coût pour Discourse AI et le guide d’accompagnement Configuration des quotas d’utilisation des LLM dans Discourse AI). Les administrateurs ont également échangé sur les appels périodiques à l’API IA qui peuvent survenir même lorsque vous n’utilisez pas activement les fonctionnalités UI de l’IA, en raison de tâches en arrière-plan comme les embeddings et les remplissages de résumés (voir Discourse appelle-t-il les API IA en arrière-plan et la confirmation de Falco).
Côté sécurité, une attention renouvelée a été portée sur ce qui est exactement injecté dans les invites de résumé—en particulier si l’inclusion de commentaires HTML pouvait former un « canal caché » de manipulation (voir Les commentaires HTML sont également résumés par l’IA, la réponse de Falco, et les préoccupations de suivi).
Pendant ce temps, plusieurs fils de discussion se sont concentrés sur « le rendre fonctionnel dans le monde réel » : dépannage des erreurs 500 dans les suggestions de titres IA et apprentissage de l’emplacement des journaux d’audit (voir Fil de support Qwen3.7-plus et conseils sur ai_api_audit_logs), configuration des points de terminaison IA internes / sidecars LiteLLM (voir Comment utiliser des points de terminaison IA internes ? et le compte rendu de la solution ici), et l’auto-hébergement de la traduction via l’API compatible OpenAI d’Ollama (voir Auto-hébergement d’un LLM OpenSource pour DiscourseAI, conseils sur le modèle/tokenizer, et discussion sur les contraintes de traduction ici).
L’UX et le polissage produit ont également retenu l’attention : une correction a été proposée pour le positionnement de l’icône de suggestion de titre IA (voir L’icône de suggestion de titre IA est placée au-dessus du champ de saisie du titre), les suggestions IA « inline » ont soulevé des questions de latence/comportement (voir Intégration inline des suggestions IA (dans le Composer) et question sur la latence), et le composer ancré pour les conversations avec les bots IA a été réactivé après avoir été désactivé par erreur (voir question et résolution).
Sujets intéressants
-
Quotas basés sur le coût pour Discourse AI (dollars estimés, pas seulement des jetons) dans #Announcements ai : sam a annoncé une nouvelle façon de limiter l’utilisation de l’IA par coût estimé en dollars par groupe, pour aider à la budgétisation entre les fournisseurs (annonce). La fonctionnalité s’intègre au flux de configuration des quotas existant (Configuration des quotas d’utilisation des LLM dans Discourse AI).
-
Le résumé IA inclut les commentaires HTML (et les préoccupations potentielles d’injection d’invite) dans #Feature ai ai-summarize : Ed_S a souligné le risque que les commentaires HTML deviennent un « canal caché » pour influencer les résumés (préoccupation). Falco a reconnu la possibilité—en particulier avec les modèles plus petits/anciens—et a pointé vers la séparation des invites système/utilisateur comme concept atténuant (réponse), ce que Ed_S a contesté en soulignant que ce n’est pas un véritable mécanisme contre les jailbreaks (suivi).
-
Configuration de Qwen3.7-plus : l’outil de suggestion de titre rencontre des erreurs 500 + comment déboguer avec les journaux d’audit dans Support ai : bird a signalé une erreur 500 lors de l’utilisation de la génération de titres IA alors que d’autres outils IA fonctionnaient (rapport). Falco a recommandé d’interroger
ai_api_audit_logspour des diagnostics plus détaillés (conseil), puis a clarifié comment inspecter la dernière entrée et que l’erreur 500 venait de Discourse (et non de Qwen) (suivi). Le fil a également pointé vers la documentation sur la génération d’images lorsqu’on a demandé si Discourse AI la supportait (réponse + lien, plus Support amélioré de la génération d’images dans Discourse AI). -
Exécution de Discourse AI avec des points de terminaison internes (sidecar LiteLLM, listes blanches d’hôtes internes, nettoyage MCP) dans Support ai : evantobin a décrit comment faire fonctionner la connectivité interne en utilisant
DISCOURSE_ALLOWED_INTERNAL_HOSTSpour un sidecar LiteLLM en localhost, et a mentionné des travaux de suivi pour l’authentification Vertex AI (détails). satonotdead a partagé une solution complète utilisant l’IP de passerelle interne de Docker, le mappage de ports, et le nettoyage des outils MCP défectueux (solution). -
Demande de fonctionnalité / PR : ajouter le paramètre de modèle
{username}aux invites système de la persona IA dans #Feature ai : 42aross a proposé d’ajouter{username}comme paramètre de modèle autorisé afin qu’une persona IA puisse identifier fiablement l’utilisateur actuel côté serveur (au lieu de laisser le LLM l’inférer à partir du texte/métadonnées du sujet) (demande + justification). Ils ont également noté la finalisation du processus CLA (suivi). -
Composer ancré pour les conversations avec les bots IA : désactivé sur Meta, puis réactivé dans #Announcements ai ai-bot : putty a demandé pourquoi Meta n’affichait plus l’interface du composer ancré (question). keegan a répondu qu’il avait été désactivé par erreur et l’a réactivé, notant que le changement passait en
beta(mise à jour de statut). nicolsdennis a suivi avec une question produit sur la limitation de la longueur des réponses pour les conversations de bot (question). -
Suggestions IA inline dans le composer : cohérence + questions de latence/comportement dans #Announcements ai ai-helper : chapoi a discuté de la cohérence du comportement entre les points d’entrée UI similaires et a demandé des retours (post). nicolsdennis a interrogé sur la latence aller-retour et si les suggestions étaient basées uniquement sur le titre du sujet (question).
-
Correction UX : positionnement de l’icône de suggestion de titre IA dans ux ai : chapoi a posté une correction d’implémentation pour l’icône de suggestion de titre apparaissant au-dessus du champ de titre, demandant confirmation des effets secondaires (correction + lien PR).
-
Changements de clé API Gemini : comptes de service, préoccupations de migration dans #Integrations how-to ai : m_terenui a noté les changements de sécurité signalés par Google autour des clés API Gemini, nécessitant potentiellement des comptes de service et la migration des anciennes clés, et a demandé ce que Discourse attend des administrateurs pour la configuration future (question). (Référence du fil : Configurer les clés API Gemini pour Discourse AI)
-
Auto-hébergement de la traduction Discourse AI avec Ollama : choix du fournisseur, tokenizer/fenêtre de contexte, et pourquoi les « points de terminaison de traduction » ne sont pas plug-and-play dans #Self-Hosting ai : mononym a demandé comment essayer la traduction Discourse AI via Ollama et où se trouvaient les paramètres de l’interface admin plus récente (question). Falco a suggéré d’utiliser l’API compatible OpenAI d’Ollama en sélectionnant OpenAI comme fournisseur (conseils), puis a fourni des conseils de configuration pratiques (choix du tokenizer, fenêtre de contexte) et mis en garde contre les modèles inadaptés/anciens (détails). Le fil couvrait également pourquoi la traduction Discourse AI n’est pas conçue comme un simple remplacement de point de terminaison LibreTranslate et pourquoi l’ancien plugin Translator peut encore être utilisé « tel quel » (contraintes).
Activité
-
sam a introduit les quotas de coût estimé en dollars pour les groupes Discourse AI dans #Announcements, dirigeant les administrateurs vers la documentation plus large sur les quotas (Quotas basés sur le coût pour Discourse AI; Configuration des quotas d’utilisation des LLM dans Discourse AI).
-
Falco a été actif dans les fils de dépannage, de sécurité et d’auto-hébergement :
- A discuté des risques/atténuations autour des entrées de résumé lorsque les commentaires HTML sont inclus (réponse; voir aussi la préoccupation d’injection d’invite ici et le suivi ici).
- A aidé à déboguer une erreur 500 de suggestion de titre liée à Qwen en pointant vers
ai_api_audit_logset en conseillant comment inspecter les nouvelles lignes après reproduction de l’erreur (conseil journal d’audit; inspecter la dernière ligne + erreur 500 côté Discourse; pointeur génération d’image ici; lié : Support amélioré de la génération d’images dans Discourse AI). - A confirmé que des appels IA périodiques en arrière-plan peuvent être attendus pour les fonctionnalités activées comme les remplissages de résumés et les embeddings (Discourse appelle-t-il les API IA en arrière-plan; question admin originale ici).
- A guidé les auto-hébergeurs utilisant Ollama via la compatibilité OpenAI et fourni des conseils de configuration/modèle pour la traduction (utiliser le fournisseur OpenAI avec Ollama; tokenizer/fenêtre de contexte + mises en garde sur les modèles; contraintes de conception de traduction vs LibreTranslate ici).
-
chapoi a poussé sur l’UX et la cohérence :
- A discuté de l’alignement du comportement des suggestions IA entre les différentes surfaces et demandé des retours (Intégration inline des suggestions IA (dans le Composer); question liée latence/portée du titre ici).
- A proposé une correction pour le positionnement de l’icône de suggestion de titre IA, liant une PR d’implémentation et demandant des tests d’effets secondaires (L’icône de suggestion de titre IA est placée au-dessus du champ de saisie du titre).
-
Ed_S a soulevé une préoccupation axée sur la sécurité que résumer les commentaires HTML pourrait être utilisé comme un canal de manipulation caché (Les commentaires HTML sont également résumés par l’IA) et a insisté sur le fait que la séparation des invites système/utilisateur n’est pas une garantie absolue contre l’influence des jailbreaks (suivi).
-
42aross a proposé un petit changement additif pour améliorer le templating des invites de persona IA en ajoutant
{username}comme variable supportée (Ajouter {username} comme paramètre de modèle dans les invites système de persona IA; suivi CLA ici). -
keegan a réactivé le composer ancré pour les conversations avec les bots IA après qu’il ait été désactivé par erreur, et a noté la promotion de la fonctionnalité vers
beta(Introduction d’un composer ancré pour les conversations avec les bots IA; question originale ici). -
evantobin a partagé des détails de configuration réseau interne pour connecter Discourse AI à un sidecar LiteLLM en utilisant
DISCOURSE_ALLOWED_INTERNAL_HOSTS(Comment utiliser des points de terminaison IA internes ?; voir aussi la solution complète ultérieure ici). -
m_terenui a soulevé deux préoccupations admin/ops :
- Si l’approche de clé API Gemini de Google a changé pour exiger des comptes de service et ce que Discourse attend que les administrateurs collent dans les paramètres (Configurer les clés API Gemini pour Discourse AI; racine du fil tutoriel ici).
- A remarqué des appels périodiques à Gemini et a demandé si Discourse invoque les API IA en arrière-plan ; Falco a confirmé que les tâches en arrière-plan peuvent le faire selon les fonctionnalités activées (Discourse appelle-t-il les API IA en arrière-plan; réponse).
-
putty a signalé que l’interface du composer bot IA ancré semblait désactivée sur Meta et a demandé la justification (Introduction d’un composer ancré pour les conversations avec les bots IA; résolution ici).
-
nicolsdennis a posé des questions produit/ops dans deux fils d’annonce :
- Sur la latence et si les suggestions inline sont basées uniquement sur le titre du sujet (Intégration inline des suggestions IA (dans le Composer); discussion de cohérence liée ici).
- Sur la contrainte de la longueur de réponse des bots IA dans l’expérience du composer ancré (Introduction d’un composer ancré pour les conversations avec les bots IA; mise à jour de statut de la fonctionnalité ici).
-
bird a documenté un problème d’intégration Discourse AI utilisant Qwen3.7-plus où la suggestion de titre retournait une erreur 500 (rapport), a demandé comment voir des journaux plus profonds (question), et a ensuite interrogé sur le support de la génération d’images (question; réponse et pointeur ici).
-
satonotdead a posté une solution détaillée « ça marche » pour les points de terminaison IA internes, couvrant le routage de la passerelle Docker, l’exposition des ports, et la suppression des entrées de serveur/outils MCP défectueux (Comment utiliser des points de terminaison IA internes ?; contexte de configuration antérieur ici).
-
mononym a ravivé le fil d’auto-hébergement avec des questions sur l’interface admin actuelle, l’utilisation d’Ollama pour la traduction, et si un point de terminaison de style LibreTranslate pourrait être réutilisé (Auto-hébergement d’un LLM OpenSource pour DiscourseAI; questions fournisseur/config ici; question compatibilité LibreTranslate ici). Falco a répondu avec des conseils de configuration et des contraintes (configuration compat OpenAI; conseils tokenizer/contexte; pourquoi pas LibreTranslate dans la traduction IA).
Merci d’avoir lu, et je vous retrouverai la semaine prochaine ! ![]()