Résumé hebdomadaire des sujets liés à l'IA

Vue d’ensemble

Les conversations autour de ai sur #meta.discourse.org cette semaine ont porté sur la maîtrise et la compréhension des coûts de l’IA + de l’utilisation en arrière-plan, le resserrement des exigences de sécurité concernant les entrées de résumé, et l’amélioration de l’UX et des intégrations dans l’ensemble des fonctionnalités Discourse AI.

Côté coûts/ops, Discourse a mis en place des quotas basés sur le coût estimé en dollars pour l’utilisation de Discourse AI (en plus des limites de jetons), facilitant ainsi la budgétisation entre les différents fournisseurs (voir Quotas basés sur le coût pour Discourse AI et le guide d’accompagnement Configuration des quotas d’utilisation des LLM dans Discourse AI). Les administrateurs ont également échangé sur les appels périodiques à l’API IA qui peuvent survenir même lorsque vous n’utilisez pas activement les fonctionnalités UI de l’IA, en raison de tâches en arrière-plan comme les embeddings et les remplissages de résumés (voir Discourse appelle-t-il les API IA en arrière-plan et la confirmation de Falco).

Côté sécurité, une attention renouvelée a été portée sur ce qui est exactement injecté dans les invites de résumé—en particulier si l’inclusion de commentaires HTML pouvait former un « canal caché » de manipulation (voir Les commentaires HTML sont également résumés par l’IA, la réponse de Falco, et les préoccupations de suivi).

Pendant ce temps, plusieurs fils de discussion se sont concentrés sur « le rendre fonctionnel dans le monde réel » : dépannage des erreurs 500 dans les suggestions de titres IA et apprentissage de l’emplacement des journaux d’audit (voir Fil de support Qwen3.7-plus et conseils sur ai_api_audit_logs), configuration des points de terminaison IA internes / sidecars LiteLLM (voir Comment utiliser des points de terminaison IA internes ? et le compte rendu de la solution ici), et l’auto-hébergement de la traduction via l’API compatible OpenAI d’Ollama (voir Auto-hébergement d’un LLM OpenSource pour DiscourseAI, conseils sur le modèle/tokenizer, et discussion sur les contraintes de traduction ici).

L’UX et le polissage produit ont également retenu l’attention : une correction a été proposée pour le positionnement de l’icône de suggestion de titre IA (voir L’icône de suggestion de titre IA est placée au-dessus du champ de saisie du titre), les suggestions IA « inline » ont soulevé des questions de latence/comportement (voir Intégration inline des suggestions IA (dans le Composer) et question sur la latence), et le composer ancré pour les conversations avec les bots IA a été réactivé après avoir été désactivé par erreur (voir question et résolution).


Sujets intéressants

  • Quotas basés sur le coût pour Discourse AI (dollars estimés, pas seulement des jetons) dans #Announcements ai : sam a annoncé une nouvelle façon de limiter l’utilisation de l’IA par coût estimé en dollars par groupe, pour aider à la budgétisation entre les fournisseurs (annonce). La fonctionnalité s’intègre au flux de configuration des quotas existant (Configuration des quotas d’utilisation des LLM dans Discourse AI).

  • Le résumé IA inclut les commentaires HTML (et les préoccupations potentielles d’injection d’invite) dans #Feature ai ai-summarize : Ed_S a souligné le risque que les commentaires HTML deviennent un « canal caché » pour influencer les résumés (préoccupation). Falco a reconnu la possibilité—en particulier avec les modèles plus petits/anciens—et a pointé vers la séparation des invites système/utilisateur comme concept atténuant (réponse), ce que Ed_S a contesté en soulignant que ce n’est pas un véritable mécanisme contre les jailbreaks (suivi).

  • Configuration de Qwen3.7-plus : l’outil de suggestion de titre rencontre des erreurs 500 + comment déboguer avec les journaux d’audit dans Support ai : bird a signalé une erreur 500 lors de l’utilisation de la génération de titres IA alors que d’autres outils IA fonctionnaient (rapport). Falco a recommandé d’interroger ai_api_audit_logs pour des diagnostics plus détaillés (conseil), puis a clarifié comment inspecter la dernière entrée et que l’erreur 500 venait de Discourse (et non de Qwen) (suivi). Le fil a également pointé vers la documentation sur la génération d’images lorsqu’on a demandé si Discourse AI la supportait (réponse + lien, plus Support amélioré de la génération d’images dans Discourse AI).

  • Exécution de Discourse AI avec des points de terminaison internes (sidecar LiteLLM, listes blanches d’hôtes internes, nettoyage MCP) dans Support ai : evantobin a décrit comment faire fonctionner la connectivité interne en utilisant DISCOURSE_ALLOWED_INTERNAL_HOSTS pour un sidecar LiteLLM en localhost, et a mentionné des travaux de suivi pour l’authentification Vertex AI (détails). satonotdead a partagé une solution complète utilisant l’IP de passerelle interne de Docker, le mappage de ports, et le nettoyage des outils MCP défectueux (solution).

  • Demande de fonctionnalité / PR : ajouter le paramètre de modèle {username} aux invites système de la persona IA dans #Feature ai : 42aross a proposé d’ajouter {username} comme paramètre de modèle autorisé afin qu’une persona IA puisse identifier fiablement l’utilisateur actuel côté serveur (au lieu de laisser le LLM l’inférer à partir du texte/métadonnées du sujet) (demande + justification). Ils ont également noté la finalisation du processus CLA (suivi).

  • Composer ancré pour les conversations avec les bots IA : désactivé sur Meta, puis réactivé dans #Announcements ai ai-bot : putty a demandé pourquoi Meta n’affichait plus l’interface du composer ancré (question). keegan a répondu qu’il avait été désactivé par erreur et l’a réactivé, notant que le changement passait en beta (mise à jour de statut). nicolsdennis a suivi avec une question produit sur la limitation de la longueur des réponses pour les conversations de bot (question).

  • Suggestions IA inline dans le composer : cohérence + questions de latence/comportement dans #Announcements ai ai-helper : chapoi a discuté de la cohérence du comportement entre les points d’entrée UI similaires et a demandé des retours (post). nicolsdennis a interrogé sur la latence aller-retour et si les suggestions étaient basées uniquement sur le titre du sujet (question).

  • Correction UX : positionnement de l’icône de suggestion de titre IA dans ux ai : chapoi a posté une correction d’implémentation pour l’icône de suggestion de titre apparaissant au-dessus du champ de titre, demandant confirmation des effets secondaires (correction + lien PR).

  • Changements de clé API Gemini : comptes de service, préoccupations de migration dans #Integrations how-to ai : m_terenui a noté les changements de sécurité signalés par Google autour des clés API Gemini, nécessitant potentiellement des comptes de service et la migration des anciennes clés, et a demandé ce que Discourse attend des administrateurs pour la configuration future (question). (Référence du fil : Configurer les clés API Gemini pour Discourse AI)

  • Auto-hébergement de la traduction Discourse AI avec Ollama : choix du fournisseur, tokenizer/fenêtre de contexte, et pourquoi les « points de terminaison de traduction » ne sont pas plug-and-play dans #Self-Hosting ai : mononym a demandé comment essayer la traduction Discourse AI via Ollama et où se trouvaient les paramètres de l’interface admin plus récente (question). Falco a suggéré d’utiliser l’API compatible OpenAI d’Ollama en sélectionnant OpenAI comme fournisseur (conseils), puis a fourni des conseils de configuration pratiques (choix du tokenizer, fenêtre de contexte) et mis en garde contre les modèles inadaptés/anciens (détails). Le fil couvrait également pourquoi la traduction Discourse AI n’est pas conçue comme un simple remplacement de point de terminaison LibreTranslate et pourquoi l’ancien plugin Translator peut encore être utilisé « tel quel » (contraintes).


Activité


Merci d’avoir lu, et je vous retrouverai la semaine prochaine ! :slight_smile: