Übersicht
Die KI-Diskussionen dieser Woche auf #meta.discourse.org drehten sich vor allem um die Kontrolle und das Verständnis von KI-Kosten sowie Hintergrundaktivitäten, die Verschärfung der Sicherheitsanforderungen bei Zusammenfassungseingaben und die Verbesserung der Benutzeroberfläche (UX) und Integrationen im gesamten Discourse-KI-Funktionsumfang.
Auf der Kosten-/Betriebsseite hat Discourse geschätzte dollarbasierte Kontingente für die Nutzung von Discourse AI eingeführt (zusätzlich zu Token-Limits), was die Budgetplanung über verschiedene Anbieter hinweg erleichtert (siehe Kontingente basierend auf Kosten für Discourse AI und den begleitenden Leitfaden Konfiguration von LLM-Nutzungskontingenten in Discourse AI). Administratoren tauschten sich zudem über periodische KI-API-Aufrufe aus, die auch dann auftreten können, wenn KI-Oberflächenfunktionen nicht aktiv genutzt werden, aufgrund von Hintergrundjobs wie Embeddings und dem Nachfüllen von Zusammenfassungen (siehe Ruft Discourse KI-APIs im Hintergrund auf? und Falcos Bestätigung).
Auf der Sicherheitsebene gab es erneut Aufmerksamkeit für das, was genau in Zusammenfassungsaufforderungen (Prompts) eingespeist wird – insbesondere, ob die Einbeziehung von HTML-Kommentaren einen „versteckten Kanal“ für Manipulationen bilden könnte (siehe HTML-Kommentare werden ebenfalls von der KI zusammengefasst, Falcos Antwort und weitere Bedenken).
Zugleich konzentrierten sich mehrere Threads darauf, „es in der realen Welt zum Laufen zu bringen“: Fehlerbehebung bei 500-Fehlern bei KI-Titelvorschlägen und die Suche nach Audit-Logs (siehe Support-Thread für Qwen3.7-plus und Hinweise zu ai_api_audit_logs), die Konfiguration von internen KI-Endpunkten / LiteLLM-Sidecars (siehe Wie verwendet man interne KI-Endpunkte? und die Lösungsbeschreibung hier), sowie die selbstgehostete Übersetzung über Ollamas OpenAI-kompatible API (siehe Selbsthosting eines Open-Source-LLM für DiscourseAI, Hinweise zu Modell/Tokenizer und die Diskussion zu Übersetzungseinschränkungen hier).
Auch UX und Produktpolitur kamen nicht zu kurz: Es wurde ein Fix für die Positionierung des Icons für KI-Titelvorschläge vorgeschlagen (siehe Icon für KI-Titelvorschlag wird oberhalb des Titelfelds platziert), „Inline“-KI-Vorschläge brachten Fragen zur Latenz und zum Verhalten auf (siehe Inline-Integration von KI-Vorschlägen (im Composer) und Frage zur Latenz), und der andockende Composer für KI-Bot-Gespräche wurde nach versehentlichem Deaktivieren wieder aktiviert (siehe Frage und Lösung).
Interessante Themen
-
Kostengestützte Kontingente für Discourse AI (geschätzte Dollarbeträge, nicht nur Tokens) in #Announcements #ai: sam kündigte eine neue Methode an, die KI-Nutzung pro Gruppe nach geschätzten Dollar-Kosten zu begrenzen, um die Budgetplanung über verschiedene Anbieter hinweg zu erleichtern (Kündigung). Die Funktion ist in den bestehenden Workflow zur Kontingentkonfiguration integriert (Konfiguration von LLM-Nutzungskontingenten in Discourse AI).
-
KI-Zusammenfassungen beinhalten HTML-Kommentare (und potenzielle Prompt-Injection-Bedenken) in #Feature ai #ai-summarize: Ed_S wies auf das Risiko hin, dass HTML-Kommentare als „versteckter Kanal“ zur Beeinflussung von Zusammenfassungen dienen könnten (Bedenken). Falco erkannte die Möglichkeit an – insbesondere bei kleineren/älteren Modellen – und verwies auf die Trennung von System- und User-Prompts als ein Konzept zur Minderung (Antwort), wogegen Ed_S einwandte, dass dies kein wirksamer Schutz gegen Jailbreaks sei (Nachtrag).
-
Qwen3.7-plus-Einrichtung: Titelgenerierungstool stößt auf 500er-Fehler + Debugging mit Audit-Logs in Support #ai: bird meldete einen 500er-Fehler bei der KI-Titelgenerierung, obwohl andere KI-Tools funktionierten (Bericht). Falco empfahl,
ai_api_audit_logsfür detailliertere Diagnosen abzufragen (Tipp), und erläuterte anschließend, wie man den neuesten Eintrag prüft und dass der 500er-Fehler von Discourse (nicht von Qwen) stammt (Nachtrag). Der Thread verwies zudem auf die Dokumentation zur Bildgenerierung, als gefragt wurde, ob Discourse AI diese unterstützt (Antwort + Link, sowie Verbesserter Support für Bildgenerierung in Discourse AI). -
Discourse AI mit internen Endpunkten betreiben (LiteLLM-Sidecar, interne Host-Whitelists, MCP-Bereinigung) in Support #ai: evantobin beschrieb, wie er die interne Konnektivität für einen lokalen LiteLLM-Sidecar mit
DISCOURSE_ALLOWED_INTERNAL_HOSTSzum Laufen brachte, und erwähnte weitere Arbeiten zur Vertex AI-Authentifizierung (Details). satonotdead teilte eine vollständige Lösung unter Verwendung der internen Gateway-IP von Docker, Port-Mapping und der Bereinigung defekter MCP-Tools (Lösung). -
Feature-Anfrage / PR:
{username}-Template-Parameter zu KI-Persona-Systemprompts hinzufügen in #Feature #ai: 42aross schlug vor,{username}als erlaubten Template-Parameter hinzuzufügen, damit eine KI-Persona den aktuellen Benutzer serverseitig zuverlässig identifizieren kann (statt dass das LLM es aus Thema-Text/Metadaten ableiten muss) (Anfrage + Begründung). Er erwähnte auch den Abschluss des CLA-Prozesses (Nachtrag). -
Andockender Composer für KI-Bot-Gespräche: Auf Meta deaktiviert, dann wieder aktiviert in #Announcements ai #ai-bot: putty fragte, warum Meta die UI des andockenden Composers nicht mehr anzeigte (Frage). keegan antwortete, dass er versehentlich deaktiviert worden war, und schaltete ihn wieder ein, wobei er erwähnte, dass die Änderung in den
beta-Status wechselt (Statusupdate). nicolsdennis folgte mit einer Produktfrage zur Begrenzung der Antwortlänge bei Bot-Gesprächen (Frage). -
Inline-KI-Vorschläge im Composer: Konsistenz + Latenz- und Verhaltensfragen in #Announcements ai #ai-helper: chapoi diskutierte die Angleichung des Verhaltens über ähnliche UI-Einstiegsstellen hinweg und bat um Feedback (Beitrag). nicolsdennis fragte nach der Round-Trip-Latenz und ob Vorschläge rein auf dem Thema-Titel basieren (Frage).
-
UX-Fix: Positionierung des Icons für KI-Titelvorschläge in ux #ai: chapoi postete einen Implementierungsfix für das Problem, dass das Icon für Titelvorschläge oberhalb des Titelfelds erschien, und bat um Bestätigung bezüglich Nebenwirkungen (Fix + PR-Link).
-
Änderungen bei Gemini-API-Schlüsseln: Service Accounts, Migrationsbedenken in #Integrations how-to #ai: m_terenui wies auf Google’s gemeldete Sicherheitsänderungen bei Gemini-API-Schlüsseln hin, die möglicherweise Service Accounts erfordern und alte Schlüssel migrieren, und fragte, was Discourse Administratoren zukünftig konfigurieren erwartet (Frage). (Thread-Referenz: Einrichten von Gemini-API-Schlüsseln für Discourse AI)
-
Selbsthosting der Discourse AI-Übersetzung mit Ollama: Anbieterwahl, Tokenizer/Kontextfenster und warum „Übersetzungs-Endpunkte“ kein Drop-In sind in #Self-Hosting #ai: mononym fragte, wie man Discourse AI-Übersetzung über Ollama ausprobieren kann und wo die neueren Admin-UI-Einstellungen zu finden sind (Frage). Falco schlug vor, Ollamas OpenAI-kompatible API zu verwenden, indem man OpenAI als Anbieter auswählt (Hinweise), und lieferte anschließend praktische Konfigurationsratschläge (Tokenizer-Wahl, Kontextfenster) sowie Warnungen vor ungeeigneten/alten Modellen (Details). Der Thread behandelte auch, warum Discourse AI-Übersetzung nicht als einfacher Ersatz für LibreTranslate-Endpunkte konzipiert ist und warum das ältere Translator-Plugin weiterhin „so wie es ist“ genutzt werden kann (Einschränkungen).
Aktivitäten
-
sam führte Kontingente für geschätzte Dollar-Kosten für Discourse AI-Gruppen in #Announcements ein und verwies Administratoren auf die umfassendere Dokumentation zu Kontingenten (Kostengestützte Kontingente für Discourse AI; Konfiguration von LLM-Nutzungskontingenten in Discourse AI).
-
Falco war in Threads zu Fehlerbehebung, Sicherheit und Selbsthosting aktiv:
- Diskutierte Risiken/Minderungen im Zusammenhang mit Zusammenfassungseingaben, wenn HTML-Kommentare enthalten sind (Antwort; siehe auch die Bedenken zur Prompt-Injection hier und den Nachtrag hier).
- half bei der Fehlerbehebung eines Qwen-bezogenen 500er-Fehlers bei Titelvorschlägen, indem er auf
ai_api_audit_logsverwies und beriet, wie man neue Einträge nach Reproduzierung des Fehlers prüft (Audit-Log-Tipp; Neuesten Eintrag prüfen + 500er auf Discourse-Seite; Hinweis zur Bildgenerierung hier; verwandt: Verbesserter Support für Bildgenerierung in Discourse AI). - Bestätigte, dass periodische KI-Aufrufe im Hintergrund für aktivierte Funktionen wie das Nachfüllen von Zusammenfassungen und Embeddings zu erwarten sind (Ruft Discourse KI-APIs im Hintergrund auf?; ursprüngliche Admin-Frage hier).
- Beriet Selbsthoster, die Ollama über OpenAI-Kompatibilität nutzen, und lieferte Konfigurations-/Modellratschläge für Übersetzungen (OpenAI-Anbieter mit Ollama verwenden; Tokenizer/Kontextfenster + Modell-Hinweise; Übersetzungsdesign-Einschränkungen vs. LibreTranslate hier).
-
chapoi setzte sich für UX und Konsistenz ein:
- Diskutierte die Angleichung des KI-Vorschlagsverhaltens über verschiedene Oberflächen hinweg und bat um Feedback (Inline-Integration von KI-Vorschlägen (im Composer); verwandte Frage zur Latenz/Titel-Bereich hier).
- Schlug einen Fix für die Positionierung des Icons für KI-Titelvorschläge vor, verlinkte einen Implementierungs-PR und bat um Tests auf Nebenwirkungen (Icon für KI-Titelvorschlag wird oberhalb des Titelfelds platziert).
-
Ed_S brachte eine sicherheitsbezogene Sorge vor, dass die Zusammenfassung von HTML-Kommentaren als versteckter Manipulationskanal genutzt werden könnte (HTML-Kommentare werden ebenfalls von der KI zusammengefasst) und betonte, dass die Trennung von System-/User-Prompts keine harte Garantie gegen Jailbreak-Einflüsse bietet (Nachtrag).
-
42aross schlug eine kleine additive Änderung vor, um das Prompt-Templating für KI-Personas zu verbessern, indem
{username}als unterstützte Variable hinzugefügt wird ({username} als Template-Parameter in KI-Persona-Systemprompts hinzufügen; CLA-Nachtrag hier). -
keegan reaktivierte den andockenden Composer für KI-Bot-Gespräche, nachdem er versehentlich ausgeschaltet worden war, und erwähnte die Promotion der Funktion in Richtung
beta(Einführung eines andockenden Composers für KI-Bot-Gespräche; ursprüngliche Frage hier). -
evantobin teilte Details zur internen Netzwerkeinrichtung für die Verbindung von Discourse AI mit einem LiteLLM-Sidecar unter Verwendung von
DISCOURSE_ALLOWED_INTERNAL_HOSTS(Wie verwendet man interne KI-Endpunkte?; siehe auch die spätere vollständige Lösung hier). -
m_terenui brachte zwei Admin-/Operator-Bedenken vor:
- Ob sich Google’s Ansatz bei Gemini-API-Schlüsseln geändert hat, um Service Accounts zu erfordern, und was Discourse von Administratoren erwartet, in die Einstellungen einzufügen (Einrichten von Gemini-API-Schlüsseln für Discourse AI; Thread-Wurzel des Tutorials hier).
- Er bemerkte periodische Gemini-Aufrufe und fragte, ob Discourse KI-APIs im Hintergrund aufruft; Falco bestätigte, dass Hintergrundjobs dies je nach aktivierten Funktionen tun können (Ruft Discourse KI-APIs im Hintergrund auf?; Antwort).
-
putty wies darauf hin, dass die UI des andockenden KI-Bot-Composers auf Meta deaktiviert zu sein schien, und fragte nach der Begründung (Einführung eines andockenden Composers für KI-Bot-Gespräche; Lösung hier).
-
nicolsdennis stellte Produkt-/Betriebsfragen in zwei Ankündigungs-Threads:
- Zur Latenz und ob Inline-Vorschläge nur auf dem Thema-Titel basieren (Inline-Integration von KI-Vorschlägen (im Composer); verwandte Diskussion zur Konsistenz hier).
- Zur Beschränkung der KI-Bot-Antwortlänge in der Erfahrung des andockenden Composers (Einführung eines andockenden Composers für KI-Bot-Gespräche; Statusupdate zur Funktion hier).
-
bird dokumentierte ein Discourse AI-Integrationsproblem mit Qwen3.7-plus, bei dem der Titelvorschlag einen 500er-Fehler zurückgab (Bericht), fragte, wie man tiefere Logs einsehen kann (Frage), und fragte später nach dem Support für Bildgenerierung (Frage; Antwort und Hinweis hier).
-
satonotdead postete eine detaillierte „Es funktioniert“-Lösung für interne KI-Endpunkte, die Docker-Gateway-Weiterleitung, Port-Exposition und das Entfernen defekter MCP-Server-/Tool-Einträge abdeckte (Wie verwendet man interne KI-Endpunkte?; früherer Einrichtungskontext hier).
-
mononym belebte den Selbsthosting-Thread mit Fragen zur aktuellen Admin-UI, der Verwendung von Ollama für Übersetzungen und ob ein LibreTranslate-ähnlicher Endpunkt wiederverwendet werden könnte (Selbsthosting eines Open-Source-LLM für DiscourseAI; Fragen zu Anbieter/Konfiguration hier; Frage zur LibreTranslate-Kompatibilität hier). Falco antwortete mit Konfigurationshinweisen und Einschränkungen (OpenAI-kompatible Einrichtung; Ratschläge zu Tokenizer/Kontext; Warum kein LibreTranslate in KI-Übersetzung).
Danke fürs Lesen, und wir sehen uns nächste Woche wieder! ![]()