Unser Bot hat ZeitĂŒberschreitungen gehabt, bis wir die BegrĂŒndung auf minimal gesetzt haben. Danke!
Ehrlich gesagt finde ich GPT-5 generell zu langsam und es ist nicht offensichtlich, dass sich die zusÀtzliche Vorlaufzeit bei den Antworten lohnt.
Wie haben Sie es fĂŒr Ihren Support-Bot empfunden?
Ich habe gpt-5 ĂŒber Chat GPT ausprobiert, was eine ganz andere Sache ist als ĂŒber die API, und es benötigt diese lange Denkzeit, um geringfĂŒgig bessere Antworten zu geben, als 4o oder o1 geben wĂŒrden. Wenn es schnell antworten muss, ist es nicht besser als 4.1.
Ich bin ziemlich sicher, dass die Situation bei der Verwendung der API Àhnlich oder schlechter ist, da es an Werkzeugen und Anweisungen mangelt. Aber ich weià es nicht sicher, weil gpt-5 schmerzhaft langsam ist und in einer Forumsumgebung muss es fast Lichtgeschwindigkeit antworten.
In Bezug auf die Inhaltsleistung scheint GPT-5 anekdotisch gesehen merklich bessere technische Antworten als GPT-4o zu liefern. Ich bin mir nicht sicher, wie ich das quantifizieren kann, aber es hat mich wirklich beeindruckt.
Ich erhalte unterschiedliche Ergebnisse, was die Antwortzeit betrifft. Aus Experimenten heute Morgen scheint sich zu ergeben, dass GPT-5 im Durchschnitt langsamer ist, aber nicht allzu sehr, und es gab einige FĂ€lle, in denen die Antwort mit GPT-5 schneller kam. Ich messe zwischen 5 Sekunden und 35 Sekunden fĂŒr eine Antwort.
Wir verwenden RAG und ich kann nicht sagen, welcher Teil der Latenz von der RAG-Suche im Vergleich zur Chat-VervollstĂ€ndigung herrĂŒhrt. Es könnte sein, dass es manchmal keine RAG-Suche durchfĂŒhrt, die Suche schneller erfolgt oder etwas zwischengespeichert wird (in der Suche oder der VervollstĂ€ndigung).
Wir wĂŒrden in der Regel bessere Antworten gegenĂŒber einer schnelleren Antwort bevorzugen, da es kostspielig ist, Kunden schlechte technische RatschlĂ€ge zu geben. Bis zu einem gewissen Punkt ist es jedoch eine sehr schlechte Benutzererfahrung, wenn es zu einem Timeout kommt.
GPT-5 empfiehlt fĂŒr unseren Anwendungsfall hauptsĂ€chlich GPT-5-mini und eskaliert unter bestimmten UmstĂ€nden zu GPT-5. Klingt gut, aber kompliziert. Haben Sie erwogen, dynamisch zwischen Modellen zu wechseln? Warum macht OpenAI das nicht einfach automatisch? ChatGPT - Compare GPT models performance
Wir mussten auf gpt-4o zurĂŒckschalten, weil gpt-5-mini anscheinend glaubt, Dinge tun zu können, die es nicht kann. Es bot einem Kunden selbstbewusst an, dessen AlarmĂŒberwachungsservice einzurichten und mit dessen HausalarmausrĂŒstung zu verbinden. Es fragte nach GerĂ€te-IDs und halluzinierte, als wĂ€re es ein Concierge, der alles fĂŒr ihn einrichtet. Unsere Website kann das, aber der Chatbot nicht. Es scheint die SchutzmaĂnahmen in der Systemaufforderung nicht zu befolgen, wie es gpt-4o tat. Wir mĂŒssen sie verschĂ€rfen, bevor wir es fĂŒr die Leute freigeben können.
Update: Es stellt sich heraus, dass gpt-5 Anweisungen besser befolgt und Regeln in der Aufforderung besser beachtet als gpt-5-mini. Wenn Sie zulassen, dass ein Bot Ihre Marke reprĂ€sentiert, empfehle ich gpt-5, auch wenn es langsamer und 5x teurer ist. Es besteht zu viel Risiko, dass gpt-5-mini auĂer Kontrolle gerĂ€t.
Ich hatte wirklich viel GlĂŒck mit GTP-5-mini in agentenbasierten AblĂ€ufen durch Tool-Aufrufe, das Schreiben von Code und strukturierte Daten. Ich finde strukturierte Daten im Allgemeinen einfacher fĂŒr KI-Anwendungen als unstrukturierte! .. nicht das, was ich erwartet hatte! Aber Leitplanken sind einfacher .. (Code-in-the-Loop, Human-in-the-Loop, LLM-as-Judge usw.)
Schauen Sie sich dies an fĂŒr eine detaillierte Vorstellung von hochleistungsfĂ€higem, kostengĂŒnstigem GPT-5-mini und GPT-4o âŠ
Wenn jemand daran interessiert ist, Funktionen fĂŒr strukturierte Daten in Discourse als Plugin usw. zu integrieren, melden Sie sich bitte.
Eine NLP-Erweiterung fĂŒr SQL/Statistik/Data Science fĂŒr Data Explorer ist ein Beispiel. Aber es könnte auch ein Tool/Plugin/eine Funktion geben, die natĂŒrliche Sprachabfragen von schreibgeschĂŒtzten SQL-Lite- oder DuckDB- usw. OLAP-Dateien ermöglicht, die in den Container geladen werden? Nur ein Gedanke.. ![]()
Ăbrigens, ich habe GPT 5.1 zusammen mit einigen Korrekturen zum Plugin hinzugefĂŒgt:
@tom_eric Sie haben nach der Möglichkeit gefragt, Spiele mit anderen Forumsmitgliedern zu spielen in einem anderen Thema.
Ich habe diesen Prompt mit Chatbot ausprobiert und es scheint mit GPT 5.1 zu funktionieren. Probieren Sie es aus:
@Chatbot erleichtere ein 9x9 Go-Spiel mit @Other_Player und mir, indem du eine Markdown-Tabelle zur Darstellung des Spielbretts verwendest â lass mich zuerst ziehen und akzeptiere ZĂŒge nur von mir und @Other_Player und nur, wenn wir an der Reihe sind â stelle das Spielbrett dar und fordere mich auf, zu beginnen âŠ
Oh, danke. Das ist eine wirklich kreative Idee.Oh, danke. Das ist eine wirklich kreative Idee.
np, lass mich wissen, wie es klappt ![]()
Ein leicht angepasstes Dev-Setup ermöglichte es mir, mit einem Chatbot, der Zork spielt, mithilfe dieses Plugins und Discourse Frotz zu experimentieren ![]()
(hier mit GPT 5.1 bei geringerer Schlussfolgerung)
Eine kleine Zeit spÀter:
Sammle eine ziemliche Punktzahl an! Und:
(Entschuldigung, das Setup ist etwas zu komplex, um es hier einfach zu teilen).
Wow! Das wusste ich nicht, dass das möglich ist. Ich schÀtze, mit guten Prompts ist so ziemlich alles möglich ![]()
Chatbot-Modell-Dropdowns haben jetzt gpt 5.2 und 5.2 Pro â und fĂŒr 5.2 gibt es jetzt eine xhigh-Reasoning-Stufe, wenn Sie es lieben, Tokens zu verbrennen und die Umwelt zu zerstören ![]()
Sie werden vielleicht auch bemerken, dass Benutzer des Maths Plugin den Chatbot nun ganz einfach dazu bringen können, ĂŒber Mathematik mit schön gerenderten mathematischen Gleichungen zu sprechen, ohne etwas zum System-Prompt hinzufĂŒgen zu mĂŒssen âŠ
Ich habe die StartschaltflĂ€che an eine viel ordentlichere Stelle unten rechts verschoben (auĂer bei iOS PWA/App) â lassen Sie mich wissen, ob das nicht wie beabsichtigt funktioniert.
Dies sollte immer dazu dienen, das CSS zu vereinfachen und gleichzeitig diese nervigen Steuerleisten auf iOS zu berĂŒcksichtigen, aber ich konnte es nicht lĂ€nger ertragen, es hat meinen Augen wehgetan
![]()
@ThisSource Dies war der erste KI-Chatbot fĂŒr Discourse und lĂ€uft immer noch :).
Ich freue mich, meinen ersten fortlaufenden Business-Sponsor von Chatbot bekannt zu geben: Surety, die nun den neuen Abschnitt âProject Sponsorâ in der README einnehmen.
Surety hat es sich zur Aufgabe gemacht, Heimwerker mit professioneller SicherheitsalarmĂŒberwachung und Hausautomatisierung auf die transparenteste und effizienteste Weise zu versorgen und damit dem Trend in der Heimsicherheitsbranche entgegenzuwirken.
Vielen Dank, Surety!
Wenn Sie Sponsor eines meiner Projekte werden möchten, schauen Sie sich dies an: Sponsor @merefield on GitHub Sponsors · GitHub ![]()
Zusammenfassung der jĂŒngsten PRs â 1.â3. August 2026
Mehrere verwandte PRs wurden in Discourse Chatbot und seinen Erweiterungs-Plugins gemerged.
Highlights
- EinfĂŒhrung fortschrittlicher lokaler Reasoning-Strategien, einschlieĂlich verify-and-revise, best-of-two und unsicherheitsgesteuertes Reasoning.
- HinzufĂŒgung aktueller OpenAI-Modelle und des neuen âmax reasoning effortâ-Parameters.
- HinzufĂŒgung eines semantischen Blockiergates fĂŒr Fragen basierend auf Embedding-Ăhnlichkeit.
- erhebliche Einsparungen, da Embeddings verwendet werden, um Themen zu blockieren, die der Bot nicht bearbeiten soll, ohne dabei LLM-Tokens zu verbrauchen.
- Konsolidierung der Basic- und RAG-Implementierungen in einem einzigen DiscourseChatbot::Bot.
- Ersatz der Bot-Modus-Einstellungen durch Trust-Level-basierte integrierte Tool-Selektoren.
- Umbenennung der Erweiterungs-API von âFunctionâ in âToolâ.
- Ersatz des auf SafeRuby basierenden Calculator-Tools durch den eingeschrĂ€nkten Dentaku-Ausdrucksauswerter â dies ist eine groĂe Verbesserung der Sicherheit, da SafeRuby trotz seines Namens SicherheitslĂŒcken aufweist.
- EinfĂŒhrung von Zeitwerk-Loading in Chatbot und seinen Erweiterungs-Plugins.
- Verschiebung standortspezifischer Tools in das Locations Early Access Plugin (sponsor mich, um den Zugriff wieder zu erhalten)
- Verbesserung der Fehlerwiederherstellung des Calculators und UnterstĂŒtzung gĂ€ngiger Ï/e-Notation.
- Aktualisierung des READMEs
- Aktualisierung des Haupt-Plugins von Version 1.8.0 auf 2.4.1.
Discourse Chatbot
-
#162 â FIX: Beibehaltung des Reasoning-Zustands der Responses API (FIX: Preserve Responses API reasoning state - Pull Request #162 - merefield/discourse-chatbot - GitHub)
Die Reasoning- und Tool-Weiterleitungen der Responses API wurden zuverlĂ€ssiger, konfigurierbare Iterations- und Token-Limits eingefĂŒhrt,
die URL-HerkunftsprĂŒfung verbessert, nĂŒtzliche Teilantworten beibehalten und die Akzeptanz leerer oder fehlerhafter Antworten verhindert. -
#163 â FEATURE: HinzufĂŒgung fortschrittlicher lokaler Reasoning-Strategien (FEATURE: Add advanced local reasoning strategies - Pull Request #163 - merefield/discourse-chatbot - GitHub)
Einfache, verify-and-revise, best-of-two und unsicherheitsgesteuerte Reasoning-Strategien fĂŒr Chat Completions hinzugefĂŒgt, mit
begrenzten Hilfsanfragen und fĂŒr Mitarbeiter sichtbaren Audit-Protokollen. -
#164 â FEATURE: HinzufĂŒgung aktueller OpenAI-Modelle (FEATURE: Add current OpenAI models - Pull Request #164 - merefield/discourse-chatbot - GitHub)
Die Modellselektoren wurden mit neueren GPT-5.x- und Pro-Varianten aktualisiert, geeignete Modelle wurden ĂŒber die Responses
API geroutet und âmax reasoning effortâ hinzugefĂŒgt. -
#165 â FIX: Verbesserung der Calculator-Wiederholungsanleitung (FIX: Improve calculator retry guidance - Pull Request #165 - merefield/discourse-chatbot - GitHub)
Den Modellen wurden klarere Calculator-Syntax- und Wiederherstellungsanweisungen gegeben, sodass korrigierbare Fehler angemessen wiederholt werden. -
#166 â FEATURE: HinzufĂŒgung eines semantischen Blockiergates fĂŒr Fragen (FEATURE: Add semantic blocked-question gate - Pull Request #166 - merefield/discourse-chatbot - GitHub)
Ein optionales, auf Embeddings basierendes Gate hinzugefĂŒgt, das administrativ definierte blockierte Themen identifizieren und Standardantworten zurĂŒckgeben kann, bevor das Hauptmodell aufgerufen wird. Es umfasst Caching, Mitarbeiter-Auditing, Fail-Open-Verhalten und UnterstĂŒtzung benutzerdefinierter Embedding-Modelle. -
#167 â DEV: Ersatz von SafeRuby und EinfĂŒhrung von Zeitwerk-Loading (DEV: Replace SafeRuby and adopt Zeitwerk loading - Pull Request #167 - merefield/discourse-chatbot - GitHub)
Der vendored SafeRuby-Auswerter wurde durch Dentaku ersetzt, Namespaces und Dateinamen wurden an Zeitwerk angepasst und
die Loading- und Lint-Konfiguration des Plugins modernisiert. Es stellte sich heraus, dass SafeRuby SicherheitslĂŒcken aufwies, daher die Migration. -
#168 â DEV: Extrahierung der Locations-Funktionen aus Chatbot (DEV: Extract Locations functions from Chatbot - Pull Request #168 - merefield/discourse-chatbot - GitHub)
Standortspezifische Tools und Einstellungen wurden aus dem Haupt-Plugin entfernt, sodass sie unabhÀngig von discourse-locations bereitgestellt werden können. -
#169 â FEATURE: Ersatz der Bot-Modi durch Trust-Level-basierte Tool-Auswahl
(FEATURE: Replace bot modes with trust-level tool selection - Pull Request #169 - merefield/discourse-chatbot - GitHub)
Dies war die wichtigste architektonische Rationalisierung:- Die separaten Basic- und RAG-Bots wurden durch DiscourseChatbot::Bot ersetzt.
- Integrierte Tool-Selektoren fĂŒr jedes Trust-Level hinzugefĂŒgt.
- Ein leerer Selektor ist nun gleichbedeutend mit einem einfachen, toolfreien Bot.
- Vision und Malen wurden in das Tool-Auswahlsystem integriert.
- Von externen Plugins bereitgestellte Tools bleiben auĂerhalb der integrierten Selektoren.
- Die Terminologie, Einstellungen und Klassen von âFunctionâ in âToolâ umbenannt.
- Einstellungen neu geordnet, gruppiert und bedingt ausgeblendet.
- Migrationshandhabung fĂŒr bestehende Konfigurationen hinzugefĂŒgt.
- Quota-AbzĂŒge wurden concurrency-safe gemacht.
- Antwortzeichenlimits, Logging-Auswahl und binÀres PDF-Lesen wurden korrigiert.
-
#170 â FIX: Verbesserung der Calculator-Tool-Wiederherstellung (FIX: Improve calculator tool recovery - Pull Request #170 - merefield/discourse-chatbot - GitHub)
Bekannte AusdrĂŒcke wie Math::PI, Math.PI, Math::E, Math.E und Ï wurden in eine Dentaku-kompatible Syntax normalisiert.
Wiederholte ungĂŒltige Aufrufe werden nun mit handlungsorientierten Hinweisen abgelehnt. -
#171 â DEV: Aktualisierung der Chatbot-Dokumentation (DEV: Refresh chatbot documentation - Pull Request #171 - merefield/discourse-chatbot - GitHub)
Das README wurde fĂŒr die einheitliche Bot- und Tool-Architektur, Reasoning-Strategien, blockierte Fragen, Calculator-Verhalten, Limits, Quotas, benutzerdefinierte Endpunkte, Bild-/PDF-UnterstĂŒtzung und aktuelle Einstellungen aktualisiert. Die Vision-UnterstĂŒtzung wird nicht mehr als experimentell beschrieben.
Begleit-Plugins
-
discourse-locations #4 â FIX: Aktualisierung der Chatbot-Standort-Erweiterungen fĂŒr die Tool-API (https://github.com/merefield/discourse-locations-early-access/pull/4)
Die extrahierten Standort-Integrationen wurden zu DiscourseChatbot::Tool migriert, unter Locations::Chatbot::Tools platziert und fĂŒr den einheitlichen Bot aktualisiert. -
Function-Erweiterungsbeispiel #1 â FIX: Aktualisierung des Beispiel-Plugins fĂŒr die Chatbot-Tool-API (FIX: Update example extension for Chatbot tool API - Pull Request #1 - merefield/discourse-chatbot-function-extension-example - GitHub)
Das Beispiel-Plugin wurde aktualisiert, um DiscourseChatbot::Tool, Zeitwerk-Loading, toolorientierte Einstellungen und
Ăbersetzungen sowie fokussierte Verhaltens-tests ohne Legacy-KompatibilitĂ€tscode zu demonstrieren.
@Karthik_K1 bitte wirf einen Blick auf den Screenshot im letzten Beitrag.
Ein Chatbot löst dieses Problem nahezu kosteneffizient:
Falls du keine Drittanbieter-Plugins installieren kannst, wird dir das wenig helfen.
Ich habe gerade einige Cache-Optimierungen eingefĂŒgt, die die Kosten fĂŒr die Nutzung von Chatbot senken sollten.



