# Frustraciones con el detector de spam de AI

**URL:** https://meta.discourse.org/t/frustrations-on-ai-spam-detector/388947
**Category:** Support
**Tags:** ai, spam
**Created:** [19 Noviembre, 2025 03:20 UTC](https://meta.discourse.org/t/frustrations-on-ai-spam-detector/388947 "2025-11-19T03:20:02Z")
**Posts on this page:** 10
**Page:** 1

<div class="post-metadata">

### Author: ![lilydjwg](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/lilydjwg/32/515838_2.png) [@lilydjwg](https://meta.discourse.org/u/lilydjwg)
#### Post date: [19 Noviembre, 2025 03:20 UTC](https://meta.discourse.org/t/frustrations-on-ai-spam-detector/388947/1 "2025-11-19T03:20:02Z")

</div>

Estoy intentando configurar el detector de spam de IA para mi propia instancia de Discourse, pero tengo varias preguntas:

El _prompt_ del sistema de la personalidad del detector de spam no se puede editar. Puedo crear una nueva personalidad, pero no hay ningún campo para hacerle saber a Discourse que se va a utilizar como detector de spam.

Quiero usar Qwen3 como el LLM para la tarea. No hay una configuración preestablecida para Qwen3, así que voy a crear una personalizada. Pero tampoco hay un `Qwen3Tokenizer`. ¿Qué hace el _tokenizer_ aquí? ¿Funciona `QwenTokenizer` para Qwen3?

¿O hay una opción más fácil para configurar un servicio tipo _webhook_ y que Discourse lo llame ante nuevos temas/publicaciones?

---

<div class="post-metadata">

### Author: ![NateDhaliwal](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/natedhaliwal/32/313494_2.png) [@NateDhaliwal](https://meta.discourse.org/u/NateDhaliwal)
#### Post date: [19 Noviembre, 2025 03:59 UTC](https://meta.discourse.org/t/frustrations-on-ai-spam-detector/388947/2 "2025-11-19T03:59:21Z")

</div>

Hola, para responder a tu pregunta:

> [@lilydjwg](#):
>
> ¿Qué hace el tokenizador aquí?

De la documentación:

> [@Discourse](#):
>
> **¿Qué es un tokenizador?**
> 
> - El tokenizador traduce cadenas de texto a _tokens_ (fichas), que es lo que un modelo utiliza para comprender la entrada.

---

<div class="post-metadata">

### Author: ![lilydjwg](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/lilydjwg/32/515838_2.png) [@lilydjwg](https://meta.discourse.org/u/lilydjwg)
#### Post date: [19 Noviembre, 2025 04:02 UTC](https://meta.discourse.org/t/frustrations-on-ai-spam-detector/388947/3 "2025-11-19T04:02:59Z")

</div>

Gracias, pero sé lo que es un tokenizador. Lo que no sé es para qué lo usa Discourse y qué pasaría si eligiera el tokenizador incorrecto. De todos modos, no necesito un tokenizador para llamar a un LLM.

---

<div class="post-metadata">

### Author: ![nat](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/nat/32/235063_2.png) [@nat](https://meta.discourse.org/u/nat)
#### Post date: [19 Noviembre, 2025 04:10 UTC](https://meta.discourse.org/t/frustrations-on-ai-spam-detector/388947/4 "2025-11-19T04:10:07Z")

</div>

> [@lilydjwg](#):
>
> No se puede editar la instrucción del sistema de la personalidad del detector de spam.

¿Puedes intentar visitar esta `https://\u003cyour-site\u003e/admin/plugins/discourse-ai/ai-spam`? Debería permitirte insertar instrucciones personalizadas y probar contra una publicación.

---

<div class="post-metadata">

### Author: ![lilydjwg](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/lilydjwg/32/515838_2.png) [@lilydjwg](https://meta.discourse.org/u/lilydjwg)
#### Post date: [19 Noviembre, 2025 04:22 UTC](https://meta.discourse.org/t/frustrations-on-ai-spam-detector/388947/5 "2025-11-19T04:22:50Z")

</div>

> [@nat](#):
>
> insertar instrucciones personalizadas

Entiendo que esta instrucción se concatena a la instrucción del sistema en lugar de reemplazarla, lo que hace que la instrucción sea aún más larga y tenga lenguajes mixtos…

> [@nat](#):
>
> Sí, puedes hacerlo y luego ejecutar la “Prueba”

Pero pasar la prueba no significa que no haya ningún problema. (Para su información, todavía no he configurado completamente el LLM; probé el servicio gratuito de Gemini pero obtuve 429, así que ahora estoy tratando de descubrir cómo integrar llama.cpp en Discourse).

---

<div class="post-metadata">

### Author: ![nat](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/nat/32/235063_2.png) [@nat](https://meta.discourse.org/u/nat)
#### Post date: [19 Noviembre, 2025 06:03 UTC](https://meta.discourse.org/t/frustrations-on-ai-spam-detector/388947/6 "2025-11-19T06:03:33Z")

</div>

Acabo de hacer una configuración rápida y funciona bien al seleccionar la personalidad personalizada para el spam.

![Screenshot 2025-11-19 at 1.54.11 PM](https://global.discourse-cdn.com/meta/original/4X/f/8/d/f8d74f227f919a6555fb34a9ef2345682a4a492b.jpeg)

![Screenshot 2025-11-19 at 1.51.51 PM](https://global.discourse-cdn.com/meta/original/4X/4/e/6/4e6ace185a3ea3f8fd8390dc090c4594819e5133.jpeg)

Avísanos de nuevo si no puedes hacerlo a través de `/discourse-ai/ai-spam`

---

<div class="post-metadata">

### Author: ![lilydjwg](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/lilydjwg/32/515838_2.png) [@lilydjwg](https://meta.discourse.org/u/lilydjwg)
#### Post date: [19 Noviembre, 2025 06:13 UTC](https://meta.discourse.org/t/frustrations-on-ai-spam-detector/388947/7 "2025-11-19T06:13:07Z")

</div>

Gracias, ¿así que esa etiqueta de “detector de spam” solo afecta al filtrado de listas de las _personas_?  
Configuraré un entorno de prueba e intentaré usarlo.

---

<div class="post-metadata">

### Author: ![lilydjwg](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/lilydjwg/32/515838_2.png) [@lilydjwg](https://meta.discourse.org/u/lilydjwg)
#### Post date: [19 Noviembre, 2025 11:14 UTC](https://meta.discourse.org/t/frustrations-on-ai-spam-detector/388947/8 "2025-11-19T11:14:32Z")

</div>

¡Parece que funciona, gracias!

---

<div class="post-metadata">

### Author: ![lilydjwg](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/lilydjwg/32/515838_2.png) [@lilydjwg](https://meta.discourse.org/u/lilydjwg)
#### Post date: [21 Noviembre, 2025 04:21 UTC](https://meta.discourse.org/t/frustrations-on-ai-spam-detector/388947/9 "2025-11-21T04:21:34Z")

</div>

Revisé el código fuente. Si no cometí errores, el tokenizador se utiliza para dos cosas: contar tokens para estadísticas y estimación de precios, y truncar publicaciones al límite establecido. Así que no debería afectarme mucho si se utiliza uno incorrecto.

---

<div class="post-metadata">

### Author: ![system](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/system/32/443519_2.png) [@system](https://meta.discourse.org/u/system)
#### Post date: [21 Diciembre, 2025 04:22 UTC](https://meta.discourse.org/t/frustrations-on-ai-spam-detector/388947/10 "2025-12-21T04:22:11Z")

</div>

This topic was automatically closed 30 days after the last reply. New replies are no longer allowed.
