Página de configuraciones de Discourse AI - Large Language Model (LLM)

:bookmark: Esta guía cubre la página de configuración de LLM, que forma parte del plugin Discourse AI.

:person_raising_hand: Nivel de usuario requerido: Administrador

La página de configuración dedicada está diseñada para tener todo lo relacionado con los Modelos de Lenguaje Grandes (LLM) utilizados para las funciones de IA de Discourse en un solo lugar.

:raised_hand_with_fingers_splayed: Dependiendo de la función de IA de Discourse habilitada, se podría necesitar un LLM. Por favor, revise cada función de IA de Discourse para saber si un LLM es un prerrequisito.


Funciones

  • Añadir nuevos modelos, con información prellenada
  • Añadir modelos personalizados no mencionados
  • Configurar ajustes de LLM
  • Permitir el uso específico de LLM para el Bot de IA
    • Ver el nombre de usuario del Bot de IA
  • Habilitar el soporte de visión (dependiente del modelo)
  • Configurar tipos de archivo adjunto permitidos
  • Configurar cuotas de uso por grupo
  • Rastrear los costes de tokens de entrada/salida
  • Probar
  • Guardar configuraciones

Añadir conexiones de LLM

  1. Ir a AdministraciónPluginsIA
  2. Ir a la pestaña LLMs
  3. Añadir una nueva conexión, elegir su modelo
  4. Introducir la clave de API (dependiendo del modelo, puede que tenga más campos para introducir manualmente) y guardar
  5. (Opcional) Probar su conexión para asegurarse de que funciona

LLMs Soportados

:person_tipping_hand: Siempre puede añadir una opción personalizada si no ve su modelo listado. Se añaden continuamente modelos soportados. Los modelos preconfigurados son plantillas; siempre puede lograr el mismo resultado usando la “Configuración manual”.

Anthropic

  • Claude Opus 4.6
  • Claude Sonnet 4.6
  • Claude Haiku 4.5

Google

  • Gemini 3 Pro
  • Gemini 3 Flash

OpenAI

  • GPT-5.4
  • GPT-5 Mini
  • GPT-5 Nano

Open Router

  • DeepSeek V3.2
  • Moonshot Kimi K2.5
  • xAI Grok 4 Fast
  • MiniMax M2.5
  • Z-AI GLM-5
  • … y muchos más

Además, los clientes alojados pueden usar el LLM Pequeño Alojado de CDCK preconfigurado en la página de configuración. Este es un LLM de pesos abiertos alojado por Discourse, listo para usarse para potenciar las funciones de IA.

Campos de Configuración

:information_source: Solo verá los campos relevantes para su proveedor de LLM seleccionado. Por favor, verifique dos veces cualquiera de los campos pre-rellenados con el proveedor apropiado, como el Nombre del modelo

Campos principales:

  • Nombre de visualización — el nombre amigable que se muestra en los menús desplegables
  • Nombre del modelo — el identificador del modelo enviado a la API (ej. claude-sonnet-4-6, gpt-5.2)
  • Proveedor — el servicio que aloja el modelo (ej. Anthropic, OpenAI, Google, AWS Bedrock, Azure, Open Router, etc.)
  • URL — la URL del endpoint de la API (no se muestra para AWS Bedrock)
  • Clave de API — configurada a través del sistema de Secretos de IA
  • Tokenizador
  • Tokens máximos de prompt — controla el recorte del prompt para evitar solicitudes de tamaño excesivo
  • Tokens máximos de salida
  • Coste de entrada / Coste de salida — coste por millón de tokens, utilizado para el seguimiento del uso
  • Coste de entrada en caché / Coste de escritura en caché — para proveedores que soportan el almacenamiento en caché del prompt
  • Visión habilitada — habilita la comprensión de imágenes (dependiente del modelo)
  • Tipos de archivo adjunto permitidos — tipos de archivo que el modelo puede procesar

Campos específicos del proveedor (mostrados dinámicamente según el proveedor seleccionado):

  • AWS Bedrock: ID de clave de acceso, ARN de rol, Región, opciones de razonamiento/pensamiento, Almacenamiento en caché de prompt
  • Anthropic: opciones de razonamiento, Almacenamiento en caché de prompt
  • OpenAI: ID de organización, Esfuerzo de razonamiento, Nivel de servicio
  • Google: Habilitar pensamiento, Nivel de pensamiento
  • Open Router: Orden del proveedor, Cuantificaciones del proveedor

Cuotas (disponibles después de guardar inicialmente):

  • Se pueden configurar cuotas de uso por grupo con tokens máximos, usos máximos y duración

Preguntas Frecuentes Técnicas

¿Qué es el tokenizador?

  • El tokenizador traduce cadenas de texto a tokens, que es lo que un modelo utiliza para comprender la entrada.

¿Qué número debo usar para Tokens máximos de prompt?

  • Una buena regla general es el 50% de la ventana de contexto del modelo, que es la suma de cuántos tokens envía y cuántos tokens generan. Si el prompt se vuelve demasiado grande, la solicitud fallará. Ese número se utiliza para recortar el prompt y evitar que eso suceda.

Advertencias

  • A veces es posible que no vea el modelo que quería usar listado. Aunque puede añadirlos manualmente, soportaremos los modelos populares a medida que salgan.
11 Me gusta

Es demasiado difícil, no sé cómo hacerlo. Espero que actualicen tutoriales específicos sobre varias IA, como la configuración de inicio de sesión de Google.

1 me gusta

20 publicaciones se separaron a un nuevo tema: Discusión aleatoria sobre la configuración de LLM en Discourse

6 publicaciones se dividieron en un nuevo tema: Necesito ayuda para actualizar Discourse