# Advertencia al incrustar \`input must have less than 8192 tokens\` con discourse ai

**URL:** https://meta.discourse.org/t/warning-of-embedding-input-must-have-less-than-8192-tokens-with-discourse-ai/387332
**Category:** Support
**Tags:** ai
**Created:** [1 Noviembre, 2025 01:53 UTC](https://meta.discourse.org/t/warning-of-embedding-input-must-have-less-than-8192-tokens-with-discourse-ai/387332 "2025-11-01T01:53:41Z")
**Posts on this page:** 6
**Page:** 1

<div class="post-metadata">

### Author: ![whitewaterdeu](https://avatars.discourse-cdn.com/v4/letter/w/57b2e6/32.png) [@whitewaterdeu](https://meta.discourse.org/u/whitewaterdeu)
#### Post date: [1 Noviembre, 2025 01:53 UTC](https://meta.discourse.org/t/warning-of-embedding-input-must-have-less-than-8192-tokens-with-discourse-ai/387332/1 "2025-11-01T01:53:41Z")

</div>

¿Hay alguna herramienta para dividir el texto de entrada en fragmentos?  
¿O qué API de incrustación admite más de 8192 tokens?

```plaintext
Mensaje (15 copias reportadas)

OpenAI Embeddings falló con el estado: 413 cuerpo: {"code":20042,"message":"la entrada debe tener menos de 8192 tokens","data":null}

Backtrace

/var/www/discourse/vendor/bundle/ruby/3.3.0/gems/activesupport-8.0.3/lib/active_support/broadcast_logger.rb:218:in `block in dispatch'
/var/www/discourse/vendor/bundle/ruby/3.3.0/gems/activesupport-8.0.3/lib/active_support/broadcast_logger.rb:217:in `map'
/var/www/discourse/vendor/bundle/ruby/3.3.0/gems/activesupport-8.0.3/lib/active_support/broadcast_logger.rb:217:in `dispatch'
/var/www/discourse/vendor/bundle/ruby/3.3.0/gems/activesupport-8.0.3/lib/active_support/broadcast_logger.rb:129:in `warn'
/var/www/discourse/plugins/discourse-ai/lib/inference/open_ai_embeddings.rb:34:in `perform!'
/var/www/discourse/plugins/discourse-ai/lib/embeddings/vector.rb:45:in `block (2 levels) in gen_bulk_reprensentations'
/var/www/discourse/lib/scheduler/thread_pool.rb:118:in `block (2 levels) in wrap_block'
/var/www/discourse/vendor/bundle/ruby/3.3.0/gems/rails_multisite-7.0.0/lib/rails_multisite/connection_management/null_instance.rb:49:in `with_connection'
/var/www/discourse/vendor/bundle/ruby/3.3.0/gems/rails_multisite-7.0.0/lib/rails_multisite/connection_management.rb:17:in `with_connection'
/var/www/discourse/lib/scheduler/thread_pool.rb:118:in `block in wrap_block'
/var/www/discourse/lib/scheduler/thread_pool.rb:163:in `thread_loop'
/var/www/discourse/lib/scheduler/thread_pool.rb:174:in `block in spawn_thread'

```

---

<div class="post-metadata">

### Author: ![Falco](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/falco/32/179432_2.png) [@Falco](https://meta.discourse.org/u/Falco)
#### Post date: [1 Noviembre, 2025 03:39 UTC](https://meta.discourse.org/t/warning-of-embedding-input-must-have-less-than-8192-tokens-with-discourse-ai/387332/2 "2025-11-01T03:39:58Z")

</div>

Si auto-alojas ese mismo modelo, puede ocupar hasta 32&nbsp;000 tokens.

Si eso está fuera de discusión, entonces necesitas configurar el modelo de embeddings para limitar las entradas al máximo permitido en tu proveedor. De esta manera, nuestro Bot de IA RAG dividirá los archivos cargados en fragmentos, y Related Topic / Search tomará solo los primeros 8192 tokens de cada tema.

---

<div class="post-metadata">

### Author: ![whitewaterdeu](https://avatars.discourse-cdn.com/v4/letter/w/57b2e6/32.png) [@whitewaterdeu](https://meta.discourse.org/u/whitewaterdeu)
#### Post date: [2 Noviembre, 2025 02:56 UTC](https://meta.discourse.org/t/warning-of-embedding-input-must-have-less-than-8192-tokens-with-discourse-ai/387332/3 "2025-11-02T02:56:04Z")

</div>

¿cómo configurar el modelo de incrustación? ¿en discourse? ¿o en el proveedor del modelo?

---

<div class="post-metadata">

### Author: ![whitewaterdeu](https://avatars.discourse-cdn.com/v4/letter/w/57b2e6/32.png) [@whitewaterdeu](https://meta.discourse.org/u/whitewaterdeu)
#### Post date: [2 Noviembre, 2025 12:44 UTC](https://meta.discourse.org/t/warning-of-embedding-input-must-have-less-than-8192-tokens-with-discourse-ai/387332/4 "2025-11-02T12:44:50Z")

</div>

Estoy seguro de que **[Qwen/Qwen3-Embedding-0.6B](https://cloud.siliconflow.cn/models?target=Qwen/Qwen3-Embedding-0.6B)** admite hasta 32k tokens  
y he configurado la longitud de la secuencia en 32k

 ![image](https://global.discourse-cdn.com/meta/original/4X/b/e/2/be2e8b807a72ad0da175688de147365bc170d67f.png)

 ![image](https://global.discourse-cdn.com/meta/original/4X/3/a/d/3adf93f9e977d2c8955de36806c5cb90ec06d0ff.png)

pero todavía hay muchos errores de incrustación

 ![image](https://global.discourse-cdn.com/meta/original/4X/9/1/5/9155df3c4bf768d42268330da338da14eaa80784.jpeg)

 ![image](https://global.discourse-cdn.com/meta/original/4X/7/3/6/73623b414176fe6b99b497e3ac5a69e16b4a2285.jpeg)

 ![image](https://global.discourse-cdn.com/meta/original/4X/4/e/6/4e677198c2833642be486b30877ec7f38f81f81a.jpeg)

---

<div class="post-metadata">

### Author: ![Falco](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/falco/32/179432_2.png) [@Falco](https://meta.discourse.org/u/Falco)
#### Post date: [2 Noviembre, 2025 17:08 UTC](https://meta.discourse.org/t/warning-of-embedding-input-must-have-less-than-8192-tokens-with-discourse-ai/387332/5 "2025-11-02T17:08:39Z")

</div>

> [@whitewaterdeu](#):
>
> Estoy seguro de que **[Qwen/Qwen3-Embedding-0.6B](https://cloud.siliconflow.cn/models?target=Qwen/Qwen3-Embedding-0.6B)** admite hasta 32k tokens

Lo hace si tu proveedor de API lo permite.

> [@whitewaterdeu](#):
>
> pero todavía hay muchos errores de incrustación

Si tu proveedor de API lo limita a 8192, tienes que seguir sus reglas.

---

<div class="post-metadata">

### Author: ![whitewaterdeu](https://avatars.discourse-cdn.com/v4/letter/w/57b2e6/32.png) [@whitewaterdeu](https://meta.discourse.org/u/whitewaterdeu)
#### Post date: [3 Noviembre, 2025 08:10 UTC](https://meta.discourse.org/t/warning-of-embedding-input-must-have-less-than-8192-tokens-with-discourse-ai/387332/6 "2025-11-03T08:10:48Z")

</div>

ok, le estoy preguntando al proveedor de la API
