Después de actualizar Discourse a la versión v2026.8.0, el LLM que utiliza Gemini Flash Lite con la función de razonamiento (thinking) activada genera un error 400.
Aquí está la configuración (que funcionaba antes de la actualización):
Al activar thinking, el problema regresa a un error de regresión que reporté el año pasado. Parece ser que necesito establecer manualmente (hardcode) el número de tokens utilizados para el razonamiento, y el sistema no acepta 0 ni -1, ni tampoco dejar el campo vacío, a pesar de que se indica que es opcional.
Parece que solo afecta al modelo Flash Lite, pero no al modelo Flash (que funciona perfectamente, incluso sin especificar tokens de razonamiento ni habilitar la función de razonamiento).
El modelo Pro está completamente roto. No logro que funcione en absoluto tras la actualización; recibo un error interno del servidor.
Porque es una actualización, Sam. No se puede mantener el ritmo al que Gemini genera modelos y API. La idea es mantener Discourse estable y funcionando con lo que funciona y con cambios mínimos.
No veo que Google cierre los puntos finales de los modelos “legacy” en los próximos años; demasiadas aplicaciones y sistemas los utilizan y, como cualquier corporación, una vez que las cosas están en producción, no se deprecian en cuestión de meses. De manera similar, me esperaría que las cosas que funcionan en Discourse sigan funcionando (hasta que Discourse las elimine). Si los puntos finales de los modelos están soportados en Discourse, entonces deberían seguir funcionando como lo hacían antes de la actualización.
Además, anoté el punto sobre el id de modelo latest no estar soportado por los puntos finales de interacción; eso en sí mismo es un gran problema e introduce una carga administrativa significativa.
Digamos que lo configuro para usar el punto final 3.5 y, seis meses después, Google lo retira. ¿Quién me informa de que 3.5 fue retirado? Discourse no lo hace, ni lo hace Gemini (porque se ejecuta a través de Discourse). El resultado final es que, de repente, un día todo deja de funcionar y ahora estamos intentando averiguar qué pasó.