# Regression - Gemini Flash Lite con thinking rotto dopo l'aggiornamento a 2026.8.0

**URL:** https://meta.discourse.org/t/regression-gemini-flash-lite-with-thinking-broken-after-upgrade-to-2026-8-0/411445
**Category:** Bug
**Tags:** ai
**Created:** [2 Settembre 2026, 4:37am UTC](https://meta.discourse.org/t/regression-gemini-flash-lite-with-thinking-broken-after-upgrade-to-2026-8-0/411445 "2026-09-02T04:37:23Z")
**Posts on this page:** 4
**Page:** 1

<div class="post-metadata">

### Author: ![RBoy](https://avatars.discourse-cdn.com/v4/letter/r/2bfe46/32.png) [@RBoy](https://meta.discourse.org/u/RBoy)
#### Post date: [2 Settembre 2026, 4:37am UTC](https://meta.discourse.org/t/regression-gemini-flash-lite-with-thinking-broken-after-upgrade-to-2026-8-0/411445/1 "2026-09-02T04:37:23Z")

</div>

Dopo l’aggiornamento di Discourse alla versione v2026.8.0, l’LLM che utilizza Gemini Flash Lite con il thinking abilitato restituisce un errore 400.

Ecco la configurazione (che funzionava prima dell’aggiornamento)

 ![image](https://global.discourse-cdn.com/meta/original/4X/e/0/3/e03a504750e117288a0330581376a5bfbfe8e351.png)

Ora, quando lo eseguo, restituisce:

> Non-streaming request failed: { “error”: { “code”: 400, “message”: “Request contains an invalid argument.”, “status”: “INVALID\_ARGUMENT” } }

Se disabilito `thinking`, funziona.

Se abilito thinking, il problema torna a essere un bug di regressione che avevo segnalato l’anno scorso: sembra che sia necessario impostare manualmente il numero di token utilizzati per il thinking e il sistema non accetta 0 né -1, e non accetta nemmeno di non specificare nulla, anche se viene indicato come facoltativo.

> [@Pensare al budget per Gemini Pro, errore quando si usa -1](https://meta.discourse.org/t/thinking-budget-for-gemini-pro-error-when-using-0-or-1/388485):
>
> Sto cercando di utilizzare il modello più recente di LLM gemini pro (gemini-pro-latest) per la persona Forum Helper per Posts Triage e ricevo un errore: DiscourseAi::Completions::Endpoints:Gemini status: 400 - body: { "error": { "code": 400, "message": "Budget 0 non è valido. Questo modello funziona solo in modalità di pensiero.", "status": "INVALID\_ARGUMENT" } } Backtrace activesupport-8.0.4/lib/active\_support/broadcast\_logger.rb:218:in `block in dispatch' activesupport-8.…

---

<div class="post-metadata">

### Author: ![RBoy](https://avatars.discourse-cdn.com/v4/letter/r/2bfe46/32.png) [@RBoy](https://meta.discourse.org/u/RBoy)
#### Post date: [2 Settembre 2026, 4:47am UTC](https://meta.discourse.org/t/regression-gemini-flash-lite-with-thinking-broken-after-upgrade-to-2026-8-0/411445/2 "2026-09-02T04:47:52Z")

</div>

Sembra che il problema riguardi solo il modello Flash Lite, ma non il modello Flash (che funziona perfettamente, anche senza specificare token di ragionamento e con il ragionamento attivato).

Il modello Pro è completamente rotto: dopo l’aggiornamento non riesco a farlo funzionare in alcun modo, ricevo un errore interno del server.

---

<div class="post-metadata">

### Author: ![sam](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/sam/32/102149_2.png) [@sam](https://meta.discourse.org/u/sam)
#### Post date: [2 Settembre 2026, 5:15am UTC](https://meta.discourse.org/t/regression-gemini-flash-lite-with-thinking-broken-after-upgrade-to-2026-8-0/411445/3 "2026-09-02T05:15:47Z")

</div>

Perché stai usando l’API legacy? Puoi passare all’API non legacy e utilizzare: gemini-3.5-flash-lite?

---

<div class="post-metadata">

### Author: ![RBoy](https://avatars.discourse-cdn.com/v4/letter/r/2bfe46/32.png) [@RBoy](https://meta.discourse.org/u/RBoy)
#### Post date: [2 Settembre 2026, 5:33am UTC](https://meta.discourse.org/t/regression-gemini-flash-lite-with-thinking-broken-after-upgrade-to-2026-8-0/411445/4 "2026-09-02T05:33:42Z")

</div>

Perché si tratta di un aggiornamento, Sam. Non si riesce a tenere il passo con il ritmo a cui Gemini produce modelli e API. L’idea è mantenere Discourse stabile e funzionante con ciò che funziona e con modifiche minime.

Non vedo Google disattivare gli endpoint dei modelli “legacy” per anni a venire: troppe app e sistemi li utilizzano e, come qualsiasi corporation, una volta che le cose sono in produzione non si depreca entro pochi mesi. Mi aspetterei allo stesso modo che le funzionalità che funzionano in Discourse continuino a funzionare (finché Discourse non se ne sbarazzerà). Se gli endpoint dei modelli sono supportati in Discourse, dovrebbero continuare a funzionare come prima dell’aggiornamento.

Inoltre, ho notato il punto relativo al fatto che l’ID del modello `latest` non sia supportato dagli endpoint di interazione: questo di per sé è un problema grave e introduce un significativo sovraccarico amministrativo.  
Diciamo che lo configuro per utilizzare l’endpoint 3.5 e sei mesi dopo Google lo ritira: chi mi informa che la 3.5 è stata ritirata? Discourse no, né tanto meno Gemini (poiché funziona tramite Discourse). Il risultato finale è che un giorno, all’improvviso, tutto smette di funzionare e ora dobbiamo cercare di capire cosa sia successo.
