RBoy
(RBoy)
1
在将 Discourse 更新到 v2026.8.0 后,使用启用了思考模式(thinking)的 Gemini Flash Lite 作为 LLM 时,会抛出 400 错误。
以下是配置(在升级之前是正常工作的):
现在运行时,它会抛出以下错误:
Non-streaming request failed: { “error”: { “code”: 400, “message”: “Request contains an invalid argument.”, “status”: “INVALID_ARGUMENT” } }
如果我禁用 thinking,它就能正常工作。
一旦我启用 thinking,问题就会回归到我去年报告过的一个回归 bug。看起来我需要硬编码用于思考的 token 数量,它不接受 0 或 -1,即使文档说明该参数是可选的,它也不接受留空。
RBoy
(RBoy)
2
这似乎只影响了 Flash Lite 模型,而 Flash 模型(即使未指定思考令牌且未启用思考功能)也能正常工作。
Pro 模型完全无法使用,升级后我完全无法让它运行,一直提示内部服务器错误。
sam
(Sam Saffron)
3
你为什么要使用旧版 API?你能切换到非旧版 API 并使用 gemini-3.5-flash-lite 吗?
RBoy
(RBoy)
4
因为这是一个升级,Sam。Gemini 推出新模型和 API 的速度太快了,根本跟不上。我们的想法是让 Discourse 保持稳定运行,在现有功能可用的基础上进行尽可能少的改动。
我不认为 Google 会在未来几年内关闭这些“旧版”模型端点。毕竟有太多的应用和系统在使用它们,而且和任何公司一样,一旦功能投入生产环境,就不会在短短几个月内将其弃用。同样,我也期望 Discourse 中原本正常运行的功能能够继续正常工作(直到 Discourse 主动移除它们)。如果模型端点在 Discourse 中受到支持,那么升级后它们应该像之前一样继续工作。
此外,我还注意到一个关于 latest 模型 ID 不被交互端点支持的问题——这本身就是一个大问题,并带来了显著的管理开销。假设我配置系统使用 3.5 端点,六个月后 Google 将其退役了——谁来通知我 3.5 已经退役?Discourse 不会,Gemini 也不会(因为它是通过 Discourse 运行的)。结果就是,突然有一天所有功能都停止工作了,然后我们才开始试图弄清楚发生了什么。