ericwyuan
eaf4ef3bd3
fix: Gemini 模型 fallback 链 — 修复全量降级 NVIDIA
根因: 免费层配额 GenerateRequestsPerDayPerProjectPerModel 每天每
模型仅 20 请求,日均 30+ 任务耗尽后持续 429,全部降级 NVIDIA
(最近40任务 35 nvidia / 4 gemini)。
- gemini_adapter 抽 _generate() 模型链调用: 429 立即切换下一模型
(flash -> flash-lite,各自独立 20/天配额),503 退避 3s 重试一次
再切换;视觉分析与问答统一走该链
- config: gemini 增 fallback_models,nvidia 恢复 nemotron-omni
(原生视频输入;此前 Oracle 线上手动改过未回传仓库,被旧配置
覆盖回 llama-3.2 逐帧模式) + timeout 30->120
- 健康检查校验整条模型链
实测 task 73: flash 429 -> lite 1s 内接管,12 帧直出,event_52
落库 provider=gemini。