[架构重构] 移除本地Ollama融合,云端直出JSON直存DB,Q&A三模型降级
1. 视频摘要链路:云端VLM直出结构化JSON → Edge format_cloud_result格式化校验 → 直存NAS DB(移除run_text_fusion本地融合) 2. 智能问答链路:Gemini→NVIDIA→Ollama降级,新增chat()纯文本问答方法 3. 适配器重构:base/gemini/nvidia/ollama adapter新增chat();gemini多图单请求结构化JSON;nvidia逐帧调用聚合 4. 端点变更:/api/edge/chat → /api/edge/chat/ask,调orchestrator.run_qa() 5. chat_handler改经Edge Q&A编排,不再直连Ollama 6. 配置更新:ollama_url → qa_url,Ollama role注释改为Q&A兜底 7. README同步更新架构描述、拓扑图、时序图、模块表
This commit is contained in:
@@ -39,9 +39,15 @@ timeout:
|
||||
callback: 30
|
||||
overall: 1800
|
||||
|
||||
# 多模型池配置
|
||||
# 视觉分析: Gemini(主) -> NVIDIA NIM(备) 顺序降级; 全失败 -> 任务 FAILED 走重试
|
||||
# 文本融合/对话: 本地 Ollama qwen2.5:7b 专职 (不参与视觉)
|
||||
# 多模型池配置(新框架:本地大模型不参与视频分析,仅智能问答兜底)
|
||||
#
|
||||
# 视频分析链路(推送模式):
|
||||
# 云端 VLM 直接产出结构化 JSON (global_summary / entities_json / frame_details)
|
||||
# -> Edge 仅做格式化/校验 (format_cloud_result) -> 直接回写 NAS,无本地融合步骤
|
||||
# 视觉角色: Gemini(主) -> NVIDIA NIM(备) 顺序降级; 两云端全失败 -> 任务 FAILED 走重试
|
||||
#
|
||||
# 智能问答链路:
|
||||
# Gemini -> NVIDIA -> 本地 Ollama (仅当两云端都失败才启用本地兜底)
|
||||
models:
|
||||
- provider: "gemini"
|
||||
role: "vision"
|
||||
@@ -66,12 +72,14 @@ models:
|
||||
threshold: 3
|
||||
cooldown: 600
|
||||
|
||||
# 本地模型:纯文本 qwen2.5:7b,仅参与智能问答,作为 Gemini/NVIDIA 都失败时的兜底
|
||||
- provider: "ollama"
|
||||
role: "text"
|
||||
usage: "qa_fallback"
|
||||
enabled: true
|
||||
model_name: "qwen2.5:7b"
|
||||
base_url: "http://localhost:11434"
|
||||
timeout: 300
|
||||
timeout: 120
|
||||
num_predict: 512
|
||||
circuit_breaker:
|
||||
enabled: false
|
||||
|
||||
Reference in New Issue
Block a user