为"按资源而不是按配置调度"提供判定基础:`stage_gpu_need_mb` 给出节点的显存 需求(whisper 按权重 ×1.45;本机 LLM/VLM 端点按预留;线上端点为 0), `GpuGate` 负责准入(GPU 阶段互斥 + 显存余量检查;探测不到 nvidia-smi 时退化为 互斥,与串行等价)。 - 判定只看资源现状,调用方不需要判断"是否云端"。 - 局域网地址上的本机 Ollama 用 `WOV_LOCAL_MODEL_HOSTS` 声明;预留值可用 `WOV_LOCAL_LLM_RESERVE_MB` / `WOV_LOCAL_VLM_RESERVE_MB` 调整。 - 测试覆盖互斥、余量边界、无探测退化、真实权重估算与端点判定。
0 lines
0 B
Python
0 lines
0 B
Python
The file is empty.