cat-shark
171b088e7c
feat: 批量流水线按 GPU 资源调度(非 GPU 阶段并行、GPU 阶段互斥)
此前组内阶段是串行的(先全部提音、再全部转写、再全部翻译),LLM 走线上端点时
翻译阶段不占显存、GPU 全程空转——实测占整轮挂钟约 40%(19.6W / 272MiB)。
- `_run_job` 改为按组启动在途流水线:每个视频独立推进自己的阶段,最多
`WOV_BATCH_PIPELINE_WORKERS`(默认 4)个阶段在途。
- 派发只看资源:`stage_gpu_need_mb` 为 0 的阶段(提音、线上翻译、ASS)立刻派发,
可与其它视频的转写并行;需要 GPU 的阶段由 `GpuGate` 互斥准入,并按"阶段索引
最小者优先"派发,组内仍是先跑完全部转写再进翻译——本机 Ollama 模型每组只
加载一次,不需要按"是否云端"写分支。
- 同一阶段只在途一份(派发即标记 running),单视频异常不带走整组;暂停沿用
run 级 paused.flag,暂停后不再派发新阶段。
- 测试:远端翻译与其它视频转写重叠、本机端点下全部转写先于翻译且翻译互斥、
提音与转写重叠,以及既有分组/暂停/失败隔离用例。
2026-09-18 22:40:53 +08:00
..
2026-09-06 08:15:13 +08:00
2026-09-13 15:40:31 +08:00
2026-09-18 22:40:53 +08:00
2026-09-18 22:40:53 +08:00
2026-09-18 10:31:52 +08:00
2026-09-18 22:40:53 +08:00
2026-09-05 22:32:40 +08:00
2026-09-18 22:23:19 +08:00
2026-09-05 21:03:55 +08:00
2026-09-18 22:27:38 +08:00
2026-09-18 10:31:52 +08:00
2026-09-13 15:40:31 +08:00