fix: 帧文件按帧号数值排序,修复超 9999 帧字典序错位
- frame-extract 新增 _sorted_frame_files:ffmpeg %04d 编号超过 9999 帧后扩为 5 位,sorted() 字典序会把 5 位编号排在 4 位之前,导致 frames.json 时间与 图像错位(真实发生于 run_339ec7ee437f 的 14236 帧任务) - subtitle-ocr 提取 _merge_kept 供重组装复用 - 回归测试用真实任务留存数据(testdata/frames_boundary/),并新增真实 OCR 数据按正确时间轴重组装为 SRT 的集成测试(test_integration_reassemble_ocr)
This commit is contained in:
+19
-1
@@ -111,6 +111,24 @@ def _parse_progress_line(line: str) -> int | None:
|
||||
except ValueError:
|
||||
return None
|
||||
|
||||
|
||||
def _sorted_frame_files(frames_dir: Path) -> list[Path]:
|
||||
"""按文件名中的帧号数值排序返回帧文件列表(自然排序,非字典序)。
|
||||
|
||||
关键点:ffmpeg 的 %04d 编号在超过 9999 帧后会自动扩为 5 位
|
||||
(frame_10000.png 等),此时 sorted() 默认的字典序会把 5 位编号排在
|
||||
4 位编号之前(如 "frame_10009" < "frame_1009"),导致帧号回退、
|
||||
manifest 时间与图像错位(曾真实发生于 run_339ec7ee437f 的 14236 帧
|
||||
任务,全片后半段时间轴全部错乱)。必须解析出帧号按数值排序,
|
||||
才能保证"第 k 个文件 = 第 k 个选中帧 = 时间 index*step/fps"成立。
|
||||
"""
|
||||
def frame_number(path: Path) -> int:
|
||||
# 文件名形如 frame_0001.png,取下划线后的数字部分。
|
||||
return int(path.stem.split("_", 1)[1])
|
||||
|
||||
return sorted(frames_dir.glob("frame_*.png"), key=frame_number)
|
||||
|
||||
|
||||
def invoke(request: InvokeRequest) -> InvokeResponse:
|
||||
"""按帧间隔抽取并裁切视频帧,输出 frames.json 清单。"""
|
||||
video_uri = request.inputs.get("video_uri")
|
||||
@@ -203,7 +221,7 @@ def invoke(request: InvokeRequest) -> InvokeResponse:
|
||||
return InvokeResponse(status="failed", error=stderr[-500:] or "ffmpeg failed")
|
||||
|
||||
# 第 k 个输出文件对应原始帧号 k×step,时间 = 帧号 / fps(帧精确,无累计偏差)。
|
||||
files = sorted(frames_dir.glob("frame_*.png"))
|
||||
files = _sorted_frame_files(frames_dir)
|
||||
manifest = [
|
||||
{"time": round((index * step) / fps, 3), "image_uri": str(path)}
|
||||
for index, path in enumerate(files)
|
||||
|
||||
Reference in New Issue
Block a user