1.1 KiB
1.1 KiB
WOV Whisper Node
使用 faster-whisper 将音频转写为 SRT 字幕。
输入
audio_uri:16kHz 单声道音频。- 参数:
language、model_path、device、compute_type、beam_size、vad_filter。
输出
srt_uri:生成的 SRT。
安装模型依赖
uv add faster-whisper
Linux 上同样在 wov-node-whisper 目录执行 uv add faster-whisper;节点管理器会自动使用该仓库 .venv/bin/python 启动节点。
代码注释规范
- 本仓库所有源码(Python、TOML 等支持注释的文件)必须配有详细中文注释,说明模块职责、模型加载参数与 SRT 生成逻辑,确保后续维护人员可以快速理解代码工作原理。
- 新增或修改代码时,必须同步补充或更新对应注释;不得删除已有注释。
- 测试代码同样必须配有中文注释,说明每条测试验证的行为。
- JSON 数据文件(
node.manifest.json)不支持注释,字段语义以wov-sdk的NodeManifest模型注释和本文档输入/输出说明为准。