这是一款什么工具
把视频或音频丢进去,输出 SRT / ASS 字幕文件。识别与时间轴对齐全部在本机完成,素材不出本地磁盘。
九千多行,界面部分是 Qt,识别与对齐跑在本地推理后端上。
三步跑完一条字幕
- 导入素材拖入视频或音频文件,支持批量;工具会先读取时长与音轨参数,不支持的编码会提前提示。
- 选择模型与语言按语言选识别模型,中文场景建议同时打开标点恢复;带显卡的机器可以在设置里切换推理设备。
- 导出字幕在预览区校对时间轴后导出 SRT 或 ASS,双语字幕会输出同一条时间轴上的两行文本。
使用注意
注意事项
- 首次使用需要下载识别模型,模型文件较大,建议在网络稳定的环境下完成
- 长视频建议开启分段处理,单次处理超过两小时素材时内存占用会明显上升
- 导出的 ASS 若要在剪辑软件里使用,需确认该软件的字幕编码设置与工具一致
交付与上手
交付成品程序包,版本 v0.7.4,含模型下载脚本与使用说明。
- 先跑一条短视频确认模型下载完成且能出字幕
- 再批量导入,观察任务队列里的处理进度与失败原因
- 最后按自己的剪辑流程固定一种导出格式