
视频字幕提取指南本地 OCR 一键把硬字幕转成 srt 文件【免费下载链接】video-subtitle-extractor视频硬字幕提取生成srt文件。无需申请第三方API本地实现文本识别。基于深度学习的视频字幕提取框架包含字幕区域检测、字幕内容提取。A GUI tool for extracting hard-coded subtitle (hardsub) from videos and generating srt files.项目地址: https://gitcode.com/gh_mirrors/vi/video-subtitle-extractorVideo-subtitle-extractorVSE是一款开源的视频字幕提取工具能在你自己的电脑上把视频里的硬字幕识别出来并导出为外挂 srt 文件全程本地运行、无需申请任何第三方 OCR API。项目内置 87 种语言的识别模型支持批量处理多个视频适合外语学习、影视资源整理和内容二创人群。快速上手拿到项目有两条路普通用户直接下载 Release 里的压缩包解压即可运行开发者则从仓库拉取源码。git clone https://gitcode.com/gh_mirrors/vi/video-subtitle-extractor源码运行要求 Python 3.12 及以上版本先在项目目录创建虚拟环境按 requirements.txt 安装依赖其中包含 PaddlePaddle没有独立显卡的机器安装 CPU 版即可然后启动图形界面。python gui.py启动后点【打开】选择视频右侧选好语言与识别模式点【运行】即可。命令行用户也可以执行python backend/main.py走 CLI 流程。界面布局如下上方是视频预览下方滚动输出日志右下角的任务列表会显示每个视频的处理进度。核心能力拆解上手之后可以留意这四项能力它们决定了这份字幕干不干净、全不全。本地完成识别不碰在线服务检测与识别模型都打包在仓库内位于backend/models/V5/目录文字识别在你本机跑完字幕内容不会传往任何服务器断网环境也能用处理隐私素材更放心。自动锁定字幕区域滤掉水印台标打开视频后程序会先判断字幕大致出现在画面哪里并用绿色框标在预览中你可以拖动修正。由于台标、水印的位置长期不变而字幕持续跳动算法据此区分两者导出的 srt 不会被固定杂音刷屏。一次多选批量生成外挂字幕一次勾选多个视频程序按顺序排队处理每个视频各生成一份独立 srt也可顺手导出 txt 纯文本。注意同一批视频的分辨率与字幕位置应保持一致批量效果才稳定。87 种语言小语种也覆盖右侧的视频的语言下拉框决定使用哪套识别模型。除简体中文含中英混排、繁体中文、英文、日语、韩语、越南语外阿拉伯语、西班牙语、俄语等语言也支持学习材料里的小语种不必再找在线工具。参数与模式调节模式、区域、阈值三组设置分别管快不快、认不认、干不干净按需调整即可识别模式快速使用轻量模型速度快但可能漏少量行、出现个别错字自动按硬件分配模型CPU 走轻量、GPU 走高精是官方推荐的选择精准逐帧检测不漏行但非常慢仅在前两者漏行明显时启用。字幕区域默认框定在画面下方字幕位置特殊时直接拖绿框或在高级设置中修改区域坐标。置信度阈值默认 75低于 0.75 置信度的文字直接丢弃误识别多就调高漏字多就调低。文本相似度阈值去重时判断两行是否为同一句字幕值越高判断越严格。采样频率每秒抓取多少帧参与识别默认 3 帧调高更完整但更耗时。文字层面的杂音交给替换规则处理编辑backend/configs/typoMap.json左侧填误识别原文、右侧填期望文本例如把威筋改成威胁右侧写空字符串则整条删除常用来清掉固定出现的水印短句。运行门槛与性能基础配置并不高双核 CPU、4GB 内存、2GB 可用磁盘模型文件已随仓库提供没有独立显卡也能用 CPU 模式跑通全流程只是处理长视频会比较慢。推荐配置则是带 NVIDIA 显卡走 CUDA或 AMD/Intel 显卡走 DirectML的机器搭配 8GB 以上内存与固态硬盘。硬件加速的价值不只是提速GPU 环境下自动模式会直接切到更大、更准的模型加速后准确率与速度会同时提升。排错手册闪退或报未知错误多半是视频文件路径或项目路径含中文、空格将两者都挪到纯英文路径后重试。CUDA / cuDNN 报错、识别无结果显卡驱动与安装的 CUDA、cuDNN 版本不匹配按显卡型号安装对应组合常见推荐是 CUDA 11.8 cuDNN 8.6.0。漏字幕、缺行先把识别模式从快速换成自动重跑仍漏得明显时再启用精准模式。写在最后VSE 把硬字幕变外挂做成了完全离线的本地流程语言学习者、影视资源整理者和二创作者都能直接受益。 下一步建议克隆项目后先拿仓库test/目录下自带的 test_cn.mp4 试跑一次确认环境无误后再处理正式素材。【免费下载链接】video-subtitle-extractor视频硬字幕提取生成srt文件。无需申请第三方API本地实现文本识别。基于深度学习的视频字幕提取框架包含字幕区域检测、字幕内容提取。A GUI tool for extracting hard-coded subtitle (hardsub) from videos and generating srt files.项目地址: https://gitcode.com/gh_mirrors/vi/video-subtitle-extractor创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考