ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

免费开源的日文中文字幕生成神器:Faster-Whisper-TransWithAI-ChickenRice完整入门指南

免费开源的日文中文字幕生成神器:Faster-Whisper-TransWithAI-ChickenRice完整入门指南 免费开源的日文中文字幕生成神器Faster-Whisper-TransWithAI-ChickenRice完整入门指南【免费下载链接】Faster-Whisper-TransWithAI-ChickenRice项目地址: https://gitcode.com/gh_mirrors/fa/Faster-Whisper-TransWithAI-ChickenRiceFaster-Whisper-TransWithAI-ChickenRice是一款免费开源的日文中文字幕生成工具基于 Faster Whisper 与音声优化 VAD 打造专门针对「日文转中文」场景深度优化。只需把音视频文件拖到对应的启动脚本上就能一键生成 SRT、VTT、LRC 三种格式的字幕支持 NVIDIA / AMD 显卡加速与 CPU 模式甚至无显卡也能通过云端推理完成转录翻译。为什么推荐这款字幕生成神器特性说明 高精度日文转中文内置「海南鸡v2」优化模型基于 5000 小时音频数据训练 双模式翻译模式日→中与转录模式日文原文转写任选 GPU 加速支持 NVIDIA CUDA 11.8 / 12.2 / 12.8 与 AMD ROCm/HIP☁️ 云端推理无本地显卡可用 Modal 云端 GPU 处理 智能缓存已生成字幕自动跳过批量处理更高效它相比普通字幕工具的最大差异是内置了一套「智能 VAD 切分 字幕合并去重」的后处理机制核心逻辑见 vad_manager.py 与 injection.py能有效减少嗯嗯啊啊造成的重复字幕和超长字幕条。第一步选择适合你的版本 下载前请先确认自己属于哪类用户项目提供三种发行包详细说明见 RELEASE_NOTES_CN.md翻译版translate开箱即用内置「海南鸡v2」日文转中文优化模型 → 想做日语视频中文字幕选它转录版transcribe内置日文原文转录模型 → 想要日文原文文本选它无主模型版nomodel不含主模型可自由替换 → 想用自己的模型选它根据显卡选 CUDA 版本NVIDIA 用户先运行nvidia-smi查看 CUDA 版本再按下表选择显卡系列推荐版本GTX 10 / 16 系列CUDA 11.8RTX 20 / 30 系列CUDA 11.8 或 12.2RTX 40 系列CUDA 12.2 或 12.8RTX 50 系列必须 CUDA 12.8AMD RX 5000–9000按gfx101x / gfx103x / gfx110x / gfx120x后缀选对应包无独立显卡CPU 版或 Modal 云端推理 不确定自己的显卡型号Windows 下打开「任务管理器 → 性能 → GPU」即可查看。第二步获取并运行工具 方式一下载发行包推荐新手从项目的 Releases 页面下载与显卡匹配的 ZIP解压后无需安装任何环境。方式二克隆源码如果你需要自行构建可克隆仓库源码git clone https://gitcode.com/gh_mirrors/fa/Faster-Whisper-TransWithAI-ChickenRice源码中通过 download_models.py 可以从模型仓库自动下载 VAD 等模型文件各环境的依赖清单参考 environment-cuda118.yml、environment-cuda122.yml 等文件。第三步拖入文件开始生成字幕 ✨用法非常简单——把音视频文件或整个文件夹拖到对应的 .bat 文件上即可你的需求拖到哪个文件日文转中文GPU显存≥6GB运行(翻译)(GPU).bat(GPU).bat)日文转中文显存仅 4GB运行(翻译)(GPU,低显存模式).bat(GPU,低显存模式).bat)日文转中文无显卡运行(翻译)(CPU).bat(CPU).bat)日文原文转录GPU运行(转录)(GPU).bat(GPU).bat)字幕输出到输出文件夹运行(转录)(GPU)(输出到当前文件夹).bat(GPU)(输出到当前文件夹).bat)默认会同时生成SRT视频播放、VTT网页视频、LRC歌词三种格式已存在的字幕会自动跳过。支持 mp3/wav/flac 等音频与 mp4/mkv/avi 等常见视频格式完整清单见 使用说明.txt。进阶让字幕更精准的关键参数 ⚙️大多数情况下无需改参数遇到幻听、时间轴漂移、字幕过长时可编辑 generation_config.json5 调整task设为translate翻译输出或transcribe原文转写vad_parameters.thresholdVAD 检测阈值0.3~0.7推荐 0.5——太大漏翻、太小时间轴不准segment_merge.max_duration_ms单条字幕合并后的最大时长避免出现跨几分钟不消失的超长字幕smart_split_with_vad智能 VAD 切分开关长视频更稳命令行参数--overwrite覆盖旧字幕、--output_dir指定输出目录、--task切换任务等可加在 .bat 中的infer.exe后面详情见 使用说明.txt 与 README.md。没有显卡用云端推理照样出字幕 ☁️显存不足或完全没独显时可以走 Modal 云端 GPU安装依赖pip install modal questionary或使用 environment-modal.yml 一键建环境注册 Modal 账号并执行modal token new完成授权运行python [modal_infer.py](https://link.gitcode.com/i/9e01b20cf198ca9c2a30e84982f01ff6)按交互提示选择 GPU 类型推荐性价比最高的 T4、模型和输入文件即可流程会自动完成上传音频 → 云端推理 → 字幕下载回本地输出保存在源文件同目录。常见问题解答 GPU 模式跑不起来先更新显卡驱动到最新版NVIDIA 用户确认 CUDA 版本匹配AMD 用户确认下载了对应gfx架构的版本字幕没生成检查文件格式是否受支持看控制台报错可加--overwrite参数重试显存不够换低显存模式int8_float16、CPU 模式或使用 Modal 云端推理无主模型版不识别模型把模型文件直接放入models/根目录或在 .bat 中加--model_name_or_pathmodels\模型文件夹写在最后作为一款永久免费开源MIT 协议见 LICENSE的日文中文字幕生成工具Faster-Whisper-TransWithAI-ChickenRice 把复杂的 Whisper 部署、VAD 调优、字幕后处理都封装成了拖一下的简单操作非常适合字幕组、汉化爱好者和无字幕日语视频观看者。更多细节可查阅 使用说明.txt 与 RELEASE_NOTES_CN.md源码核心位于 src/faster_whisper_transwithai_chickenrice/欢迎参与共建【免费下载链接】Faster-Whisper-TransWithAI-ChickenRice项目地址: https://gitcode.com/gh_mirrors/fa/Faster-Whisper-TransWithAI-ChickenRice创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表