ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Buzz:本地离线音频转录完整指南,5 分钟转出第一份文字稿

Buzz:本地离线音频转录完整指南,5 分钟转出第一份文字稿 Buzz本地离线音频转录完整指南5 分钟转出第一份文字稿【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款免费的桌面程序用 OpenAI Whisper 在本地完成离线音频转录MP3、WAV、MP4 等文件不上传任何服务器转完即得 TXT、SRT、VTT 三种格式的文字稿。它解决的是手里有一堆录音、需要文字稿、又不想交给云端处理的常见需求。对隐私敏感、要批量出稿、或给视频做本地字幕的人来说它是目前最省事的本地方案之一。它最擅长的三件事批量本地转录。本地音视频文件和网页链接都能导入一次选多少个就排多少个按顺序处理内置 Whisper、Faster Whisper、Whisper.cpp、Hugging Face、OpenAI API 共 5 种后端同一条队列可以混用。麦克风实时转录。点工具栏的麦克风按钮就开始监听边说边出字还带一个独立的演示窗口适合讲座、发布会这种正在发生的内容。说话人识别与字幕输出。开启识别后转录稿会标注不同说话人结果可导出 SRT、VTT 字幕文件直接挂到视频上使用。5 分钟上手推荐用 pip 安装两条命令pip install buzz-captions python -m buzz程序启动后点工具栏的 号选择一个本地音频文件也可以粘贴视频网址先下载再转录在任务行里选好引擎和模型大小点开始行状态变为 Completed 后双击该行进入时间轴结果界面逐行核对文字。常用配置项说明下面 5 个参数最直接影响结果按参数名作用怎么选记**--model-type引擎**5 种后端里选一个可选 whisper、whispercpp、fasterwhisper、huggingface、openaiapiWhisper.cpp 偏速度Faster Whisper 在 GPU 上表现好拿同一段音频各试一次最直观**--model-size模型大小**tiny、base、small、medium、large 五档越大越准也越慢日常会议录音用 small 或 medium重要访谈、术语多的内容用 large**--language语言**指定语言代码留空则自动检测确定语言时直接填检测更稳**-w词级时间戳**生成 word-level timestamps后续用 Merge 方式重排字幕时必须开启它而 Resize 方式要求不开启Resize 三参数Desired subtitle length 控制单行字幕最大字符数默认 42Merge by gap 把间隔小于 0.2 秒的两条字幕合并Split by punctuation 遇句末标点强制断行正则默认已覆盖中英文标点。各引擎的具体调用逻辑可以从源码目录 buzz/transcriber/ 入手看。进阶玩法命令行批量跳过图形界面直接跑任务加--hide-gui适合放进脚本。常用选项-m指定引擎、-s模型大小、-l语言、--srt/--vtt/--txt指定导出格式、-d输出目录完整参数表见 docs/docs/cli.md。python -m buzz add -m whispercpp -s medium -l en --srt -d ./out ./interview.mp3监听文件夹自动转录开启 Watch folder 后放进目录的新音频自动排队处理整批文件不用手动选。适合谁从哪开始录音涉及隐私、不能上传云端的用它做离线音频转录手里有一批音频要批量出文字稿的用任务队列加命令行处理给视频做本地字幕、不想走在线服务的转完直接导出 SRT 挂到视频上。第一次用建议先用 small 模型跑一段 1 分钟左右的短音频熟悉队列、结果界面和导出流程后再换 large 模型处理正式内容。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表