ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Buzz 语音转录:免费的 Whisper 离线语音转文字完整指南

Buzz 语音转录:免费的 Whisper 离线语音转文字完整指南 Buzz 语音转录免费的 Whisper 离线语音转文字完整指南【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 语音转录是一款免费的开源工具底层是 OpenAI 的 Whisper 模型音频不用上传服务器断网也能离线转文字适合处理会议录音、采访素材这类不想上云的音频。下面按「装好 → 用顺 → 用狠 → 不出错」的顺序把安装、常用操作和自救办法一次讲清读完全篇你就能独立跑通从导入到导出字幕的完整流程。一、三平台安装对照三个平台的安装方式各不一样对着表来就行平台安装方式说明Windows下载安装包双击安装安装包未签名会弹警告选「仍要运行」即可首次自动下载基础模型预留约 1GB 空间macOS下载.dmg直装现仅支持 Apple 芯片Intel 机型停留在 1.4.5 版本LinuxFlatpak 或 SnapSnap 方式需再执行sudo snap connect buzz:password-manager-service接入系统密码管理器更详细的系统依赖和 pip 安装方式见 docs/docs/installation.md。二、主界面认识 模型怎么挑主界面就三大块先认出来后面操作都在这三块里进行上方工具栏录音、导入文件、导入 URL、清空历史这些核心按钮都在这左侧任务列表每个导入的音频对应一个任务实时显示等待、转录中、完成等状态右侧转录结果区逐句显示文字和时间戳可以直接点选、编辑、跟着音频播放校对。模型决定了「转得快」还是「转得准」。Buzz 默认使用 Whisper 系列模型在偏好窗口里管理菜单打开偏好或按Ctrl,模型适用设备处理速度准确率推荐场景Tiny低配置电脑极快够用实时转录、草稿Base普通电脑快良好日常使用Small主流配置中等高会议记录Medium高性能电脑较慢很高正式文稿Large高性能显卡慢最高高精度需求几个实用细节偏好窗口可下载、删除模型不用去网页手动找文件选 Whisper.cpp 引擎时支持Custom选项填入模型.bin文件的下载链接即可用任意量化模型显存不够时可在偏好里开启「Reduce GPU RAM」等价于环境变量BUZZ_REDUCE_GPU_MEMORY。三、三种常见用法用法一离线转写一个音频最常用的场景。步骤点工具栏「导入文件」快捷键CtrlO选 mp3、wav 等音频文件在任务列表里看进度转完自动进入结果区结果区里每句都有独立时间戳可直接改字、调时间、跟着音频播放校对。这里能做的事改错字点任意一句直接改文本识别错了不用重新跑调时间轴选中句子后用Ctrl←/Ctrl→微调起止时间CtrlShift←/CtrlShift→调结束时间播放校对CtrlP播放/暂停CtrlG跳到当前播放位置边听边改切视角CtrlE纯文本视图CtrlT带时间戳视图CtrlL看译文。导出支持 TXT、SRT、VTT 等格式导出按钮在结果区右上角还能设置默认导出文件名模板。用法二实时录音转写开会、听讲座不想回头整理录音可以让 Buzz 边录边出字按CtrlR打开录音窗口选输入设备麦克风选语言并挑一个响应快的模型Base 或 Small实时场景速度比准确率更要紧选转录模式追加在下方新句排末尾、追加在上方新句排最前直播字幕常用、追加并修正会回头纠正上一句的错字比较吃算力点录制文字实时刷出来。结果说明开启「Live transcript exports」后实时文字还会同步导出成文本文件方便投屏或接入 OBS 等工具官方录音模式说明见 docs/docs/usage/2_live_recording.md。用法三导出字幕并调整长度转出来的句子有时太短碎、有时又太长Buzz 内置字幕重排功能把句子合并、重切成适合当字幕的长度在结果区打开「调整」面板设定每行目标长度它按时间间隔规则把短句合并、长句拆开直接导出 SRT/VTT 就是可用的字幕文件。合并规则想自定义可用环境变量BUZZ_MERGE_REGROUP_RULE指定 regroup 规则。另外项目自带一批插件buzz/plugins/目录下比如 AI 摘要、说话人分离、导出 Word、按语言智能检测可在偏好窗口的插件页单独启用和配置见 docs/docs/usage/7_plugins.md。四、进阶调优环境变量与快捷键一些高级选项不放在偏好界面里而是通过环境变量控制。Linux/macOS 写个启动脚本最省事#!/bin/bash export BUZZ_WHISPERCPP_N_THREADS8 export BUZZ_FAVORITE_LANGUAGESzh,en,ja buzz常用变量一览变量作用BUZZ_WHISPERCPP_N_THREADSWhisper.cpp 线程数默认 CPU 核心数的一半16 线程笔记本设成 8 可提速约 15%再往上反而变慢BUZZ_FAVORITE_LANGUAGES逗号分隔的语言代码置顶显示如zh,en,jaBUZZ_FORCE_CPU设为true强制走 CPU老显卡比 CPU 慢或出问题时用BUZZ_REDUCE_GPU_MEMORY设为true用 8bit 量化压缩模型省显存BUZZ_MODEL_ROOT指定模型存放目录换盘放模型时设它BUZZ_PARAGRAPH_SPLIT_TIME导出纯文本时按多长静音切段默认 2000 毫秒BUZZ_DISABLE_UPDATE_CHECK/BUZZ_DISABLE_TELEMETRY设为true关闭更新检查和基础使用统计快捷键内置的一批都覆盖高频操作完整定义在 buzz/settings/shortcut.py快捷键操作CtrlO导入音频文件CtrlU导入视频网址CtrlR打开录音窗口CtrlX取消当前转录CtrlS清空任务历史CtrlP播放/暂停音频CtrlG跳到当前播放位置CtrlF在转录文本中搜索CtrlE/CtrlT/CtrlL切换纯文本 / 时间戳 / 译文视图所有快捷键都能在偏好窗口的快捷键编辑页里改成自己顺手的组合完整变量清单见 docs/docs/preferences.md。五、踩坑与自救现象 → 处理办法现象处理办法转得太慢换小一号的模型Small→Base调BUZZ_WHISPERCPP_N_THREADS到核心数一半左右关掉吃 CPU 的其他程序模型下载中断 / 加载失败到偏好窗口删掉这个模型重新下磁盘满了就设BUZZ_MODEL_ROOT换个目录长音频卡住、显存爆掉开「Reduce GPU RAM」或设BUZZ_REDUCE_GPU_MEMORYtrue实在不行把长音频手动切段分别转GPU 报错、驱动冲突设BUZZ_FORCE_CPUtrue强制 CPU 模式慢一点但稳语言列表太长找不到用BUZZ_FAVORITE_LANGUAGES把常用语言置顶实时转录跟不上说话速度实时场景别用 Medium/Large换 Small 或 Base六、最短上手路径装好后先丢一段 1–2 分钟的短音频模型选 Base 跑一遍确认流程通了再去挑大模型处理正式素材——这样既能验证安装没问题也能对速度有个预期。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表