ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Buzz 本地离线语音转文字:从导入到拿到字幕只需 3 步,99+ 语言免费

Buzz 本地离线语音转文字:从导入到拿到字幕只需 3 步,99+ 语言免费 Buzz 本地离线语音转文字从导入到拿到字幕只需 3 步99 语言免费【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz两小时的访谈录音还躺在硬盘里你想尽快转成文字又不愿把客户的声音传给任何云端服务。Buzz 是面向这种场景的桌面程序导入音频后它在你自己的电脑上用 OpenAI 的 Whisper 模型完成转录文件全程不出机器也不需要注册和订阅。它凭什么值得装先说得到的东西转写结果以 TXT、SRT、VTT 三种格式落盘录音内容不经过任何服务器敏感素材也能放心处理。功能上它同时覆盖三类需求——批量转写存量音视频、麦克风实时转录带演讲用的大屏展示窗口、给视频做字幕。语言方面Whisper 系列覆盖 99 种以上走 Hugging Face 后端还能选 Meta 的 MMS 模型族扩展到 1000 种以上语言。推理后端可选NVIDIA 显卡走 CUDA 加速Mac 走 Apple SiliconWhisper.cpp 还能用 Vulkan 跑集显。对自动化需求它提供命令行接口对个性化需求有插件系统AI 摘要、字幕自动调整等可按需装。MIT 协议免费。安装并跑通第一次转录安装本身不复杂三个平台各一句macOS 下载.dmg打开即用Windows 下载安装包提示未签名时点更多信息→仍要运行Linux 用 Snap 或 Flatpak 装sudo snap install buzz想在源码环境里跑需要先装好 FFmpeg 并准备 Python 3.12然后执行pip install buzz-captions用python -m buzz启动。第一次转录三步走完点工具栏号或菜单里的 Import Media File导入音频、视频文件也支持粘贴 YouTube 链接在任务行里选任务类型、语言和模型点 Run。模型首次使用会自动下载之后每次运行都是离线转录表格实时显示进度百分比状态变成 Completed 后双击该行打开转写查看器官方文档的建议是手动指定源语言自动语言检测偶尔会判断错显式选一个往往更稳。三种典型用法批量处理录音把十几个访谈或会议录音一次拖进主界面任务自动排队依次处理进度和状态在同一张表里看完完成后转写文件自动保存。多人对话、环境嘈杂的文件转录前勾上 Extract speech 做语音分离准确率会更稳。 会议与讲座的实时转录选好转录任务、语言和麦克风点 Record 就开始文字边说边出。实时转写对算力有要求文档建议这类场景优先选 Whisper.cpp 后端和小模型。说到一半想核对某句原话用转写查看器的搜索框CtrlF定位关键词拖进度条即可跳到那一秒对外演讲时可以切到演示窗口把转写内容放大投给听众。 给视频做字幕转录完成后进入转写查看器逐句校对改错字、用快捷键按 0.5 秒微调起止时间戳、最高 2 倍速快进复查。需要规范字幕长度时用 Resize 功能设定每条字幕的最大长度重新切分导出 SRT/VTT 后可以直接进剪辑软件。模型怎么选模型的管理入口在帮助 → 偏好设置 → 模型里可以下载新模型、删掉不用的也能看到模型在硬盘上的存放位置。模型速度精度表现硬件要求Tiny最快适合先出草稿基本无门槛Base快日常内容够用低Small中等速度和精度较均衡低Medium较慢精度更好中等Large最慢最高内存和算力要求高后端Whisper type决定跑得快不快四个常见选项Faster Whisper 给显存 6GB 以上的 NVIDIA 卡用比官方实现快一个量级且更省内存Whisper.cpp 是 C 实现任何品牌的 GPU 乃至纯 CPU 都能跑是 Mac 和实时场景的首选官方 Whisper 实现精度可靠但慢且吃内存Hugging Face 后端可以选针对特定语言优化的自定义模型MMS、Parakeet 等。Large 的几个版本要分清楚Large-V3 多数场景精度最高但偶尔会编造原音频里不存在的词句Large-V2 更稳Turbo 在速度和精度之间折中。官方 FAQ 的口径是没有通用答案用你自己的语言内容各测一遍最靠谱。几个容易踩的坑Q转录速度太慢先动哪里A先降模型规格Tiny/Base再换后端——N 卡换 Faster Whisper其他机器换 Whisper.cpp。这两步的收益通常比升级硬件大。Q转出来的文字里有原音频没有的内容ALarge-V3 的已知倾向换成 Large-V2 或 Turbo 一般就消失了。Q完全离线的机器能用吗A能。在有网的机器上把模型下好把缓存目录Linux 为~/.cache/BuzzmacOS 为~/Library/Caches/BuzzWindows 为%USERPROFILE%\AppData\Local\Buzz\Buzz\Cache原样拷到离线机器的相同位置。另外两个提醒CPU 需要支持 AVX2太老的机器会直接跑不起来如果 Buzz 崩溃优先怀疑模型下载不完整到偏好设置里删掉对应模型重新下载。上手前最后确认三件事确认完就可以开工CPU 支持 AVX2、知道模型缓存放哪崩溃时先清理重下、第一次跑之前留点时间等模型下载。Buzz 做的事很单一把 Whisper 的本地离线转录做成一个开箱即用的桌面程序录音不出门转录不花订阅费。官方文档安装指南 · 命令行用法 · 常见问题核心源码转录引擎 buzz/transcriber/ · 插件系统 buzz/plugins/【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表