
FunASR 离线本地音频转写实战一条命令装好完整部署流程【免费下载链接】FunASROpen-source speech recognition toolkit for training, inference, streaming ASR, VAD, punctuation, speaker diarization pipelines, and OpenAI-compatible/MCP serving.项目地址: https://gitcode.com/GitHub_Trending/fun/FunASR客服录音质检、会议纪要归档这类业务里音频往往不能离开内网企业云上的 ASR 接口直接就被排除了。FunASR 是达摩院开源的语音识别工具包它的 runtime 把识别模型、VAD判断哪段有人在说话、标点补全三件事打包进一个 Docker 容器全程只在你自己的机器上跑一条命令装好、一条命令出文本不依赖任何云端服务。上手前要备好的两样东西结论很简单一台装了 Docker、能连外网的机器就够了不需要 GPU。Docker整套服务跑在容器里安装脚本会自动帮你拉镜像。Windows 上用 Docker Desktop开启 WSL2 后端服务器上直接用原生 Docker。Python 3.8只有客户端跑转写命令时才用到它。网络与磁盘脚本要下载镜像和 ASR/VAD/标点三个模型预留至少 10GB 空间下载过程带进度条。装好服务并确认它活着跑一条安装命令服务就会在 10095 端口上待命。先拿到源码并进入部署目录git clone https://gitcode.com/GitHub_Trending/fun/FunASR cd FunASR/runtime/deploy_tools接着执行离线中文转写的安装命令它一次完成拉镜像、下模型、起容器三件事sudo bash funasr-runtime-deploy-offline-cpu-zh.sh install终端出现The service has been started.就装好了。默认监听 10095 端口并且自带 SSL 加密自签证书。验证是否存活在任意客户端机器上敲curl -k https://127.0.0.1:10095拿到HTTP/1.1 200或收到 WebSocket 握手响应说明服务正常-k的作用是跳过自签证书的校验。之后日常运维用start、stop、restart子命令管理容器--show可以查看当前全部配置。第一次转写从单文件到批量客户端就是一个 Python 脚本--mode offline指整段识别精度最高。先在客户端装依赖要处理 mp3、m4a 这类非 wav 格式先装 FFmpegcd runtime/python/websocket pip install -r requirements_client.txt转写单个文件python funasr_wss_client.py --host 127.0.0.1 --port 10095 \ --mode offline --audio_in ./meeting.wav --output_dir ./out--mode共三种写法offline整段识别最准online流式识别边说边出字但精度略低2pass先用流式出草稿再整段修正。结果会以 json 落在--output_dir里终端同时实时打印识别文本。批量场景把--audio_in指向一个 wav.scp 文件每行写标签 路径一次跑完一整个目录的录音meeting_01 /data/audio/meeting01.mp3 call_02 /data/audio/call02.wav两个实战中常用的开关--hotword传入热词文件每行词 权重用来抬升专业术语的召回--use_itn 0关闭数字归一化避免一百二十三被自动还原成123。不想敲命令时把runtime/html5/static/index.html用浏览器打开填好地址和端口即可直接上传文件或点麦克风转写。生产调优四个必知的调整点结论全部通过update子命令修改再restart让新容器生效改动不会作用于正在跑的进程。线程数--decode_thread_num控制解码线程--io_thread_num控制 IO 线程。起步值按 CPU 核心数的四分之一到二分之一给16 核机器可从 8/4 开始压测调优。模型替换--asr_model可填其他模型 ID 或本地路径行业专用模型可对照 model_zoo/modelscope_models.md 的清单挑选。热词维护在 workspace 下维护一份 hotwords.txt每次请求经--hotword传入术语库随业务更新即可。SSL 与端口--ssl 0关闭加密仅限内网环境使用--host_port 10096换端口。改线程等配置前先stop再执行updaterestart顺序反了改动不会生效。接下来能做什么这套一键脚本 WebSocket 客户端的组合适合对数据出网敏感的业务客服录音质检、会议纪要归档、庭审与访谈转写都能在自己的机器上闭环。想深入服务细节读 runtime/quick_start.md想看更多模型的训练与推理示例去 examples/ 目录翻。【免费下载链接】FunASROpen-source speech recognition toolkit for training, inference, streaming ASR, VAD, punctuation, speaker diarization pipelines, and OpenAI-compatible/MCP serving.项目地址: https://gitcode.com/GitHub_Trending/fun/FunASR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考