
Duix.Avatar 本地部署教程10 分钟跑通数字人视频生成【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款开源数字人工具上传一段约 10 秒的说话视频克隆出形象和声音之后输入文案就能离线生成口播视频全程不联网。本文按能跑起来的标准带你走完全流程并给出硬件门槛和排错清单。谁适合用它两个典型场景。内容创作者要批量产出讲解视频把固定文案喂给同一位数字模特不用反复拍摄。企业内部做培训或产品演示数据不能出内网Duix.Avatar 全程本地离线。判断标准很具体适合有 NVIDIA 显卡8GB 显存起步、要反复生成口播视频、素材涉及隐私不适合只有核显三个容器起不来只想用现成平台出 1 条片子直接用在线服务更快 10 分钟跑通从代码到第一条视频1. 获取代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar完成标志当前目录下能看到deploy、src两个文件夹。2. 准备显卡与 Docker先确认显卡可用nvidia-smi能打印出显卡型号和驱动版本即通过。资源档位8G 显存可跑建议 407012G 32G 内存16G 内存可能起不来 ASR 容器。Windows 需 WSL2 Docker Desktop执行wsl --install装 WSLC 盘留 100G 存镜像D 盘留 30G 存数据。3. 启动服务端cd deploy docker-compose up -d首次拉镜像约 70G耗时半小时上下建议连 WiFi。完成标志Docker 里duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个服务都是 Running。Ubuntu 22.04 改在 deploy/ 目录执行docker-compose -f docker-compose-linux.yml up -d前置是 NVIDIA 驱动和 Container Toolkit。50 系显卡30/40 系 cuda12.8 也可用docker-compose -f docker-compose-5090.yml up -d。4. 装客户端生成第一条视频客户端直接用官方安装包Windows 是 setup.exeUbuntu 是 AppImage双击启动。想从源码跑Node 18 环境执行npm install后npm run dev。进入界面后点快速定制上传 10 秒左右的正面说话视频等克隆完成再点创建视频输入文案并选择刚才的模特。完成后在我的作品里下载。第一条视频出现就算跑通。⚡ 原理速览三个容器各管一段声音克隆链路参考视频先被拆成画面和音频。音频由duix-avatar-asrfun-asr端口 10095转写成文字作为参照文本。合成时duix-avatar-ttsfish-speech端口 18180拿着参照音频和参照文本把你的新文案读成克隆音色的 wav。视频合成链路duix-avatar-gen-video端口 8383接收音频加模特视频做口型同步输出最终口播视频。任务提交后返回一个 code用它轮询进度直到完成。客户端角色客户端是 Electron 程序只负责界面和本地存储SQLite所有算力都在三个容器里。它本质是本地http://127.0.0.1上几个 API 的图形化封装。 排查高频报错症状docker-compose up -d报 connection error / timeout。原因连不上 Docker Hub。解法给/etc/docker/daemon.json加镜像源后重启 Docker{ registry-mirrors: [ https://docker.m.daocloud.io ] }症状三个服务起不来或反复重启。原因缺 NVIDIA 驱动或 Container Toolkit。解法跑nvidia-smi核对驱动Linux 补装 nvidia-container-toolkit 后执行sudo systemctl restart docker。症状克隆模特失败。原因上传的视频里没有清晰人声。解法换 10 秒左右、人物开口说话的素材重传程序要用这段声音做克隆。症状定制模特报 Connection refused。原因ASR 服务启动慢或内存只有 16G 导致容器没起来。解法等服务全部 Running 后等 2–3 分钟再操作内存不足先升到 32G。症状日志报错看不懂。原因信息分散在客户端和服务端。解法客户端日志在右上角设置菜单打开日志服务端日志在 Docker 容器日志页点复制按钮。 边界与扩展先说做不到的。口型效果是可用级追求影视级逼真不建议官方只验证了 Windows 10 19042 与 Ubuntu 22.04 桌面版其他 Linux 发行版未测商用时用户量超 10 万或年营收超 1000 万美元需签商业协议。两个进阶方向API 接入Docker 起好后本地接口已就绪TTS 18180、合成 8383调用示例在 src/main/service/ 的 model.js、video.js、voice.js可直接接入自己的批量流程精简部署显存紧张时跑 lite 版只起视频合成一个容器docker-compose -f docker-compose-lite.yml up -d语音克隆链路需自备外部 TTS下一步照10 分钟跑通一节先出第一条视频确认显卡与镜像都没问题。遇到报错按 doc/常见问题.md 的自查清单逐条核对。跑通后再试 API 方式把生成流程接进你自己的批量任务里。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考