
Duix.Avatar 本地部署完整指南10 秒视频克隆 AI 数字人离线生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是 Duix.com 开源的 AI 数字人本地部署工具上传一段 10 秒左右的说话视频克隆你的形象和声音之后输入文案即可在本机离线生成口播视频省去商业数字人服务的费用与数据上传环节。 它能干什么五个能力覆盖了从克隆到成片的主要环节形象声音克隆10 秒视频生成数字分身文案驱动口型文字转语音自动对口型全离线运行素材和成片不出本机8 种语言文案中英日韩法德阿西多模型管理多个数字人一键导入切换 快速跑起来数字人本地部署环境要求与步骤先确认硬件达标再装 Docker下载镜像约需半小时。硬件与系统要求项目最低建议操作系统Windows 1019042.1526 及以上或 Ubuntu 22.04系统保持更新显卡NVIDIA 独显且驱动装好RTX 4070内存16GBASR 服务可能起不来32GB磁盘D 盘空闲 30GB C 盘空闲 100GB100GB 以上镜像位置可迁移部署步骤Windows验证显卡驱动运行下面命令出现显卡型号和驱动版本即通过没通过就先装好 NVIDIA 驱动再继续。本项目全部算力在本地 GPU这一步是硬性前提。nvidia-smi安装 WSLwsl --list --verbose检查是否已装 WSL没有则执行安装并更新完成后能看到 WSL 发行版列表。wsl --install wsl --update安装 Docker Desktop从 Docker 官网下载 Windows 版首次启动接受协议、跳过登录出现 Docker 托盘图标即成功。迁移镜像存储位置可选在 Docker Desktop 的设置里把 Disk image location 改到剩余空间大于 100GB 的磁盘点 Apply restart避免 C 盘被镜像占满。克隆仓库git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar启动服务端进入 deploy 目录执行下面命令首次会拉取约 70GB 镜像耗时半小时左右。看到 Docker 里 3 个容器处于 Running 状态duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video即部署成功。cd deploy docker-compose up -d想省资源可改用 lite 版docker-compose -f docker-compose-lite.yml up -d此时只有一个 gen-video 服务NVIDIA 50 系显卡30/40 系 CUDA 12.8 也可改用docker-compose -f docker-compose-5090.yml up -d。安装客户端到项目 Releases 页下载 Windows 安装包Duix.Avatar-x.x.x-setup.exe双击安装Ubuntu 用户下载Duix.Avatar-x.x.x.AppImage双击即可运行root 用户需加--no-sandbox参数。Ubuntu 22.04 用户先装 Docker 与 NVIDIA Container Toolkit再用对应文件启动服务端cd deploy docker-compose -f docker-compose-linux.yml up -d 从输入到产出10 秒视频到第一条数字人口播视频服务端跑起来后客户端四步出片。准备素材录一段 10 秒左右、人物正对镜头清晰说话的视频光线均匀、背景干净。视频里必须有清晰的说话声系统靠它做声音克隆纯画面素材会直接报错。创建数字人打开客户端点右上角 Create Avatar 上传视频。系统分析面部特征和声音特征完成后模型出现在 My Avatars 列表。输入文案点 Create Video 选择刚建好的模型输入口播文案——支持中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语共 8 种语言——也可以直接上传一段音频。等待生成点生成按钮几分钟内得到成片作品自动进入 My Works 列表可以直接播放或保存。 排错手册数字人本地部署常见问题对照部署和生成阶段的问题大多集中在这几类现象可能原因解决办法docker-compose up -d拉镜像超时网络连 Docker Hub 不稳定配置国内镜像源或代理方法见 常见问题文档三个服务起不来或反复重启没有 NVIDIA 显卡或驱动没装好用nvidia-smi验证驱动装好后重新docker-compose up -d创建模特报 Connection refused / file not existsASR 服务启动慢或内存只有 16GB服务端启动后等几分钟再操作内存建议 32GB新增模特提示无人脸或无声音素材视频里没有人说话换一段 10 秒左右、人物清晰说话的视频客户端报错信息看不懂需要日志定位设置菜单点 Open Log 看客户端日志点开 Docker 服务点 Logs 复制服务端日志适合谁用三类场景用得最顺自媒体创作者不用真人出镜也能保持稳定的口播更新频率。企业与教育机构产品介绍、课程讲解等标准化视频可以反复批量出。有 NVIDIA 显卡、在意数据隐私的个人素材和成片全程留在本机。给开发者三个 Docker 容器各管一段都只监听 127.0.0.1fun-asr 负责语音识别端口 10095fish-speech 负责语音合成端口 18180duix.avatar 负责视频合成端口 8383。客户端的完整调用链——视频拆分、声音克隆预处理、TTS 合成、视频提交与进度查询——可以直接参考 src/main/service/model.js、src/main/service/video.js、src/main/service/voice.js。项目支持全球免费商用用户量超 10 万或年营收超 1000 万美元的企业需签署商业许可协议条款见 LICENSE。整套流程跑通后你得到的是一台不出内网、不限次数的数字人视频生产线。部署细节、API 参数与许可条款都写在 README_zh.md 里建议留着备用。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考