ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Duix.Avatar本地部署教程:三步跑通免费AI数字人视频生成

Duix.Avatar本地部署教程:三步跑通免费AI数字人视频生成 Duix.Avatar本地部署教程三步跑通免费AI数字人视频生成【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款可本地部署的开源 AI 数字人项目提交一段 10 秒左右的视频即可克隆你的形象和声音之后输入文案或上传音频就能自动生成口播视频全程离线、数据不出本机。这份数字人本地部署教程从环境核对讲起带你在 Windows 或 Ubuntu 上完成部署、做出第一条视频并附常见问题对照表。 一句话看懂开源AI数字人项目Duix.Avatar是什么传统数字人方案要么贵、要么依赖云端Duix.Avatar 把形象克隆、声音克隆和视频合成整套能力做成 Docker 镜像跑在你自己的显卡上。它支持中英文等 8 种语言脚本克隆、驱动、成片三步都在本地完成。和传统方案放在一起看差别更直观维度传统 3D 数字人Duix.Avatar制作成本数万美元级千元级以内软件本身开源免费部署方式依赖厂商/云端服务Docker 一键本地部署完全离线授权按年付费支持全球免费商用多语言因厂商而异中/英/日/韩/法/德/阿拉伯/西语共 8 种 部署前准备本地部署环境核对表开工前先把这张表过一遍硬件一项都不满足就会卡在容器启动阶段。Windows 用户额外注意C 盘放镜像、D 盘放数据两个盘的空间都要留够。项目最低要求推荐配置显卡NVIDIA 显卡 正确安装驱动必须RTX 4070内存8GB 起32GB 及以上磁盘WindowsC 盘 100GB镜像 D 盘 30GB数据Linux空闲 100GB预留更多给作品存储CPU无硬性要求第 13 代 Intel Core i5-13400F 或更高操作系统Windows 10 19042.1526 / Ubuntu 22.04 Desktop同左DockerDocker DesktopWindows基于 WSL2/ Docker EngineLinux保持最新版Node.js18仅客户端二次开发需要LTS 版本 从零到跑通本地部署三步走第一步拉取项目源码打开终端克隆仓库到本地git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar拉完先花 10 秒检查 Docker 的镜像盘位置确认所在磁盘有 100GB 以上空闲空间不足时可以在设置里把 Disk image location 挪到大盘上避免下载中途爆盘。第二步启动服务容器进入deploy/目录配置文件都在这里执行cd deploy docker-compose up -d只要视频生成服务、不需要语音合成和识别的话用轻量版更省资源docker-compose -f docker-compose-lite.yml up -d首次启动会自动下载约 70GB 镜像耗时 30 分钟左右建议连 WiFi 或走内网耐心等待中途不要断电。下载完成后在 Docker 里应看到三个 Running 状态的服务duix-avatar-tts语音合成、duix-avatar-asr语音识别、duix-avatar-gen-video视频生成lite 版则只有duix-avatar-gen-video一个。第三步安装客户端Windows到项目发布页下载最新的Duix.Avatar-x.x.x-setup.exe双击按向导装完即可。Ubuntu下载 Linux 版Duix.Avatar-x.x.x.AppImage先chmod x赋予执行权限再以./Duix.Avatar-x.x.x.AppImage --no-sandbox启动root 用户下必须加--no-sandbox。启动后就是下面的主界面左侧是 Home顶部两张大卡片分别对应Create Video生成视频和Create Avatar创建数字人。 实战做出你的第一条数字人视频创建数字人形象点 Create Avatar上传一段 10 秒左右的视频画面中人物正对镜头、面部清晰、有正常说话的口型变化。系统会自动做面部特征提取和模型训练完成后新的数字分身会出现在 My Avatars 列表里随时可以取用。拍摄建议决定克隆上限光线均匀柔和、背景为单一颜色、表情自然并带适度头部动作、面部清晰无遮挡。素材质量比模型参数更影响最终效果。语音克隆与合成把采集的语音文件放进D:\duix_avatar_data\voice\dataWindows 约定路径可在 docker-compose 中修改再通过http://127.0.0.1:18180/v1/invoke接口合成语音。请求里可以调节音调、语速等参数做出贴近原声又带点个性化的音色。文本驱动 vs 语音驱动选好数字人后进入 Create Video 就有两种驱动方式模式你提供什么系统做什么适合场景文本驱动一段文字文案8 种语言自动合成语音并驱动口型快速口播、多语言播报语音驱动音频文件解析节奏、语调后同步嘴型需要情感演绎的解说文本驱动胜在快语音驱动胜在自然。生成完成后成片会出现在 My Works 中数字人模型则沉淀在下方列表里反复使用。⚙️ 进阶API 集成与性能调优Docker 启动后会在本机暴露三个端口都可以直接http://127.0.0.1调用参考实现见 src/main/service/model.js、video.js、voice.js服务端口职责duix-avatar-tts18180语音合成TTSduix-avatar-asr10095语音识别ASRduix-avatar-gen-video8383视频合成口型驱动想跳过界面直接批量出片最常用的是视频合成接口// 提交视频合成任务 await axios.post(http://127.0.0.1:8383/easy/submit, { audio_url: audioPath, // 音频路径 video_url: videoPath, // 视频路径 code: uuid, // 唯一任务标识 chaofen: 0, // 固定值 watermark_switch: 0, // 水印开关 pn: 1 // 固定值 }); // 轮询任务进度 await axios.get(http://127.0.0.1:8383/easy/query?code${taskCode});GPU 自检很简单终端跑一下nvidia-smi能正常回显卡信息说明驱动就绪三个容器全靠 GPU 算力没有 NVIDIA 显卡或服务起不来都属于环境问题而非配置问题。磁盘与缓存方面WindowsC 盘保持 100GB 给镜像数据都落D:\duix_avatar_data定期清理里面的临时文件。Linux把 Docker 数据目录挂到空间充足的分区避免默认盘写满。 故障排查本地数字人部署常见问题一览卡住时先按下表自查覆盖 90% 的求助场景症状常见原因解决方法服务启动失败、镜像拉取报错无法直连 Docker Hub、磁盘不足在 Docker Engine 配置registry-mirrors镜像加速检查磁盘剩余空间容器起来但 GPU 不可用驱动没装好 / 缺 NVIDIA Container Toolkitnvidia-smi验证驱动Linux 重装 Container Toolkit 并重启 Docker客户端连不上服务有服务不在 Running、端口被占确认 18180 / 10095 / 8383 可用docker logs duix-avatar-tts等命令看日志定位模型训练失败素材模糊、格式不对、显存不足换清晰 MP4 素材确认显存 8GB查训练日志看具体报错镜像拉取慢/失败时Docker Desktop 在 Settings → Docker Engine 的 JSON 里加registry-mirrors字段后点 Apply restart 即可生效排查服务端日志直接在 Docker 里点进对应容器的 Logs 页右键复制关键报错段更多场景的官方文档doc/常见问题.md。✅ 结尾Duix.Avatar 适合谁企业内部演示视频制作教育培训标准化课程个人口播与社媒短内容营销物料批量生成项目仍在快速迭代实时对话、多模态交互等能力在持续排期中。最后提醒一句尽量用 NVIDIA 显卡的设备跑体验最完整中途卡住了先翻 doc/常见问题.md 或去社区问一句多数问题都有人踩过。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表