
Duix.Avatar 数字人完整部署教程10秒视频克隆形象离线生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar每天对着镜头念同一份教程脚本录到第五遍嗓子就哑了。Duix.Avatar 数字人用一段 10 秒左右的说话视频就能克隆你的形象和声音之后输入文案即可离线生成口播视频全程不经过外网。这篇按自查→部署→跑通→排障的顺序带你走完每一步都标了预期结果。一、适配性判断输入、输出与硬件门槛先对一遍决定你需不需要装的是三件事给什么、得什么、机器够不够。先对下表项目要求 / 说明输入一段约 10 秒的真人说话视频单人出镜、面部无遮挡、有清晰人声输出形象口型与音频逐字对齐的口播视频本地渲染显卡NVIDIA 显卡 最新驱动硬性要求没有则服务起不来内存32GB 及以上文档标注必要16GB 时 ASR 服务可能起不来磁盘WindowsC 盘 100GB 空闲存 Docker 镜像D 盘 30GB 存数字人数据系统Windows 10 19042 以上或 Ubuntu 22.04 桌面版它不能做的事也要先说清不做实时互动产物永远是渲染好的视频不是能对话的窗口所有算力在本地 GPU 上没有 NVIDIA 显卡时三个 Docker 服务都启动不了克隆出的形象只能保持原片姿态不能换背景、不能换服装。图Duix.Avatar 数字人的部署流程图从服务端镜像、Docker 服务到客户端安装的完整路径二、部署前环境自查五项清单逐条过部署失败的案例里八成栽在这一步。逐条打勾缺哪项补哪项系统版本满足上表要求磁盘余量达标C 盘 100G / D 盘 30GWindowsNVIDIA 驱动已装好内存 32GB 及以上Docker 已装Windows 用户还需 WSL2Windows 里跑 Linux 的子环境Docker Desktop 依赖它需要跑的命令就三条每条都告诉你正常输出长什么样# 查看是否装过WSL列出发行版且VERSION为2即正常没有则先执行 wsl --install wsl --list --verbose # 已有WSL时执行更新内核看到已更新/已是最新即正常 wsl --update# 检查显卡驱动看到显卡型号、驱动版本和显存占用即正常报错则先装驱动 nvidia-smi图Docker Desktop 资源设置界面可在 WSL2 引擎选项里把虚拟磁盘换到剩余空间超过 100G 的分区三、部署实操拉代码、起服务端、装客户端按顺序走第 1 步拉代码。预期结果本地出现deploy目录里面有docker-compose.yml、docker-compose-lite.yml等配置文件。# 克隆仓库并进入部署目录 git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy第 2 步起服务端。完整版和轻量版二选一预期结果相同——容器进入 Running# 完整版起 TTS、ASR、视频合成三个服务 docker-compose up -d # 轻量版只起视频合成服务配音音频需自己上传 docker-compose -f docker-compose-lite.yml up -d首次拉镜像约 70G 流量耗时长达半小时建议连 WiFi。跑完执行docker ps看到 3 个容器轻量版 1 个均为 Running 状态即成功。两个分支注意NVIDIA 50 系列或 cuda 12.8 的 30/40 系列改用docker-compose -f docker-compose-5090.yml up -dUbuntu 用户改用docker-compose-linux.yml。图Docker 中 Duix.Avatar 的 TTS、ASR、gen-video 三个服务全部 Running部署成功的判定标准第 3 步装客户端。Windows 双击Duix.Avatar-x.x.x-setup.exe安装即可Ubuntu 双击Duix.Avatar-x.x.x.AppImage运行root 用户下直接双击起不来时到终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox。第 4 步打开界面。预期结果首页出现创建模型和创建视频两个入口且能列出已建模型——能列出来说明客户端已连上本地服务端。四、第一次生成最小路径只走最短链路第一次别碰任何高级设置只走这两步创建模型起一个名字上传 10 秒说话视频坐姿或站姿均可画面里只有一张人脸、五官没遮挡。提交后系统会同时完成形象克隆和声音克隆耐心等它跑完。⚠️ 服务端刚拉起时 ASR 加载慢建议服务 Running 几分钟后再提交克隆。创建视频左侧模特列表默认选中刚建好的模型不用动右侧文本框贴入文案或改传一段音频文件其余参数全部保持默认点生成。生成结束后视频进入作品列表可在线播放。整条链路里唯一要盯的失败点文案为空或没选模特时会直接弹提示按提示补上即可。五、报错急救包高频问题的定位与解法出问题时先拿日志客户端在设置里看日志服务端在 Docker 容器页点进服务选中日志区域点复制。图Docker 容器中 Duix.Avatar-tts 服务的日志页红框标出可复制的报错日志区域用于定位服务端异常1. 镜像下载超时现象docker-compose up -d报registry-1.docker.io ... request canceled。 定位Docker Hub 官方源连不上属网络问题不是配置错。 解法Docker 设置里编辑daemon.json加入registry-mirrors国内镜像源重启 Docker 后重新up -d。2. 服务起不来或反复重启现象容器状态是 Restarting或客户端里全功能点不动。 定位先跑nvidia-smi确认驱动再看内存16GB 机器上 ASR 服务大概率拉不起来常见问题 中已确认。 解法补驱动、升内存到 32GB或先切轻量版只跑视频合成。3. 创建形象报 Connection refused现象提交克隆后日志出现Connection refused。 定位ASR 服务刚启动还在加载不是坏了。 解法等几分钟再提交一次。4. 显存不足现象gen-video 服务日志报 OOM长视频任务中途失败。 定位compose 文件已固定shm_size: 8g和max_split_size_mb:512剩余空间看你的显卡显存。 解法调低输出分辨率、关掉占显存的后台程序50 系列显卡改用 5090 版 compose。六、落地场景速览三个已验证的用法自媒体口播日更、产品讲解类视频批量生成文案换一版出一条省去出镜和后期对口型企业培训同一课程录一次之后换文案就能出新版本讲师不再反复进棚多语言播报脚本支持中、英、日、韩、法、德、阿拉伯、西八种语言同一形象可做多语版本。先跑通轻量版再补完整版 TTS。更多细节见 常见问题。Duix.Avatar 是支持本地离线部署的 AI 数字人克隆工具。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考