Duix.Avatar本地部署指南:一段10秒视频,跑通数字人克隆与口播视频生成 Duix.Avatar本地部署指南一段10秒视频跑通数字人克隆与口播视频生成【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一个本地运行的开源数字人项目核心功能是数字人克隆和口播视频生成。只需一段10秒左右、本人清晰说话的视频就能克隆形象和声音之后输入文字即可自动合成口型匹配的口播视频。本文面向首次接触它的 Windows 或 Ubuntu 用户带你按最小路径完成一次可验证的本地运行部署服务端、创建第一个数字人、生成第一条视频。开始之前用3分钟判断它是否适合你它适合谁想在本地把文生口播视频跑通一次、验证效果的人有 NVIDIA 显卡、对 Docker 有基本概念不认识也没关系照着命令走即可的普通用户不希望视频素材离开自己机器的内容创作者它不太适合谁只有集成显卡或 Apple Silicon Mac 的机器项目当前依赖 NVIDIA GPU 算力其他平台暂未适配期望零硬件投入直接出效果的人首次部署需要下载数十 GB 的服务镜像最低运行条件系统Windows 1019042.1526 或更高或 Ubuntu 22.04 Desktop显卡NVIDIA 显卡并已装好驱动。推荐配置参考项目给出的 i5-13400F 32GB 内存 RTX 4070 组合内存32GB 及以上项目 README 将 32G 标注为必要项根据 doc/常见问题.md 的说法16GB 机器可能出现 ASR 服务起不来的情况磁盘Windows 下 C 盘留 100GB 以上给 Docker 镜像、D 盘留 30GB 以上存数据服务约定使用d:/duix_avatar_data目录首次拉取镜像约消耗 70GB 左右流量网络只有拉取镜像阶段需要联网服务跑起来后的克隆与生成过程在本地完成最小部署目标不是装完而是跑通一次这一步只做三件事拿代码、启动服务端、确认服务在跑。客户端安装放到下一节再做。第一步拿到项目代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar第二步准备运行环境Windows 用户先确认 WSL 可用没有的话会装不上 Docker Desktop两条命令各有一个用途wsl --list --verbose # 查看是否已安装 WSL wsl --update # 没有或版本旧时执行更新然后从 Docker 官网安装 Docker Desktop首次启动时接受协议、跳过登录即可。Ubuntu 用户确认 Docker 已安装没有的话按官方方式装docker.io与docker-compose并额外安装 NVIDIA Container ToolkitDocker 调用 GPU 的必需组件docker --version # 检查 Docker 是否已安装 sudo apt-get install -y nvidia-container-toolkit sudo nvidia-ctk runtime configure --runtimedocker sudo systemctl restart docker第三步在 deploy/ 目录启动服务端deploy/ 目录下针对不同系统准备了 compose 文件按系统选择其中一条执行即可# Windows完整三服务版本 cd deploy docker-compose up -d # Ubuntu 22.04 cd deploy docker-compose -f docker-compose-linux.yml up -d另外两个变体按需使用NVIDIA 50 系显卡如 5090用docker-compose -f docker-compose-5090.yml up -d显存较小的机器可以试 lite 版本docker-compose -f docker-compose-lite.yml up -d只有一个视频合成服务。首次启动需要拉取三个镜像通常约 30 分钟具体取决于网速。启动成功后你会在 Docker 中看到三个容器处于 Running 状态分别负责语音合成TTS端口 18180、语音识别ASR端口 10095和视频合成端口 8383。可以用下面的命令核对docker ps第一次产出怎样判断结果可用服务端跑起来后安装对应系统的客户端安装包Windows 是.exe安装包Ubuntu 是.AppImage从项目发布页下载即可。如果是用 root 进入的 Ubuntu 桌面命令行执行时加上--no-sandbox参数启动。接下来走一遍最小成功闭环录一段 10–20 秒的视频本人在画面中清晰说话、光线均匀、背景简单。这段视频必须有人声程序要用它做声音克隆静音视频会直接失败。打开客户端点击创建数字人Create Avatar上传这段视频等待分析完成几分钟量级。到 My Avatars 列表确认新模型已出现选中它。输入一段文案脚本支持中、英、日、韩、法、德、阿拉伯、西 8 种语言点击生成。到 My Works 列表找到新视频并播放。看到以下结果说明本地链路是通的My Avatars 中出现新模型缩略图代表克隆训练成功My Works 中出现可播放的新视频代表合成任务完成播放时口型与语音节奏基本对得上不是逐帧精准但能对齐到句级视频中的音色与素材视频里的人声相近客户端界面没有出现报错弹窗如果失败下一节按现象反查遇到问题从现象反查原因不要一上来翻全部日志先按现象 → 可能原因 → 检查动作定位。新手最容易卡住的三类问题如下。现象1docker-compose up -d 报 request canceled / context canceled可能原因拉取镜像时连不上 Docker Hub 官方源属于网络问题不是配置错误。检查动作给 Docker 配置镜像加速。Windows 在 Docker Desktop 的 Settings → Docker Engine 里给 JSON 加上registry-mirrors数组Apply restartUbuntu 编辑/etc/docker/daemon.json后重启 Docker 服务。具体可用的镜像源地址随时间变化建议以 doc/常见问题.md 中列出的为准现象2服务起不来或容器反复重启可能原因本机没有 NVIDIA 显卡、驱动没装好或 Docker 没有被授权调用 GPU内存不足也是已知原因16GB 内存机器上 ASR 服务可能起不来。检查动作nvidia-smi # Ubuntu 下确认显卡和驱动正常Windows 在设备管理器中查看 docker ps -a # 看哪个容器没起来点开它的 Logs 找最后一行报错确认 Ubuntu 上 NVIDIA Container Toolkit 已安装并完成nvidia-ctk runtime configure配置。如果显卡和驱动都没问题但仍起不来优先核对内存是否达到 32GB。现象3创建数字人时报 Connection refused或提示找不到音频文件可能原因ASR 服务冷启动较慢服务刚起来几分钟内就发起克隆请求会连不上另一种常见原因是素材视频里没有人声。检查动作等三个容器全部 Running 后等几分钟再重试创建确认上传的视频里本人确实在清晰说话。如果 TTS 容器日志里反复出现file not exists检查数据目录挂载路径是否与 compose 文件约定一致从可用到好用把它接入你的真实工作跑通一次之后下面这些用法都不需要额外部署换文案即可。固定形象的口播内容为一个账号或产品介绍创建固定的数字人形象之后每条视频只替换文案形象与音色保持一致适合批量出片。教学与内部演示把讲师形象固定下来录课内容更新时直接生成新版讲解视频省去反复拍摄。多语言内容复用同一段内容用不同语言脚本再生成几版8 种语言都能跑适合一份内容多地区分发。接入自动化流程Docker 服务在本地暴露了可直接调用的接口——模型训练http://127.0.0.1:18180/v1/preprocess_and_tran、音频合成http://127.0.0.1:18180/v1/invoke、视频合成http://127.0.0.1:8383/easy/submit、进度查询http://127.0.0.1:8383/easy/query。参数格式可参考 src/main/service/ 下的 model.js、video.js、voice.js按自己的工作流封装脚本即可。下一步给新手的行动清单先对照上文检查显卡驱动和磁盘空间两项不满足就先补别急着拉镜像在 deploy/ 目录执行 compose 命令等docker ps显示三个容器全部 Running用一段 10 秒、本人清晰说话的视频创建第一个数字人生成一条 30 秒左右的口播视频逐项对照成功判断点验收全链路通过后再决定是批量出片还是接 API 自动化先完成一次本地验证确认效果符合预期再考虑扩展到真实业务里。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考