本地跑通数字人视频:Duix.Avatar 用 10 秒视频克隆形象的完整教程 本地跑通数字人视频Duix.Avatar 用 10 秒视频克隆形象的完整教程【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一个完全本地部署的开源数字人项目。你只需提交一段 10 秒左右的真人视频它就能同时克隆出这个人的外貌和声音之后输入一段文案或上传任意音频数字人会自动对口型输出一条完整的口播视频。所有推理都跑在自己的显卡上全程离线素材不出本机——对课程录制、企业宣传、虚拟主播这类隐私敏感的场景来说这比云端 API 省心很多。先备齐硬件N 卡、32G 内存和 100G 硬盘这个项目对硬件比较挑装之前先对一下自己的配置NVIDIA 显卡 驱动必选所有算力走本地 CUDA没有 N 卡三个服务根本起不来内存 32G 及以上16G 内存机器连 ASR 服务都可能起不动硬盘Windows 用户 C 盘留 100G 存 Docker 镜像D 盘留 30G 存数字人和作品数据系统Windows 10 19042 以上或已验证适配的 Ubuntu 22.04驱动装好后跑一次nvidia-smi能显示显卡信息才算过关。Windows 机器还要先装好 WSL2wsl --install后wsl --update再装 Docker Desktop。装 Docker拉取三个推理服务服务端本质是三个 Docker 容器ASR语音识别、TTS声音克隆、视频合成。compose 文件都放在 deploy/ 目录里拉取镜像大约 70G 流量耐心等半小时左右。git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar进目录启动三个服务全部显示 Running 即成功cd Duix-Avatar/deploy docker-compose up -d显存紧张的机器可以换精简版只起视频合成一个服务docker-compose -f docker-compose-lite.yml up -d。Ubuntu 用户则用docker-compose -f docker-compose-linux.yml up -d。客户端不需要自己编译直接下官方 Release 安装包Windows 双击 exeLinux 直接跑 AppImage即可打开图形界面。克隆第一个数字人从一段视频到口播成片装完客户端后流程很短两步出片Create Avatar上传一段 10 秒左右的视频。注意素材必须是真人出镜、开口说话、有清晰人声的画面声音克隆和形象克隆靠的是同一段视频Create Video形象建好后输入文案内置 TTS 转语音或直接上传音频提交后系统自动完成口型对齐生成的视频会进入 My Works 列表脚本支持中、英、日、韩、法、德、阿拉伯、西语八种语言跨语种播报也没问题。常见报错速查镜像下载失败、Connection refused⚠️ 提问前先看这几个高频问题大部分都能自己对上docker-compose up -d报 request canceled / 超时Docker Hub 连不上在 Docker Desktop → Settings → Docker Engine 里加registry-mirrors国内镜像源改完 Apply restart 再拉新建模特直接报错九成是素材视频没有声音或不是人在说话换一段有清晰人声的素材重传定制模特报Connection refusedASR 服务启动慢服务端起来后等几分钟再操作内存不足 16G 也会卡在这一切异常的兜底排查确认三个容器都是 Running确认nvidia-smi正常再把服务端和客户端都升到最新版很多问题新版已经修掉排查时服务端日志直接点开对应容器的 Logs 页签关键报错行如下官方 FAQ 里还有完整示例进阶玩法换磁盘位置、50 系显卡与开放 APIC 盘空间不够时在 Docker Desktop → Settings → Resources → Advanced 里把 Disk image location 指到另一块盘需留 100G不用重装RTX 50 系列显卡用户走单独的 compose 文件基于 torch 预览版docker-compose -f docker-compose-5090.yml up -d。服务端启动后会在本地开放 HTTP 端口模特训练、音频合成、视频合成都有对应接口可以直接跳过客户端做批量调用或业务集成参数示例和返回结构都写在 README 的开放 API一节现成实现可参考 src/main/service/ 下的 model.js、video.js、voice.js。更多细节看 doc/常见问题.md。现在就可以把自己的那段 10 秒素材丢进去试试克隆效果了。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考