
30分钟本地跑通AI数字人视频生成Duix.Avatar完整实操指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款真正开源的数字人项目支持全离线本地AI视频生成。上传一段10秒左右视频即可完成形象与声音克隆输入文案自动生成口型同步的口播视频。它解决的是商用数字人服务要联网、按条收费、数据不归你的问题。快速起步Duix.Avatar 本地部署步骤先确认硬件英伟达显卡并装好驱动、32G 内存、100G 以上空闲硬盘首次拉镜像约 70G。获取源码# 克隆源码 git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar启动服务端Docker 是一种把软件打包成镜像一键部署的工具首次拉取三个镜像约半小时cd deploy docker-compose up -dLinux 用户改用docker-compose-linux.yml文件就在 deploy 目录下。安装客户端依赖并启动# 需要 Node.js 18 npm install npm run dev客户端启动后确认 Docker 里 asr语音识别、tts语音合成、视频合成三个服务都是 Running就可以开始用了。核心能力拆解上传一段10秒视频克隆形象与声音上传一段你自己出镜说话的短视频程序会自动提取面部形象和声音完成双重克隆不用单独拍照片或录干声。适合自媒体账号先立一个出镜人设录一次之后所有口播视频都能复用这个形象。输入文案自动生成口型同步口播视频把文案粘贴进客户端或直接上传音频文件就能产出口型对齐的成片内置语音合成支持中、英、日等八种语言。做产品讲解、课程口播这类内容时改一版脚本就能重新出一版视频不用重拍。开放API搭建自定义数字人应用Docker 启动后服务端会在本地端口暴露模特训练、音频合成、视频合成三类接口脚本可以直接调用。想把数字人嵌进内部系统、或用程序批量出片的话接口封装都写在 src/main/service/ 里照着改就行。真实场景落地 自媒体与电商口播替代成本高的真人出镜拍摄。做法先创建模特之后每次只改文案即可批量产出新视频。多语言内容出海同一个形象、同一份脚本产出中、英、日等八种语言版本。做法生成时切换文案语言声音沿用克隆的原声音色。企业内网私有化部署内部培训、合规演示等场景数据全程不出设备。做法在公司内网的 GPU 服务器上部署服务端再通过开放 API 对接现有业务系统。新手避坑指南 ⚙️拉镜像超时request canceled / Client.Timeout现象docker-compose up -d之后三个服务都拉不下来。原因国内网络连 Docker Hub 官方源不稳定。解法在 Docker Desktop 的 Settings → Docker Engine 里给registry-mirrors加上国内镜像源保存后重启 Docker再重新拉一次。刚启动就建模特报 Connection refused现象服务端刚跑起来点创建模特直接报连接被拒。原因ASR语音识别服务启动慢16G 内存的机器可能起不来。解法等三个服务都 Running 后再等几分钟再操作内存不够就先升 32G。排查时点开对应容器看日志右侧有复制按钮。上传了视频却建不了模特现象新增模特时报错创建失败。原因上传的视频没有声音或不是人在说话——克隆需要这段声音做声纹样本。解法重录一段 10 秒左右、人声清晰出镜的视频再传。从克隆到成片Duix.Avatar 把整条数字人生产线搬进你自己的电脑全流程离线开源协议支持全球免费商用。有英伟达显卡的话今天就能出第一条口播视频。卡住的话先翻 doc/常见问题.md服务端接口的实现都在 src/main/service/ 下照着看比猜快。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考