三步快速跑通 Duix.Avatar:离线数字人视频生成部署指南 三步快速跑通 Duix.Avatar离线数字人视频生成部署指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar下午想出一条口播视频却不愿等云服务排队更不想把真人素材传到外部平台。Duix.Avatar 是全离线的开源数字人项目上传一段10 秒左右的视频即可克隆形象与声音输入文案就能自动产出口型匹配的视频算力全部在本地支持8 种语言、免费商用。✅ 它适合谁、不适合谁这个项目用本地 NVIDIA 显卡 32G 内存 约半小时首次等待换全离线、不限次、可商用的口播视频生产。批量产出数字人口播、且素材隐私敏感的人全流程离线素材不出机器想把数字人合成能力接进自家产品的开发者Docker 启动后在http://127.0.0.1开放合成与训练接口商用场景全球免费商用仅用户量超 10 万或年营收超 1000 万美元的企业需另签许可协议没有 NVIDIA 显卡、内存不足 32G 的机器以及需要实时交互数字人的需求本项目只做非实时视频合成不建议投入本地部署。 部署前最低配置核对表部署前把这张表核完后面 90% 的报错都与它有关。核对项最低要求备注系统Windows 10 19042.1526 或 Ubuntu 22.04 Desktop其他 Linux 版本未做兼容验证显卡NVIDIA 显卡且驱动装好缺卡或缺驱动服务起不来用nvidia-smi验证内存32G 及以上16G 可能导致 ASR语音识别服务起不来磁盘WindowsC 盘空闲 100GD 盘空闲 30GC 盘存镜像文件D 盘存数字人与作品数据运行环境DockerWindows 需先装 WSL首次启动自动拉取镜像约 70G 流量 三步跑通最小可用服务准备拉代码核对磁盘与显卡这步把代码和硬件就绪状态确认到位。git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar安装好 Docker 与 NVIDIA 驱动后运行nvidia-smi。完成标志命令正常打印显卡信息且磁盘空闲空间达到上表要求。启动一条命令拉起服务这步会自动下载镜像并启动服务耗时约半小时注意连 WiFi。cd deploy docker-compose up -d只需视频合成能力时改用docker-compose -f docker-compose-lite.yml up -d。完成标志Docker 中出现三个服务且均为 Running 状态Lite 版只有一个名为 duix-avatar-gen-video。验证打开客户端确认连接下载官方构建的安装包Windows 双击 exe 安装Ubuntu 直接运行 AppImage 文件。完成标志客户端首页正常显示My Works / My Avatars两个列表无连接报错。客户端首页上方是Create Video视频合成与数字人形象创建入口下方为My Works与My Avatars列表 资源占用与效果标准版拉三个容器Lite 版只留一个是否需要文字转语音环节是选择依据。对比维度标准版Lite 版服务容器3 个TTS语音合成、ASR语音识别、视频合成1 个视频合成暴露本地端口18180、10095、83838383启动命令docker-compose up -ddocker-compose -f docker-compose-lite.yml up -d覆盖能力形象克隆 语音合成 视频合成仅视频合成翻译一下手里已有现成音频、只想要对应数字人视频时Lite 版少下载、少启动两个容器需要直接输入文字驱动口型用标准版。 三步之后跟着做一个最小示例我用最短流程完整走一遍。客户端点击Create Avatar上传一段 10 秒正面人像视频背景干净、人在说话预期完成后My Avatars里多出一个新模型。点击Create Video选中刚创建的模型输入一段产品介绍文案文案共支持 8 种语言。提交合成等待进度走完预期进度条结束不报错。回到My Works播放并下载生成的口播视频。My Avatars页签下展示新克隆的数字人形象模型卡片及其创建时间 最容易卡住的 3 个地方现象docker-compose up -d报 registry-1.docker.io 连接超时。原因Docker Hub 官方源不稳定。解决在 Docker Desktop 的 Docker Engine 设置里配置国内镜像源示例见 常见问题。Docker Desktop 的 Docker Engine 设置页registry-mirrors 字段填入镜像源列表现象新增模特时报错。原因建模视频必须带声音且是人在说话。解决重拍一段说话清晰的 10 秒视频再上传。现象定制模特报 Connection refused。原因ASR 服务启动慢或机器内存太小。解决服务端启动后等几分钟再操作内存升到 32G 以上。Duix.Avatar 把口播视频的生产门槛压到一台带 NVIDIA 显卡的电脑 半小时等待。部署跑通后可按 README_zh.md 的接口说明把合成能力接入自己的产品提问前建议先对照 doc/常见问题.md 自查。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考