Duix.Avatar免费本地数字人:30分钟搭建你的AI分身 Duix.Avatar免费本地数字人30分钟搭建你的AI分身【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是 duix.com硅基智能开源的 AI 数字人项目用一段 10 秒视频即可克隆你的形象和声音输入文案就能生成口型同步的口播视频。全流程在本地离线跑完软件免费数据不出你的电脑。项目速览它做什么、适合谁Duix.Avatar 是一个形象克隆 语音克隆 口播视频生成三合一的本地数字人工具箱。开源方duix.com硅基智能客户端为 Windows 安装包 / Ubuntu AppImage服务端基于 Docker 部署。工作方式提交一段 10 秒左右的说话视频提取面部与声音特征之后输入文本或上传音频驱动数字人说话并输出视频。服务端由 3 个容器组成fun-asr 做语音识别、fish-speech 做语音合成、duix.avatar 做视频合成全部走本地 GPU。支持 8 种语言脚本中、英、日、韩、法、德、阿拉伯语、西班牙语。适合谁自媒体创作者批量口播、教育机构数字讲师、企业宣传品牌数字代言。软件零费用数据 100% 在本地。动手前检查硬件、花费与耗时一张表先对照下表确认你的电脑能否跑起来任何一项不满足都会导致服务起不来。检查项要求操作系统Windows 1019042.1526 及以上或 Ubuntu 22.04显卡英伟达 NVIDIA 显卡 已装驱动nvidia-smi能显示显卡信息内存32GB 及以上16GB 可能起不来硬盘WindowsC 盘留 100G 以上放镜像、D 盘留 30G 以上放数据Ubuntu空闲 100G 以上花费0 元软件与使用均免费仅约 70G 镜像下载流量耗时首次拉取镜像约 30 分钟取决于网速快速部署5步启动3个Docker服务部署的核心就是装好 Docker、拉起 3 个服务端容器、装上桌面客户端按下面顺序做即可。安装 Docker。Windows先执行wsl --install已装可跳过再从 Docker 官网安装 Docker Desktop 并启动。Ubuntu用 apt 安装 docker 与 docker-compose。sudo apt update sudo apt install docker.io docker-composeWindows 建议把 Docker 磁盘存储移出 C 盘。Docker 默认把镜像放在 C 盘约 70G 的下载量很快会挤爆系统盘在 Docker Desktop 的 Settings → Resources → Advanced 里通过 Disk image location 的 Browse 改到空闲空间更大的磁盘Apply restart 生效。获取项目代码。仓库 clone 地址如下git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar启动服务端。进入deploy目录执行Windows默认配置cd Duix-Avatar/deploy docker-compose up -dUbuntu改用 linux 配置docker-compose -f docker-compose-linux.yml up -d50 系列显卡5090 已测试通过30/40 系 cuda12.8 也可用docker-compose -f docker-compose-5090.yml up -d想省资源可执行docker-compose -f docker-compose-lite.yml up -d只启动 1 个合成服务。等约 30 分钟Docker 里出现 3 个 Running 容器即成功。安装客户端。到项目发布页下载对应系统安装包Windows双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu直接双击Duix.Avatar-x.x.x.AppImage运行root 用户需加--no-sandbox参数。首次实战10秒视频生成你的第一条口播跑通流程只需四步备素材、建模型、写文案、出视频全程在客户端里完成。备素材录一段 10–20 秒的视频正对镜头说话面部光线充足、背景简洁必须带清晰的人声声音克隆依赖它无声视频会直接报错。建模型打开客户端点右上角 Create Avatar上传视频后等待几分钟系统自动完成面部与声音特征提取模型会出现在 My Avatars 列表。生成视频点 Create Video选中你的模特输入文案或上传音频文件点击生成等待几分钟。取结果成片自动存入 My Works 列表可直接播放和下载方便反复管理。常见坑排查4个典型报错的解决法遇到问题先看日志、再对照下面四条绝大多数故障都能自助解决更完整的清单见 doc/常见问题.md。现象执行docker-compose up -d时三个服务报registry-1.docker.io连接超时。原因Docker Hub 官方源网络不稳定。怎么办在 Docker Desktop 的 Settings → Docker Engine 中加入国内镜像源registry-mirrors保存后重试。现象3 个容器起不来或反复重启。原因英伟达驱动没装对或内存不足16GB 可能启动失败。怎么办先跑nvidia-smi确认驱动确认内存 32GB 及以上。现象创建模特时报Connection refused或file not exists。原因ASR 服务启动较慢服务端刚起来就操作或上传的视频没有说话人声。怎么办等 3 个服务全部 Running 后等几分钟再克隆重新上传带清晰人声的视频。报错细节可点容器 Logs 右侧的复制按钮导出。现象视频生成卡在 20% 不动。原因音频处理环节出错如音频路径异常。怎么办客户端右上角 Setting → Open Log 打开 main.log再对照 Docker 三个服务的日志定位报错必要时重启对应服务。进阶玩法3个超出基础用法的方向基础口播之外Duix.Avatar 还预留了 API、轻量化和新显卡适配三条进阶路线。开放 API 做自动化Docker 启动后本地暴露 8383视频合成 submit/query、18180语音预处理与合成 invoke、10095语音识别三类接口通过http://127.0.0.1直接调用可实现批量提交、流水线生产。客户端内的调用实现可参考 src/main/service/ 下的 model.js、video.js、voice.js 三个文件。lite 轻量版显存和硬盘紧张时执行docker-compose -f docker-compose-lite.yml up -d只保留 1 个视频合成服务资源占用更低。50 系显卡适配RTX 50 系列用docker-compose-5090.yml官方 5090 测试通过30/40 系列 cuda12.8 环境同样可用避免 CUDA 版本不兼容导致的启动失败。写在最后一台 32GB 内存的英伟达显卡电脑、30 分钟镜像下载时间、一段 10 秒说话视频就是你启动 Duix.Avatar 需要的全部成本。克隆、口型同步、8 语言文案全部离线完成没有订阅费也没有数据上云。现在就对照动手前检查表确认配置然后按 5 步部署流程走一遍用你的第一条 10 秒视频建出属于你的数字分身。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考