Duix.Avatar完整教程:零基础30分钟克隆你的第一个AI数字人视频
2026/9/11 13:57:11 网站建设 项目流程

Duix.Avatar完整教程:零基础30分钟克隆你的第一个AI数字人视频

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

Duix.Avatar是一款免费开源的AI数字人克隆项目。提交一段10秒左右的你的视频,就能克隆你的形象和声音;之后输入文案或上传音频,它会自动生成口型同步的口播视频,全程本地离线完成。想做数字人视频的自媒体创作者、老师和企业宣传团队,都可以用它。

🎬 它能为你做些什么

  • 自媒体创作:不用出镜,让你的"数字分身"帮你念稿、口播,视频产出节奏不再受拍摄排期限制
  • 教育培训:把课程脚本交给数字人讲师,批量产出风格统一的教学视频
  • 企业宣传:用品牌数字人做产品介绍、客服口播,形象统一、随时开工
  • 个人用途:给婚礼、生日等场合做一份有你"身影"和声音的纪念视频

主界面只有两个入口:"Create Video"(生成视频)和"Create Avatar"(创建数字人),作品和数字人模型分别存在"My Works"和"My Avatars"里,一眼就能找到。

✅ 动手前:环境自检清单

先对照这张清单,确认你的电脑够不够格,再开始装环境:

  • 系统:Windows 10(19042.1526或更高版本)或 Ubuntu 22.04
  • 显卡:必须有 NVIDIA 显卡,且驱动装好(推荐 rtx-4070 级别,50系列显卡有专门部署方案)
  • 内存:32G 及以上(必要,16G 可能起不来服务)
  • CPU:参考配置为第13代英特尔酷睿 i5-13400F
  • 磁盘(Windows):C盘空闲 100G 以上(放 Docker 镜像),D盘空闲 30G 以上(存数字人和作品);Ubuntu:空闲 100G 以上
  • 网络:下载 Docker 镜像约消耗 70G 流量,建议连 WiFi

🚀 跟着做:三步部署完成

第一步:安装 Docker

Windows:先打开 PowerShell,用wsl --list --verbose查看是否装过 WSL,没有就先执行wsl --install。装好后运行下面这条命令把 WSL 更新到最新版(网络原因可能失败,多试几次):

wsl --update

然后从 Docker 官网下载 Windows 版 Docker Desktop 安装并启动,首次运行接受协议、跳过登录即可。

Ubuntu:先跑docker --version,没装 Docker 的话执行下面三条命令安装:

sudo apt update sudo apt install docker.io sudo apt install docker-compose

Ubuntu 还需要正确安装 NVIDIA 显卡驱动并安装 NVIDIA Container Toolkit(完整步骤见 README_zh.md),装完用nvidia-smi验证,能看到显卡信息才算成功。

Windows 用户注意:C盘空闲不足 100G 时,在 Docker Desktop 的 Settings → Resources → Advanced 里,用 Browse 把磁盘镜像位置改到剩余空间大于 100G 的磁盘。

第二步:启动服务端

把项目克隆到电脑上(克隆下来的目录里带deploy文件夹):

git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar

进入项目的deploy目录,Windows执行:

docker-compose up -d

Ubuntu执行:

cd Duix-Avatar/deploy docker-compose -f docker-compose-linux.yml up -d

如果用的是 50 系列显卡(30/40 系列且 CUDA 12.8 的也可以用),把命令里的配置文件换成docker-compose-5090.yml即可;配置偏低可以改用 lite 版(只启动 1 个服务)。耐心等待约 30 分钟,镜像下完、Docker 里出现 3 个运行中的服务(tts、asr、gen-video)就说明服务端就绪了。

第三步:安装客户端

去项目的 Releases 页面下载官方构建的安装包:Windows 双击Duix.Avatar-x.x.x-setup.exe安装;Ubuntu 直接双击Duix.Avatar-x.x.x.AppImage启动(root 用户需改用终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox)。客户端打开并连上本地服务端,部署就完成了。

🎙️ 完成你的第一个数字人视频

打开客户端,主界面左侧是"Create Video",右侧是"Create Avatar",右上角 Setting 菜单里还能查看用户协议、打开日志、切换语言。

准备素材:录一段 10 秒左右的视频,要求是正面人脸清晰、画面里有人说话——声音克隆就靠这段声音,没声音的视频无法建模。

提交克隆:点"Create Avatar"上传这段视频。这里有个新手容易踩的坑:服务端刚启动时语音识别服务(asr)启动较慢,建议等几分钟再提交,否则可能报 Connection refused。训练本身需要几分钟,取决于你的硬件。

生成视频:训练完成后,在"My Avatars"里选中你的数字人模型,输入要说的文案(或上传音频文件),点击生成。几分钟后,一条口型与声音同步的口播视频就会出现在"My Works"里,直接保存即可。

🛠️ 出了问题先看这里

服务拉不下来或起不来怎么办?

  1. 打开 Docker,确认三个服务(duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video)是否都是 Running 状态。
  2. 如果报registry-1.docker.io连接超时,说明 Docker Hub 连不上:进入 Docker Desktop 的 Settings → Docker Engine,在 JSON 里添加registry-mirrors国内镜像源,点 Apply & restart。
  3. nvidia-smi检查显卡驱动——没有 NVIDIA 显卡或没装驱动,三个服务是起不来的。

创建数字人模型报错怎么办?

  1. 确认上传的视频有声音、且是人在说话,这是声音克隆的必要条件。
  2. 服务端刚启动时 asr 服务还在预热,等几分钟再重试一次。
  3. 如果机器内存低于 32G(比如 16G),服务可能根本启动不了,这类报错先检查内存。

定位不了问题怎么排查?

  1. 看客户端日志:点右上角 Setting 菜单里的"Open Log",日志文件是 logs 目录下的main.log
  2. 看服务端日志:在 Docker 里点开对应服务的 Logs 页签,把关键报错复制出来。
  3. 把服务端和客户端都更新到最新版本,再试一次:到deploy目录重新执行docker-compose up -d

📈 再往前走一步

  • 开放 API:服务端启动后会在本地暴露端口,模型训练、音频合成(18180 端口)和视频合成、进度查询(8383 端口)都能通过http://127.0.0.1调用,串起来就能做批量视频生成,接口实现可以直接看 src/main/service/ 目录。
  • 8 种语言:脚本支持英语、日语、韩语、中文、法语、德语、阿拉伯语和西班牙语,界面语言在 Setting 菜单里切换。
  • 免费商用:全球范围免费商用(用户量超 10 万或年营收超 1000 万美元的企业需签署商业许可协议)。

架构上它由三个 Docker 服务组成:基于 fun-asr 的语音识别、基于 fish-speech 的语音合成、负责视频合成的合成引擎,客户端是一个 Electron 桌面应用。

你不需要会编程,也不需要花一分钱,只需要一段 10 秒的视频和一台配置达标的电脑,就能拥有自己的 AI 数字分身。现在就回到上面的第二步,把deploy目录下的命令跑起来——30 分钟后,你的第一个数字人视频就在等着你了。遇到问题先翻 常见问题,绝大多数坑都有现成答案。

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询