Duix.Avatar 本地部署指南:从零搭出你的数字人视频生成平台
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
Duix.Avatar 是免费开源的 AI 数字人项目,仅需一段 10 秒左右的视频就能克隆你的形象和声音,输入文案或上传音频即可自动生成口播视频。整个过程在本地离线运行,无需联网。本文带你一步步完成数字人本地部署,并生成第一条口播视频。
🎬 先看效果
客户端主界面分为「Create Video」和「Create Avatar」两个入口。上传一段短视频后,系统会完成面部与声音克隆;之后输入文案或上传音频,就能产出口型同步的数字人视频。生成结果会归档在下方「My Works」和「My Avatars」列表中,可随时播放和管理。
🧰 部署前准备
所有算力都在本地跑,没有英伟达显卡和驱动,服务起不来。先对照下表逐项确认:
| 项目 | 要求 |
|---|---|
| 操作系统 | Windows 10 19042.1526 及以上;或 Ubuntu 22.04(内核 6.8.0-52-generic) |
| CPU | 推荐第 13 代英特尔酷睿 i5-13400F |
| 内存 | 32G 及以上(必要) |
| 显卡 | NVIDIA 显卡且正确安装驱动,执行nvidia-smi能显示显卡信息;推荐 RTX 4070 |
| 磁盘空间 | Windows:D 盘 30G+(存数据)、C 盘 100G+(存镜像);Ubuntu:空闲空间大于 100G |
| 软件 | Docker(Windows 用 Docker Desktop + WSL,Ubuntu 用 docker.io + docker-compose)、Node.js 18 |
🚀 部署实操
1. 获取项目源码
打开终端,执行:
git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar2. Windows:安装 WSL 与 Docker Desktop
- 用
wsl --list --verbose确认 WSL 是否已装,未装则执行wsl --install(网络原因可能失败,多试几次),再用wsl --update更新。 - 按 CPU 架构下载安装 Docker Desktop,首次运行接受协议并跳过登录即可。
- C 盘不足 100G 时,在 Docker Desktop 的 Settings → Resources → Advanced 中,把 Disk image location 改到剩余空间大于 100G 的磁盘文件夹。
3. Windows:启动服务端容器
cd deploy docker-compose up -d只需要视频生成服务的话,执行docker-compose -f docker-compose-lite.yml up -d。耐心等待半小时左右(视网速而定),下载约消耗 70GB 流量,建议连 WiFi。
在 Docker 中看到duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个服务均为 Running 即成功;lite 版本只有一个duix-avatar-gen-video服务。
4. Ubuntu 22.04:安装 Docker 与 GPU 工具链
- 先
docker --version检查,未安装则执行sudo apt update、sudo apt install docker.io、sudo apt install docker-compose。 - 按 NVIDIA 官方文档安装显卡驱动,
nvidia-smi能显示显卡信息才算装好;再安装 nvidia-container-toolkit:添加 NVIDIA 仓库后执行sudo apt-get install -y nvidia-container-toolkit,用sudo nvidia-ctk runtime configure --runtime=docker配置,最后sudo systemctl restart docker。
然后启动服务端:
cd deploy docker-compose -f docker-compose-linux.yml up -d5. 安装并启动客户端
- Windows:下载官方构建的
Duix.Avatar-x.x.x-setup.exe,双击安装。 - Ubuntu:下载 Linux 版
Duix.Avatar-x.x.x.AppImage,双击即可启动,无需安装;root 用户下双击无反应时,在终端执行:
./Duix.Avatar-x.x.x.AppImage --no-sandbox🎥 第一次使用:产出第一条数字人视频
- 创建形象:启动客户端,Home 页点击「Create Avatar」,上传一段 10 秒左右的视频。注意视频必须有声音且是人在说话,程序要用这段声音做声音克隆。
- 确认克隆结果:训练完成后,「My Avatars」列表里出现以你的名字命名的模型,形象与声音分身就绪。
- 生成第一条视频:点击「Create Video」,选中刚创建的模型,输入文案(支持中、英、日、韩、法、德、阿拉伯语、西班牙语共 8 种语言),或直接上传一段音频。
- 收获口播视频:生成结束后得到一段面部与声音高度同步的口播视频,归档在「My Works」列表,可立即播放检查效果。
❓ 常见问题
Q:执行docker-compose up -d报 registry-1.docker.io 连接超时?Docker Hub 官方源连接不稳定。打开 Docker Desktop 的 Settings → Docker Engine,在registry-mirrors里填入国内镜像源,点 Apply & restart 保存。
Q:新增模特时报错?用于创建模特的视频必须有声音,且是人在说话,程序需要用这段声音做声音克隆。
Q:创建模特时日志报 Connection refused?ASR 服务启动较慢,服务端启动后等几分钟再做克隆形象操作;内存只有 16G 的机器可能直接起不来。
Q:三个服务起不来、客户端连不上服务?先确认三个服务都是 Running 状态;再确认英伟达显卡和驱动已正确安装(执行nvidia-smi)。没有显卡或驱动,服务一定启动不了。
Q:报错日志去哪里找?客户端:右上角设置 → Open Log 打开日志目录,main.log 在其中;服务端:在 Docker Desktop 点开对应服务查看并复制日志。
📚 总结与延伸
走完上面的流程,你就把「形象 + 声音克隆 → 口播视频生成」的完整链路离线跑在了自己的电脑上:硬件达标的前提下,约半小时拉完镜像,一条 10 秒视频就能产出属于你的数字人分身。想继续深入,可以看仓库里这几处:
- deploy/:完整版、lite 版、5090 显卡版与 Linux 版的 docker-compose 配置
- doc/常见问题.md:更多问题排查与自查步骤
- src/main/service/:模特训练、语音合成、视频合成的服务端接口源码
- LICENSE:开源协议
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考