
Duix.Avatar 本地部署完整指南私有化数字人克隆与离线教程【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 本地部署一次之后离线出片不再看网速脸色。这是个开源数字人克隆与口播视频生成工具上传一段 10 秒左右真人视频形象、声音一起克隆输入文案就能驱动口型出片。跟完这篇约需 12 小时大头在 70GB 镜像下载产出是你自己的第一条数字人口播视频。动手前的机器体检系统要求先对齐Windows 10 19042.1526 或更高或 Ubuntu 22.04 Desktop官方按内核 6.8.0-52-generic 验证过。另需 Node.js 18 和 Docker。硬件看三档档位CPU内存显卡 / 显存存储能达到的效果最低10 代 i5 或同级16GBRTX 3060 / 6GB系统盘 256GB 数据盘 1TB训练约 30 分钟/模型720p 合成约 5 分钟/分钟官方推荐13 代 i5-13400F32GBRTX 4070 / 12GB100GB 以上空闲训练约 15 分钟/模型1080p 合成约 2 分钟/分钟生产14 代 i9-14900K 或同级64GBRTX 4090 / 24GB1TB 系统盘 4TB 数据盘训练约 8 分钟/模型4K 合成约 1 分钟/分钟两条硬判断显存不足 6GB 的训练时长直接翻倍内存只有 16GB 时语音识别服务可能起不来镜像要吞掉 100G 以上磁盘数据盘再留 30G一共预留 130G 再动手。部署从克隆代码到服务就绪确认系统版本winver它报告 Windows 版本号应显示 19042.1526 或更高。Ubuntu 用下面这条lsb_release -a应显示 Ubuntu 22.04。备好 WSL 和 Dockerwsl --list --verbose列出已装的 WSL有输出就不用再装。接着更新wsl --update完成后重启一次。Windows 端再装 Docker Desktop首次启动接受协议、跳过登录。Ubuntu 端先确认 Docker 在不在docker --version没有的话装 Docker 本体sudo apt update sudo apt install docker.io sudo apt install docker-compose装完docker --version能打出版本号即可。Ubuntu 还要装显卡驱动和 NVIDIA Container Toolkit让 Docker 容器用上显卡按顺序执行sudo nvidia-ctk runtime configure --runtimedocker sudo systemctl restart docker最后跑这条验收nvidia-smi出现显卡型号、驱动版本、显存占用表即通过这条命令没输出后面三个服务一定起不来。克隆代码拉镜像git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar克隆完成后目录里应有deploy/、src/、README.md。docker pull guiji2025/fun-asr docker pull guiji2025/fish-speech-ziming docker pull guiji2025/duix.avatar分别是语音识别、声音合成、视频合成三个服务的镜像共约 70GB建议连 WiFi全程约半小时。避坑镜像会吃 100G 以上磁盘C 盘不足就去 Docker 设置里把存储目录换到别的盘。启动服务装客户端cd deploy docker-compose up -d它启动全部服务显存紧张可换docker-compose -f docker-compose-lite.yml up -d上精简版RTX 50 系显卡用docker-compose -f docker-compose-5090.yml up -d。耐心等它拉镜像、初始化然后验收docker ps应看到duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个容器全部 Up精简版只有duix-avatar-gen-video一个。客户端到项目 release 页面下载官方安装包Windows 双击Duix.Avatar-x.x.x-setup.exeUbuntu 下载 AppImage 版双击Duix.Avatar-x.x.x.AppImage即可运行root 用户要命令行启动./Duix.Avatar-x.x.x.AppImage --no-sandbox启动客户端桌面图标点开即进入主界面Create Video文本驱动出片和 Create Avatar克隆形象两个入口就位左下角 My Avatars 可看到克隆好的形象做出第一条视频用 10 秒素材克隆形象点 Create Avatar上传 10 秒左右的正面说话视频。要求很具体画面里有声音、是人在说话——系统要拿这段声音做克隆分辨率 720p 起步光线均匀。原理一句话深度学习分析五官形状和面部轮廓构建可驱动的虚拟模型。训练时间按硬件档位 830 分钟完成后形象出现在 My Avatars 列表。克隆音色同一套服务里声音合成会捕捉你的音色和语调特征之后生成的语音都带你的声纹。音色素材要求安静环境、无背景噪音含正式、亲切等不同语气还原度更高。文本驱动生成视频点 Create Video选中刚克隆的形象输入文案脚本支持中、英、日、韩、法、德、阿、西 8 种语言。系统先转成你的克隆音色再自动驱动口型音视频对齐后成片落到 My Works 列表可直接预览、下载。出事了怎么办故障先自查三件事三个服务是否都 Runningnvidia-smi是否正常本项目算力全在本地没显卡或没驱动服务直接起不来服务端和客户端是否都是最新版。现象最可能原因一条命令或一个动作的修复三个容器起不来显卡驱动未装或显存不足nvidia-smi确认驱动不足 16GB 内存换机器拉镜像报Client.Timeout exceededDocker Hub 连接不稳按 常见问题 配registry-mirrors镜像源或用全局 VPN克隆形象直接报错上传视频没声音、不是人在说话重录10 秒正面、开口说话、带音频克隆形象报Connection refused语音识别服务启动慢服务端起来后等几分钟再操作训练卡在某个百分比素材低于 720p 或光线不足换光线充足的 720p 以上视频重录合成变慢、画面卡顿GPU 被抢占或任务堆积关掉其他吃显卡的程序减少并发任务服务疑似没监听端口被占或没起来netstat -tuln \| grep -E 18180\|8383\|10095看三个端口从一条视频到批量生产批量生产的本质是同一模型反复用形象做成模型后换个文案就是条新片。教育场景10-15 秒教师正面视频背景简洁、光线均匀文案用文本驱动模式语速按 120-150 字/分钟设置逗号句号自动生成停顿不用额外标注。企业场景代言人备正面与 45 度角两类素材覆盖问候、产品介绍、感谢等标准动作麦克风在安静环境录制把企业介绍、产品宣传、活动通知做成模板固定品牌色调与 Logo 位置复用出片。资源渠道模型、训练与合成 API 全部开放Docker 启动后可经http://127.0.0.1的 18180 / 8383 端口调用代码参考 src/main/service/问题先去 常见问题 和项目 Issues 翻背景图、音乐找免费可商用素材库模型找社区分享的高分数字人。跑通后你就有了一套数据不出本机的数字人产线形象、声音、成片全在本地长期成本只有电费。下一步建议把同一个形象模型跑通批量出片再按场景扩素材。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考