
Duix.Avatar 数字人本地部署教程离线克隆真人形象3 步生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 数字人本地部署就是在你自己的电脑上搭一套完全离线的数字人视频生产线上传一段 10 秒左右的出镜视频克隆出你的形象和声音之后输入文案或丢一段录音它就自动帮你说出一段口型对得上的视频。所有素材都不离开这台机器隐私由你兜底。更实际的好处是零边际成本——部署一次之后生成多少条视频都不花钱、不限次数也不用担心敏感内容经过别人的服务器。认识这个工具把 Duix.Avatar 理解成本地数字人工作室一个图形客户端是你手里的遥控器后端是三个跑在 Docker 里的服务分别负责听写、配音、渲染。整个流程可以概括为一句话10 秒视频进去一个数字人出来一句文案进去一条口播视频出来。它最擅长三件事克隆真人形象10 秒出镜视频就能建一个高仿真数字分身外貌和声音都能还原文字直出视频不用自己配音文案交给它自动合成语音并驱动口型多语言脚本中、英、日、韩、法、德、西、阿八种语言都支持跑起来之后的主界面长这样创建数字人和生成视频都在首页入口里把 Duix.Avatar 跑起来硬件和系统门槛部署前先对一遍配置避免装到一半卡壳NVIDIA 显卡 正确安装驱动硬性要求本项目全部算力在本地没有 N 卡或服务起不来装完驱动用nvidia-smi能显示显卡信息才算数内存 32G 起步硬性要求16G 内存下语音识别服务大概率起不来磁盘Windows 建议 D 盘留 30G 存克隆素材和作品C 盘留 100G 存 Docker 镜像不够的话可以在 Docker 的设置里把镜像目录指到别的盘推荐配置i5-13400F / 32G 内存 / RTX 4070系统Windows 10 19042 或更高或 Ubuntu 22.04部署步骤一步一步来克隆代码库部署配置都在deploy目录里git clone https://gitcode.com/GitHub_Trending/he/HeyGem.ai cd HeyGem.ai安装 DockerWindows 装 Docker Desktop首次启动先装好 WSL命令行执行wsl --install装完再wsl --updateUbuntu 用sudo apt install docker.io docker-compose安装。进到项目的deploy目录执行docker-compose up -d。耐心等首次拉取镜像完成大约 70G 流量连 WiFi 的情况下半小时左右。打开客户端装官方构建好的安装包最省事Windows 双击 exe 安装Ubuntu 用 AppImage 直接启动不用装。怎么确认跑成功了打开 Docker看到三个容器全部是 Running 状态服务端就算活着了Duix.Avatar-asr听写、Duix.Avatar-tts配音、Duix.Avatar-gen-video视频合成。再进客户端把服务端地址填成本机新建一个模特走一遍完整流程——能上传视频、能出形象就算彻底跑通了。用好与调优镜像拉不下来加个国内镜像源这是部署中最常见的坎docker-compose up -d报request canceled或context canceled基本都是 Docker Hub 官方源连接不稳。在 Docker 的守护进程配置里加上registry-mirrors国内镜像源保存后重启 Docker再执行一次docker-compose up -d即可。提示镜像源列表会随时间失效拉不动就搜一个还活着的换上。显存紧张Lite 精简版deploy 目录里除了默认的docker-compose.yml还有docker-compose-lite.yml。显存有限、只想做视频合成的话用 lite 配置文件启动只起视频合成这一个容器克隆形象需要完整版的三个服务都在线。内存和显卡的小细节内存低于 32G 时 ASR 服务可能起不来先升内存再折腾其他Linux 部署用docker-compose -f docker-compose-linux.yml up -dNVIDIA 50 系显卡实测 5090 通过30/40 系配 CUDA 12.8 也可改用docker-compose-5090.yml启动Ubuntu 下用 root 跑客户端 AppImage 没反应的话终端加--no-sandbox参数启动实战与兜底场景一个人 IP 口播视频上传一段 10 秒的自我介绍视频克隆出你的数字分身以后每天把文案贴进去几分钟就是一条口播视频。全程离线、不限次数敏感选题也不用担心内容上传到第三方。场景二培训与课程批量换人一次克隆讲师形象之后不同课件、不同文案批量出片。素材和脚本都在公司内网里流转按协议全球免费商用用户量超 10 万或年营收超 1000 万美元的企业需要签商业许可协议协议见仓库根目录的Duix.Avatar model community Licensing Agreement.pdf。常见报错一句话解法拉镜像超时 / context canceled按上文加国内镜像源重试克隆模特失败上传的视频必须带人声且在说话声音就是克隆素材定制模特报 Connection refusedASR 服务启动偏慢等容器全部 Running 后再等几分钟内存只有 16G 则可能根本起不来排障时先在 Docker 里逐个容器复制日志客户端侧也把日志截好对照 常见问题 基本能覆盖大部分坑下一步往哪走服务端 Docker 起来后会在本机开放一组 API模特训练、语音合成、视频提交与进度查询接口说明在 README 的开放 API一节调用示例可以直接看 src/main/service/ 下的 model.js、video.js、voice.js。想把它接进自己的业务后台从这里入手。去录那 10 秒的出镜视频吧你的第一个数字人离上线只差一次docker-compose up -d。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考