ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

如何本地部署Duix-Avatar,30分钟创建AI数字人:完整Docker实战指南

如何本地部署Duix-Avatar,30分钟创建AI数字人:完整Docker实战指南 如何本地部署Duix-Avatar30分钟创建AI数字人完整Docker实战指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix-Avatar 是一个真正开源的 AI 数字人工具包支持全离线本地部署。你只需提交一段 10 秒左右的视频就能完成人物形象和声音的克隆之后输入文案或上传音频即可自动驱动口型生成口播视频脚本支持中文、英语、日语、韩语等八种语言。整个方案分成两部分Docker 服务端负责计算形象训练、声音克隆、视频合成桌面客户端提供图形化界面。视频和音频始终不离开你的电脑这也是它适合隐私敏感场景的原因。本文按查硬件 → 配 Docker → 起服务 → 装客户端的顺序带你走完部署最后用一段 10 秒视频验证效果。以 Windows 环境为主线介绍Ubuntu 22.04 用户原理相同只是换用deploy/docker-compose-linux.yml启动。动手前准备系统与硬件清单装任何东西之前先核对这张表有一项不满足后面的步骤大概率会卡住项目要求说明系统Windows 10 19042.1526 或更高Ubuntu 22.04 也可走 Linux 流程D 盘空闲大于 30GB存放数字人模型和作品数据C 盘空闲大于 100GB存放 Docker 镜像不足时可迁移内存32GB 及以上16GB 内存下服务可能启动不起来显卡英伟达显卡已装驱动推荐 RTX 4070CPU 推荐 i5-13400F网络稳定连接首次镜像下载约 70GB⚠️ 所有算力都跑在本地英伟达显卡上。没有显卡或驱动没装好三个服务是无论如何起不来的所以这一项要先确认。部署实操第一步环境检查确认 GPU 与磁盘空间做什么先确认显卡对系统可见再看两个盘的剩余空间。nvidia-smi成功后应看到命令输出显卡型号、驱动版本和显存信息。如果显示找不到显卡先装最新的 NVIDIA 驱动。Windows 用户同时在此电脑里确认 D 盘和 C 盘的剩余空间达标。第二步WSL 与 Docker Desktop 配置做什么检查并安装 WSL然后安装 Docker Desktop按 CPU 架构选对应安装包。wsl --list --verbose wsl --install wsl --update成功后应看到Docker Desktop 启动后底部状态栏显示 Engine running。安装 WSL 时会要求设置用户名和密码记一下后面会用到。Docker 装好后还有一件事如果 C 盘空闲不足 100G打开 Settings → Resources → Advanced在 Disk image location 处点 Browse把镜像文件位置改到空间充足的磁盘。wsl --install受网络影响可能失败多试几次即可。完整的前置条件说明见 README_zh.md 的Windows 安装一节。第三步拉取镜像与启动服务做什么克隆项目进入deploy目录执行 docker-compose。git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy docker-compose up -d成功后应看到Docker Desktop 的容器列表里出现三个服务且均为 Runningduix-avatar-tts语音合成、duix-avatar-asr语音识别、duix-avatar-gen-video视频合成。首次拉镜像约 70GB耗时取决于网速建议连 WiFi 或有线网络等待。根据硬件情况可以选用不同的 compose 文件标准版docker-compose.yml三个服务齐全轻量版docker-compose -f docker-compose-lite.yml up -d只起duix-avatar-gen-video一个服务英伟达 50 系列显卡5090 已测试通过docker-compose -f docker-compose-5090.yml up -d⚠️ 三个服务都依赖 GPU 运行时如果容器反复重启而不是 Running优先回到第一步检查显卡驱动再看 常见问题文档。第四步安装客户端做什么从项目发布页下载官方构建的安装包Windows 双击Duix.Avatar-x.x.x-setup.exe按向导安装Ubuntu 用户直接运行.AppImage文件即可无需安装root 用户需加--no-sandbox参数。成功后应看到客户端启动后本地服务状态显示绿色对勾说明已成功连上本地服务界面可以正常操作。验证服务并用一段10秒视频创建第一个数字人服务是否真的跑起来了用两种方式确认Docker Desktop 容器列表里三个服务轻量版为一个全部是 Running点开容器查看 Logs 页签日志持续输出正常的启动信息右侧状态为 Running即为健康。服务端接口都暴露在本地127.0.0.18383 端口对应视频合成18180 对应语音合成10095 对应语音识别。如果你想用代码对接而不是走客户端接口的请求参数示例见 README_zh.md 的开放 API部分对应实现代码在 src/main/service/ 目录下。然后创建第一个数字人在客户端首页点快速定制 / Create Avatar上传一段 10 秒左右的视频等训练完成新的数字人出现在My Avatars列表里。⚠️ 上传的视频里必须有人声且是人在说话——程序要用这段声音做声音克隆无声视频会直接失败。接着点Create Video输入口播文案或上传音频文件系统会自动完成口型匹配并导出视频。首次生成需要几分钟结束后可以对照原视频看看口型和声音相似度。原理速览说人话这个项目做三件事面部重建用 3D 形变模型从单目视频里逐帧拟合面部特征重建出面部网格原视频轻微晃动也不影响模型稳定。这就是为什么只需要 10 秒视频而不是摄影棚级别的采集。声音克隆从视频里那几秒人声样本中提取音色、语调和节奏之后输入文字就能合出音色相近的语音。视频合成把语音和数字人画面按帧对齐口型音画同步后导出成口播视频。三个环节各对应一个 Docker 服务模块划分也直接体现在源码里想深入看 src/main/service/ 下 model、voice、video 三个文件即可。还能做什么在线教育把课程讲义转成数字人课程视频不同知识点换不同文案各出一版省去反复拍摄。电商营销数字人主播商品卖点直接填成文案转成口播视频适合批量生成商品介绍和促销短视频。企业培训入职材料、制度宣导这类固定格式内容用文字驱动内容更新时随时重出不用重新找人录。这三类的共同点是文案 → 语音 → 口型这条链路本地服务部署一次后可以反复复用。常见坑速查1.docker-compose up -d连接失败报 registry-1.docker.io 超时网络访问不到 Docker Hub 官方源。最常见的解法是配置国内镜像加速器Docker Desktop → Docker Engine在配置里加上registry-mirrors点 Apply restart 后重新拉取。2. 新增模特报错 file not exists先查文件路径里有没有中文或特殊字符路径尽量保持纯英文数字再确认上传的视频确实带人声。定位不了就打开客户端设置 → 打开日志看具体报错位置。服务端这边也能直接看容器日志下面是典型的 file not exists 报错现场3. 定制模特时报 Connection refusedASR 服务启动比其他服务慢服务刚起来就克隆会连不上。等服务启动几分钟后重试另外如果机器内存低于 32GB服务本身可能就没起来这属于硬件不满足不是配置问题。4. 磁盘空间不足拉镜像或生成视频中断首次镜像下载约 70GB之后模型和作品数据落在 D 盘。C 盘保留 100GB 以上、D 盘保留 30GB 以上C 盘快满了就按第二步的方法把 Docker 镜像存储位置迁到别的盘。结尾下一步就一件事录一段 10 秒的口播视频传到客户端里等第一个数字人生成出来。遇到问题先对照上面常见坑速查的四条自查大多数情况已经覆盖。后续版本还会持续改善多语言效果和 GPU 兼容性记得把服务端和客户端都更新到最新版能少踩很多坑。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表