ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

10秒克隆你的数字人:Duix.Avatar 本地部署全攻略

10秒克隆你的数字人:Duix.Avatar 本地部署全攻略 10秒克隆你的数字人Duix.Avatar 本地部署全攻略【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar想让 AI 数字人替你录完一整期课程又不想把人脸和声音传到云端Duix.Avatar 就是为此开源的上传一段 10 秒左右的视频本地就能克隆你的形象和声音之后输入文案即可生成口播视频全程离线。显卡与空间体检单配置类型CPU内存显卡存储最低配置i5-10400F16G偏紧8G 显存 NVIDIA空闲 100G推荐配置i5-13400F32GRTX 4070C 盘 100G D 盘 30G⚠️ 硬性限制必须用英伟达NVIDIA显卡并装好驱动AMD 卡无法启动服务。装好了别急着点启动。先确认两件事Windows 10 19042 或更高版本以及 C 盘镜像空间是否够 100G不够的话装完 Docker 后在 Settings → Resources → Advanced 里改磁盘位置。Docker 环境一步到位Step 1打开命令行输入wsl --list --verbose检查 WSL没装过就执行wsl --install装好后执行wsl --update升级内核。看到更新成功的提示说明基础环境就绪。Step 2下载并安装 Docker Desktop首次启动接受协议、跳过登录。做对了的标志是左下角显示Engine running。Step 3克隆项目代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar进入仓库的deploy/目录执行docker-compose up -d显存小可改用docker-compose -f docker-compose-lite.yml up -dlite 版只起一个容器。这一步要拉取约 70G 镜像连上 Wi-Fi 耐心等半小时左右。Step 4打开 Docker Desktop 的 Containers 页面。看到duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个容器都是 Running 状态服务端就算部署完成了。拉取报连接超时在 Docker Engine 配置里加国内镜像源参考 常见问题 里的写法。从一段视频到第一个成片现在装客户端从 Releases 下载Duix.Avatar-x.x.x-setup.exe双击安装打开后首页能正常显示说明客户端和服务端已经连上。接下来克隆你自己。点右侧的Create Avatar上传一段 10 秒左右的视频注意三个要求人物正脸、光线均匀、必须有人在说话系统要用这段声音做声音克隆静音视频会直接报错。模特名随意起其他参数保持默认即可。提交后系统会自动转码视频、分离音频、训练声音模型按显卡不同约等 3 到 5 分钟看到「我的数字人」列表里出现你的头像就说明克隆成功了。然后生成第一条视频。点Create Video选中刚建好的数字人在文本框里输入文案或上传音频语速建议 1.0 倍其余保持默认点生成。1 分钟左右的文案约需 3 到 5 分钟渲染完成后到My Works里就能看到带口型同步的成片——这就是你的第一个本地数字人作品。如果你在做这几件事如果你在做教学录课建一个教师数字人把课件逐页转成文案批量生成同一模型换不同文案就是一整套系列课边际成本接近零。如果你在做电商口播一个模特模型配多段产品文案背景素材换一版就是一条新视频不用反复出镜。如果你要接进自己的系统服务本地只暴露了几个端口核心调用一条 curl 就能打通语音合成示例curl -X POST http://127.0.0.1:18180/v1/invoke -H Content-Type: application/json -d {speaker:你的uuid,text:你好,format:wav,reference_audio:训练返回值,reference_text:训练返回值}reference_audio和reference_text取自克隆时/v1/preprocess_and_tran接口的返回完整参数可看 src/main/service/ 下的源码。血泪坑替你先踩了视频里没声音现象新增模特直接报错提示文件不存在 原因训练视频必须包含人声程序靠它克隆声音 解决重新录一段你在正常说话的 10 秒视频克隆时 Connection refused现象定制模特报 111 拒绝连接 原因ASR 服务启动慢服务端刚起来就被调用了 解决容器起来后等几分钟再操作16G 内存机器可能直接拉不动建议 32G拉镜像连不上 Docker Hub现象docker-compose up -d报 request canceled 超时 原因官方源网络不稳定 解决按常见问题在 Docker Engine 里配置国内镜像源或开代理后重试三个容器起不来现象容器反复重启或停留在 Creating 原因英伟达驱动没装好GPU 运行时不可用 解决执行nvidia-smi确认能显示显卡信息装不上就回驱动官网重装下一步打开终端敲下wsl --list --verbose——半小时后你的数字人就能开口说话了。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表