ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Duix-Avatar 本地部署实战指南:离线数字人克隆与视频生成一次跑通

Duix-Avatar 本地部署实战指南:离线数字人克隆与视频生成一次跑通 Duix-Avatar 本地部署实战指南离线数字人克隆与视频生成一次跑通【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix-Avatar 是一款全开源的离线数字人工具包用一段真人视频即可克隆你的形象和声音再靠文字或音频驱动它开口说话。跟着这篇指南你只需约半小时就能在本地跑起完整服务并做出第一个数字分身。 能力全景这个数字人工具箱能干什么形象与声音克隆上传一段包含清晰面部和说话声音的视频系统会训练出你的专属数字人模型音色一并复刻。文字/音频驱动成片输入文案或上传音频数字人自动口型同步生成视频支持中、英、日、韩等 8 种语言。全程离线运行所有算力都在本地 GPU 上不联网也能创作素材和数据不会出机器隐私敏感场景友好。️ 部署路径选型先想清楚你要哪套服务这个项目不需要手动编译源码官方给出的就是 Docker 一键部署路线deploy/ 目录下备好了几套编排文件完整版docker-compose.yml拉起 3 个容器——TTS语音克隆、ASR语音识别、视频生成。想克隆声音必须用它。轻量版docker-compose-lite.yml只有 1 个视频生成容器省资源但没有声音克隆。系统区分Windows 用 docker-compose.yml数据目录写死 D 盘Ubuntu 22.04 用 docker-compose-linux.yml数据在用户目录。RTX 50 系显卡另有 docker-compose-5090.yml。一句话结论90% 的读者选「完整版 对应系统的 compose 文件」别纠结。✅ 环境自检清单部署前 5 分钟过一遍硬件NVIDIA 显卡驱动装好终端跑nvidia-smi能看到显卡信息内存 ≥ 16GB32GB 更稳16G 内存跑 ASR 服务比较吃力磁盘Windows 的 D 盘留 30GB 放数字人数据、C 盘留 100GB 放 Docker 镜像Ubuntu 留 100GB 空闲官方推荐配置参考i5-13400F / 32GB 内存 / RTX 4070软件Windows 1019042配 Docker Desktop或 Ubuntu 22.04 配 Docker NVIDIA Container Toolkit已装 NVIDIA 驱动并验证通过 部署实操从克隆仓库到服务跑起来第 1 步拿代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar此时你应该看到本地多了一个Duix-Avatar目录里面含deploy、src两个关键文件夹。第 2 步看一遍配置打开 docker-compose.yml重点看三处volumes里的数据挂载目录Windows 是d:/duix_avatar_data/...Linux 是~/duix_avatar_data/...宿主机上这些目录会在使用时自动生成无需手动建、ports端口映射、以及镜像名。第 3 步拉镜像docker pull guiji2025/fun-asr guiji2025/fish-speech-ziming guiji2025/duix.avatar首次下载约 70GB 流量会跑一阵子。国内网络如果卡在 Docker Hub 官方源先别慌去 Docker Desktop 设置里配置镜像加速器参考 doc/常见问题.md 里的 registry-mirrors 配置再重新拉。第 4 步启动服务cd deploy docker-compose up -dUbuntu 用户换成docker-compose -f docker-compose-linux.yml up -d轻量版换成-f docker-compose-lite.yml。启动后耐心等 20~30 分钟镜像拉取和服务预热都不快网速好的话会更早。 首次运行验证三个容器全绿才算成功打开 Docker Desktop 的 Containers 页面此时你应该看到 3 个容器状态都是 Runningduix-avatar-asr10095 端口、duix-avatar-gen-video8383 端口、fish-speech18180 端口。轻量版则只有 1 个。服务端就绪后打开 Duix.Avatar 客户端Windows 装 exe 安装包Ubuntu 运行 AppImage首次启动先勾选用户协议。接着做两件事验证链路点右上角 Setting → Open Log确认客户端能正常打开日志点Create Avatar上传一段 30 秒以上、人脸清晰且有人在说话的视频等待形象训练完成。 核心功能实操上传素材到产出视频形象克隆好后进入Create Video区域选择刚创建的数字人输入一段文案系统会自动走「文字转克隆语音 → 驱动数字人口型」的完整链路点击生成。几分钟到十几分钟视文案长度到 My Works 列表里就能看到成片点开即预览。这里有个高频踩坑点用于创建模特的视频必须带人声因为系统要用这段声音做声音克隆静音视频会直接报错。 排错速查高频问题对照表现象原因解法拉镜像失败、卡在官方源Docker Hub 国内连接不稳给 Docker 配置 registry-mirrors 镜像源重启 Docker 再拉服务起不来 / 状态异常没有 NVIDIA 显卡或驱动没装好跑nvidia-smi确认显卡可见本项目全部算力依赖本地 GPU创建模特报错素材视频没有人声换一段本人在清晰说话的视频重新上传定制模特报 Connection refusedASR 服务预热慢16G 内存可能起不来服务端启动后等几分钟再克隆内存不足则升级到 32G客户端行为异常客户端/服务端版本不同步到 deploy/ 重新执行docker-compose up -d客户端拉最新代码重新 build还搞不定就去客户端 Setting → Open Log 翻main.log或点 Docker 对应容器复制日志对照 doc/常见问题.md 逐条排查。 延伸资源doc/常见问题.md官方 FAQ覆盖镜像源配置、日志获取方式、典型报错的完整自查清单。deploy/docker-compose.yml部署编排入口改端口、改数据目录、换镜像都在这一个文件里。src/main/service/video.js视频合成调用层源码想基于本地服务二次开发比如批量出片从这里读起。镜像已经拉下来了现在就创建你的第一个数字分身让离线生成的视频跑起来。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表