ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Duix-Avatar 部署完整指南:10 秒视频克隆出数字人

Duix-Avatar 部署完整指南:10 秒视频克隆出数字人 Duix-Avatar 部署完整指南10 秒视频克隆出数字人【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix-Avatar 是一款支持完全本地部署的开源数字人克隆工具上传一段约 10 秒的视频即可克隆你的形象和声音再输入一段文案就能生成口型匹配的播报视频全程不联网、数据不出本机、不限制使用次数。它是什么值得试吗先说定位这一节帮你判断适不适合自己。如果你有 NVIDIA 显卡想要免费商用、不限次数的数字人口播视频它就值得一试如果机器没有独显或不想碰 Docker建议先看在线服务。全链路本地闭环形象克隆、声音克隆、文本转语音、口型合成都在自己电脑上完成视频和音频不经过任何云端。客户端零门槛桌面图形界面上传、点击、等待即可不需要写一行 Python。对开发者友好服务端在本地暴露模型训练、音频合成、视频合成三类 HTTP API可以直接接到自己的业务里调用流程参考 src/main/service/。对比维度本地开源部署在线数字人服务传统 3D 数字人数据存放全部在本机需上传云端依赖制作方硬件要求NVIDIA 显卡 32G 内存无要求需 3D 建模技能使用限制不限次数支持免费商用按次收费定制费用数万元起动手前环境检查清单这一节能帮你避免装到一半发现硬件不够的返工按条目逐项打勾。系统Windows 10 19042.1526 及以上走 Docker Desktop WSL或 Ubuntu 22.04 DesktopWindows 需有 D 盘存数字人和作品数据。NVIDIA 显卡且驱动装好必填项所有算力都在本地没有显卡三个服务起不来。Docker 与 docker-compose 已安装Docker 引擎处于运行状态。硬件配置参考数值来自项目文档项目最低能跑通更从容CPUi5-13400Fi7-13700K内存32GB16G 大概率起不动64GB显卡RTX 4070必须 NVIDIACUDA 加速RTX 4090磁盘空闲Windows 需 C 盘 100G D 盘 30GLinux 需 100G200GB首次网络镜像下载约 70G建议连 WiFi—C 盘空闲不足 100G 时可以把 Docker 的 WSL 磁盘镜像挪到别的盘进入 Docker Desktop 的 Settings → Resources → Advanced用 Browse 把 Disk image location 指到空闲大于 100G 的磁盘。三步跑通部署按顺序做完下面三件事就能在 Docker 面板里看到三个 Running 的服务容器。1. 获取代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar提示Windows 机器需先执行wsl --install安装 WSL、再wsl --update更新然后装好 Docker Desktop否则容器起不来。完成的信号Docker Desktop 左下角显示 Engine running。2. 启动服务端容器cd deploy docker-compose up -d配置文件在 deploy/docker-compose.ymlRTX 50 系显卡改用docker-compose-5090.yml想省事可用单容器的docker-compose-lite.yml。首次启动会自动下载镜像和模型约 30 分钟、消耗 70G 左右流量。完成的信号Docker 面板里 Duix.Avatar-asr、Duix.Avatar-tts、Duix.Avatar-gen-video 三个容器均为 Runninglite 版只有一个 gen-video。3. 安装客户端并验证获取对应系统的官方安装包项目 Releases 页提供双击安装也可以拉源码自行构建。打开客户端进入首页。完成的信号首页顶部出现 Create Video 与 Create Avatar 两个入口下方 My Avatars / My Works 列表区可正常加载首次为空属于正常。核心功能实操第一个数字人与第一条口播视频这一节带你走完最小可用流程从一段 10 秒视频到一条成片口播视频。创建数字人克隆形象 声音点击首页 Create Avatar上传一段 10 秒左右的正面视频。等待系统处理程序会分离静音视频与音频完成声音克隆和形象建模。处理完成后新形象出现在 My Avatars 列表中。常见误区一视频里必须有人说话的声音。声音克隆直接取自视频音轨静音片段或没有人声的视频会直接报错。 常见误区二别戴帽子、墨镜等遮挡物光线充足、背景简单、面部清晰口型才稳定。生成口播视频点击 Create Video选中刚创建的数字人。输入文案也可直接上传现成音频。点击生成完成后视频进入 My Works 列表可播放、可下载。主界面左右分别是作品列表与数字人列表顶部两个横幅即生成视频和创建数字人的入口。它是怎么工作的看懂这条本地流水线排查问题会快很多。客户端是一个 Electron 桌面应用前端 Vue3本地 SQLite 存数据源码见 src/负责上传、任务调度和结果管理重计算全部交给三个 Docker 容器各自挂 NVIDIA GPU 运行Duix.Avatar-asr语音识别fun-asr把上传视频里的人声转成文字端口 10095Duix.Avatar-tts语音合成fish-speech用你的声音把新文本读出来端口 18180Duix.Avatar-gen-video口型合成输入音频 原视频输出口播成片端口 8383。整条链路是上传 10 秒视频 → 分离出静音视频和音频 → ASR 识别出原始文本 → TTS 用这段音频建立你的声音参考 → 生成时先把文案合成语音再由 gen-video 逐帧对齐音频做出口型。三个端口都只绑定 127.0.0.1写自动化脚本很安全具体请求参数见 README 的开放 API章节。Docker 面板左侧列表看容器状态右侧日志区可实时查看服务启动进度。能用来干什么个人创作者自媒体一人多角、课程录播、多语言口播不用每次亲自出镜。团队虚拟客服与产品介绍视频改一段文案出一条片拍摄和返工成本明显下降。行业在线教育虚拟教师、医学科普、文旅数字导览都可以先用这套本地链路做低成本原型再决定要不要上商业平台。卡住了看这里按症状 → 检查项组织先对号入座更多细节见 doc/常见问题.md。症状一docker-compose up 报连接错误、超时基本是 Docker Hub 官方源连不上在 Docker Engine 配置里添加国内镜像源 registry-mirrors 后重启引擎或开全局网络代理。在右侧配置区填入可用的镜像源地址点 Apply restart 后再拉镜像。症状二创建模特报错日志出现 Connection refusedASR 服务启动偏慢服务端刚拉起时先等几分钟再操作内存低于 32G尤其 16G可能起不来服务优先升级确认视频有声音、且是人在说话。症状三服务起不来或客户端无响应用nvidia-smi确认显卡和驱动不显示显卡就先重装驱动检查三个容器是否都 Running反复重启的容器点开 Logs 看最后报错看客户端自身日志客户端右上角 Settings → Open Log。红色圈出的区域是最后的报错堆栈提问时把这段贴出来别人能直接定位问题。参与项目社区活跃、更新频繁有四种参与方式提 PR 修 bug从拼写错误到 API 改进都算贡献。补充文档常见问题清单永远缺新系统、新显卡的部署实测记录。分享教程写你的部署过程、踩坑记录和应用案例。跟进 Issues能复现并附上日志能显著缩短修复周期。下一步就一件按三步跑通部署把环境拉起来用 10 秒视频克隆一个自己生成第一条口播视频中途卡住回来按症状查卡住了看这里。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表