
Duix.Avatar30分钟免费部署本地AI数字人【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款免费开源的 AI 数字人工具本地部署后提交一段 10 秒左右的自拍视频就能克隆你的形象和声音输入文案或上传音频自动生成口播视频。全程离线、不限次数环境搭好约 30 分钟。 一段 10 秒自拍换一条不用出镜的口播视频上周一个朋友把 12 秒的自拍丢进客户端的「Create Avatar」没再露脸就拿回一条自己出镜念稿的口播视频——形象、声音、口型都是他的拍摄只花了一次。这就是 Duix.Avatar 的用法本地部署一次素材和成片都不出门。它免费且开源代码可以查看、可以改所有处理都在本机完成隐私数据不上云界面只有几个按钮不写代码也能出片。背后跑的是三个本地服务Docker打包好运行环境的集装箱一条命令起服务会拉三个容器fun-asr 做语音识别把视频里的话转成文字fish-speech 做语音合成用克隆出来的声音读你的文案duix.avatar 做视频合成让嘴型跟着音频动。素材进来先被拆成无声视频和音频声音克隆、文字合成、画面合成全部在 127.0.0.1 上完成断网也能跑。能力讲完了下面按一条时间线把它跑起来确认硬件、装 Docker、起服务、装客户端。⚙️ 部署时间线从确认硬件到三个服务跑通硬件和磁盘先对个齐系统Windows 10 19042.1526 以上或 Ubuntu 22.04 Desktop显卡NVIDIA 显卡并装好最新驱动推荐配置为 RTX 4070 级别这是硬性要求内存32G 及以上16G 的机器语音识别服务可能起不来磁盘C 盘留 100G 以上放 Docker 镜像D 盘留 30G 以上存素材和作品C 盘不够 100G 时装完 Docker 后在设置里把 Disk image location 挪到空间更大的盘再 Apply restart。Docker 装好把三个服务拉起来先检查 WSLWindows 里跑 Linux 的虚拟壳wsl --list --verbose没装过就装上装完顺手更新wsl --install wsl --update然后从 Docker 官网装 Docker Desktop按 CPU 架构选安装包装完验证显卡驱动是否就位nvidia-smi能显示显卡信息才算通过。接着拿项目代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar进入 deploy/ 目录后台拉取并启动三个服务cd Duix-Avatar/deploy docker-compose up -dcompose 文件按机器换docker-compose -f docker-compose-linux.yml up -d docker-compose -f docker-compose-5090.yml up -d docker-compose -f docker-compose-lite.yml up -d第一行给 Ubuntu第二行给 NVIDIA 50 系显卡5090 已验证第三行是 lite 精简版只起一个视频合成服务。等约 30 分钟下载约 70G 流量建议连 WiFiDocker 里出现三个 Running 的服务即成功。最后从项目发布页下载对应系统的客户端安装包Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 直接运行.AppImageroot 用户跑不起来时在终端加参数./Duix.Avatar-x.x.x.AppImage --no-sandbox服务都绿了先别急着建数字人——下面三条坑前人替你踩过。️ 部署前先看这 3 个最容易踩的坑拉镜像超时三个服务起不来。Docker Hub 连接不稳定在 Docker Desktop 的 Docker Engine 配置里加 registry-mirrors镜像源镜像下载的国内中转站保存后 Apply restart再重跑docker-compose up -d。在 daemon.json 里加一段镜像源配置{ registry-mirrors: [ https://hub.littlediary.cn, https://docker.1panelproxy.com ] }创建模特报 Connection refused。语音识别服务启动慢服务端拉起来后等几分钟再开始克隆内存小于 32G 时也可能起不来。另外记住克隆用的素材必须有人声程序要拿这段声音做声音克隆无声视频必然报错。视频生成卡在 20%。多半是音频处理环节出错。点右上角设置里的「Open Log」打开 main.log 按报错定位服务端的问题则去对应 Docker 服务的日志里找。环境没坑了开始真正用。先拍素材。 素材怎么拍10~20 秒必须带人声时长 10~20 秒太短特征不够太长处理变慢。画面要求不高但四条尽量做到脸部光线均匀、正面拍摄、背景简洁、说话清晰。声音是硬指标克隆的音色完全来自素材里的人声。克隆形象与生成视频客户端三步点「Create Avatar」上传素材系统自动提取面部和声音特征克隆出一个数字人模型。在「My Avatars」选中模型输入文案或上传音频。点生成耗时几分钟到十几分钟取决于显卡以实际为准成片自动归档到「My Works」。文案支持中、英、日、韩、法、德、阿拉伯、西语 8 种语言同一个模型可以换语言反复出片。界面够用的到此为止要把生成接进自己的流程看这段。 想绕过界面直接调本地 APIDocker 启动后会在本机暴露两个端口用 HTTP 请求代替点击API用接口指令驱动服务的通道。模特训练和音频合成走127.0.0.1:18180视频合成与进度查询走127.0.0.1:8383。调接口前先确认三个服务都 Running点开容器就能看到运行日志具体字段和请求示例直接对照 src/main/service/video.js 的调用代码抄service 目录下三个文件分别对应模型、视频、音频。跑通之后剩下的事很简单。 接下来你可以做的事照时间线完成本地部署用一段 10 秒自拍克隆第一个数字人生成第一条口播视频剩下的就是换文案批量出片。还有报错的话翻一下 doc/常见问题.md拉镜像、Connection refused、卡进度这些都有现成解法。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考