
免费开源AI数字人Duix.Avatar本地部署30分钟从零做出第一条口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款免费开源的 AI 数字人工具上传一段 10 秒左右的说话视频克隆你的形象和声音输入文字就能生成口播视频。全部在本地部署不联网、不收费。这篇教程带你从装环境到出第一条成片。 先说场景口播视频不用再亲自出镜小林每周五要交三条新的口播视频。自己出镜很麻烦买商业数字人服务每月好几千块。她的做法是拍了 10 秒对着镜头说话的片段之后每次写完文案往 Duix.Avatar 里一贴成片就出来了——视频里的“她”是她自己但她不用再重新拍摄、不用重新配音。 环境检查本地部署前确认这几项装之前先对照清单系统Windows 1019042.1526 或更高版本或 Ubuntu 22.04 桌面版显卡NVIDIA 显卡并装好驱动必要所有算力都跑在本地显卡上内存32GB及以上推荐配置参考i5-13400F RTX 4070 32G 内存磁盘Windows 需要 C 盘100GB以上空闲放 Docker 镜像、D 盘30GB以上存数字人和作品Ubuntu 需要100GB以上空闲要装的工具Windows 装 Docker Desktop依赖 WSLUbuntu 装 docker.io、docker-compose 和 NVIDIA Container Toolkit从源码构建客户端才需要 Node.js 18确认环境是否就绪只要一行终端执行nvidia-smi能显示出显卡信息说明驱动正常docker --version能输出版本号就可以开始。️ 实操走一遍从装 Docker 到出第一条口播视频第 1 步安装 Docker 并调整镜像存放路径操作Windows 先在终端执行wsl --install安装 WSL首次会要求设置用户名和密码网络不畅就多试几次更新 WSL 后按 CPU 架构下载安装 Docker DesktopUbuntu 执行sudo apt install docker.io docker-compose即可。装好 Docker 后有一个关键动作打开 Docker Desktop 的“设置 → Resources → Advanced”把“Disk image location”改到一个剩余100GB以上空间的分区应用设置后 Docker 会自动重启。Docker Desktop“Resources → Advanced”把镜像存储路径改到 100GB 以上的分区避免系统盘被占满预期结果任务栏 Docker 图标显示引擎运行中终端里docker --version能输出版本号。易踩坑点镜像默认存放在 C 盘而本项目镜像总共约70GB不改存放位置的话系统盘会很快告急。第 2 步启动数字人服务端操作先git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar获取代码进入代码里的deploy目录部署文件都在 deploy/ 下执行docker-compose up -dUbuntu 用户给同一条命令加上文件参数docker-compose -f docker-compose-linux.yml up -d。这一步会拉取约70GB镜像耗时30 分钟左右取决于网速建议连 Wi-Fi。预期结果Docker 中出现Duix.Avatar-asr、Duix.Avatar-tts、Duix.Avatar-gen-video三个服务且均为Running如果你走精简版则只有一个Duix.Avatar-gen-video。易踩坑点拉镜像超时、报连接错误基本是 Docker Hub 源的问题见下文避坑速查第一条用的是NVIDIA 50 系显卡如 5090的话换用docker-compose -f docker-compose-5090.yml up -d。第 3 步安装客户端操作到项目发布页下载对应安装包Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 双击.AppImage文件即可运行无需安装。客户端主界面上方“Create Video”“Create Avatar”两个入口下方是 My Works 与 My Avatars 列表预期结果打开主界面能看到“Create Video”和“Create Avatar”两个大按钮下方是 My Works 和 My Avatars 两个列表。易踩坑点Ubuntu 下如果以 root 用户进入桌面直接双击 AppImage 可能起不来需要在终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox靠--no-sandbox参数启动。第 4 步创建你的第一个数字人操作准备一段10-20 秒的视频人正对镜头、说话清楚、光线均匀、背景干净。客户端点“Create Avatar”上传视频然后等训练跑完。预期结果训练完成耗时随显卡性能变化期间别关客户端后“My Avatars”列表里多出一个你的数字人形象。易踩坑点视频里必须有人物清晰的说话声系统要拿这段音频做声音克隆纯画面或配乐视频会在建模型时报错。第 5 步生成第一条口播视频操作在 My Avatars 选中刚建好的形象进入 Create Video输入文案或上传自己的音频提交生成。预期结果生成完成后成片出现在 My Works 列表里可直接下载保存。易踩坑点首次启动时 ASR 服务需要一段时间初始化服务端刚拉起来就克隆可能报错等几分钟再试生成卡住时先打开 Docker 查看三个服务的日志定位原因。Docker Desktop 里可以逐个打开服务日志定位生成卡住或报错的原因还能做什么八种语言口播脚本支持中文、英文、日文、韩文、德文、法文、阿拉伯文、西班牙文同一篇文案换个语言就能出一版本地化视频。本地开放 API服务端启动后模特训练、音频合成、视频合成三组接口都在本地暴露调用流程可参考 src/main/service/方便把数字人接进自己的业务流程。多模型管理客户端可导入多个数字人并一键切换机器配置紧张时可改用精简版部署只保留视频合成一个服务。 避坑速查常见问题与解决办法现象docker-compose up -d拉镜像失败报超时或连接被取消。判断连 Docker Hub 官方源不稳定。解决在 Docker 设置中打开daemon.json添加registry-mirrors配置国内镜像源重启 Docker 再拉。Docker 配置 registry-mirrors 镜像源解决镜像拉取超时现象新增模特形象时报错。判断视频里没有说话声音或人声不清晰。解决重拍一段10-20 秒、人物说话清晰的片段保证音轨干净后重新上传。现象服务端启动几分钟后克隆报 Connection refused。判断ASR 服务启动慢或内存不足。解决等服务起来几分钟后再操作内存只有 16G 的机器可能根本起不动服务建议升到 32G。现象服务完全起不来。判断没有 NVIDIA 显卡或驱动没装好。解决用nvidia-smi确认能显示显卡信息安装或更新驱动后再启动服务。适合谁自媒体创作者不用出镜、不用重新配音文案进去视频出来口播内容可以持续高频产出。老师和企业培训做一个统一的数字人讲师批量产出课程、宣讲类口播视频风格始终一致。想接入业务的团队源码可自由修改本地 API 可直接调用免费商用用户量超 10 万或年营收超 1000 万美元的企业需签署商业许可协议。原理一句话底层是三个本地服务语音识别把你视频里的话转成文字、语音合成把新文案变成你的声音、视频合成让你的面部跟着音频动。训练就是从那段 10 秒视频里提取面部与声音特征存成模型之后“文字 → 你的声音 → 对口型视频”全部在本地算完数据不出你的机器。到这里一段 10 秒视频、一套 Docker 环境、30 分钟左右的等待就能让你拥有一个免费、完全本地的 AI 数字人。遇到问题先翻 doc/常见问题.md再在项目 Issue 列表里搜一搜大多已有答案。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考