
Duix.Avatar本地部署指南10秒视频克隆你的数字人在自己电脑上批量生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar是一套可在本地、全离线运行的开源数字人工具上传一段10秒左右的说话视频即可克隆你的形象和声音再输入文案或音频自动生成口播视频。本文带你走完环境准备、Docker服务启动到出片验证的完整流程一个晚上就能跑通。为什么值得在自己电脑上跑全离线模型训练与视频合成全部发生在本地GPU上视频和声音样本不出机器适合素材敏感、要求数据私密的场景。成本官方对比商用方案制作成本降低99%以上周期从数周缩到小时级一次搭好之后生成不限次数不再按条付费。可扩展仓库 deploy/ 目录里的编排文件拿来即用服务启动后会在本机暴露语音端口18180和合成端口8383接口方便接入自己的业务系统。过来人提醒只是想出几条片子8GB显存能跑的lite版就够了声音克隆和形象合成都想保留就上完整三服务。它能干什么三个能力各看三行形象与面部克隆原理face2face模型分析短视频中的五官、轮廓与表情变化重建一张可用的虚拟脸。价值10秒视频即可得到一个数字人形象支持多模型导入与随时切换。门槛只需录视频时正面、光线均匀、人声清晰不需要算法背景。声音克隆与语音合成原理合成模型以声音样本加参考文本为条件重建音色保留原声的语调和习惯。价值输入文案就能得到原声口吻的语音脚本支持中、英、日、韩、法、德、阿、西共8种语言。门槛零门槛一段10秒带人声的素材即可想调语音参数可参考 src/main/service/voice.js。文案转视频合成原理口型与音频节奏对齐音视频自动同步后输出成片。价值形象训练完即可“文案→语音→视频”一条龙进度还能通过8383接口轮询。门槛客户端界面操作即可用API集成的话参考 src/main/service/video.js。过来人提醒第一次先挑最短的10秒素材目标先出一条完整片子再谈质感。️ 硬件怎么选三档配置表档位CPU内存显卡存储可完成的任务体验档i5-12400或同级16GB8GB显存的N卡lite版SSD空闲100GB以上lite单服务、720p出片、单模型约40分钟流畅档i5-13400F或i7-1370032GBRTX 407012GBSSD空闲100GB以上完整三服务、1080p出片、单模型约20分钟批量档i7-14700或更高32–64GBRTX 409024GBSSD 100GB 1TB数据盘长视频批量合成、多模型并行训练注意NVIDIA显卡加驱动是硬门槛缺了它三个服务一个都起不来。验证方式执行下面的命令能看到显卡型号、显存和驱动版本才算通过。nvidia-smi过来人提醒内存32GB才是分水岭16GB机器上ASR服务经常起不来。 怎么跑起来准备、执行、验证第一步 准备系统、磁盘、Docker、仓库确认系统版本。Windows需10 19042.1526及以上用winver查看Ubuntu用22.04 Desktop用lsb_release -a查看。确认磁盘空间。Windows下镜像盘通常C盘需100GB以上空闲、数据盘30GB以上空闲Ubuntu需100GB以上空闲。C盘不够时在Docker Desktop的 Settings → Resources → Advanced 里点 Browse把镜像存放位置挪到大盘。安装Docker。Windows先装WSLwsl --install后wsl --update再装Docker Desktop并首次启动接受协议、跳过登录Ubuntu执行sudo apt update sudo apt install docker.io docker-compose验证方式docker --version能输出版本号。克隆代码。git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar验证方式ls能看到deploy和src两个目录。确认NVIDIA驱动已装好执行nvidia-smi复核见上一节。第二步 执行一条命令拉起服务进入部署目录启动cd deploy docker-compose up -dlite版8GB显存把文件换成docker-compose-lite.ymlUbuntu用docker-compose-linux.ymlRTX 50系显卡用同目录下的5090配置文件。首次会自动拉镜像约70GB流量耗时30分钟到2小时。 注意如果拉取超时并出现 request canceled 报错打开Docker Desktop → Docker Engine在JSON里加入 registry-mirrors 加速源点 Apply restart再重跑上一步命令。启动后先别急着开客户端。ASR服务就绪较慢等服务完全起来后至少留5分钟再操作。第三步 验证成功的三条标准docker ps里三个容器均为 Up/RunningDuix.Avatar-asr、Duix.Avatar-tts、Duix.Avatar-gen-videolite版只有一个 duix-avatar-gen-video。本机端口18180与8383处于监听状态。客户端连得上装官方客户端Windows装.exeUbuntu直接用.AppImage主界面出现“My Works”和“My Avatars”且没有离线提示。过来人提醒三个服务全部Running再去点克隆否则大概率报Connection refused。落地到谁手里两个真实用法教育批量做课前3分钟预告片素材8秒正面口播片段1080p人声单一、无背景音乐。流程训练一次形象模型课程文案按每段不超300字切分逐段生成再用自己的剪辑工具拼接。建议参数语速约200字/分钟一位老师一个模型模型可长期复用并随形象更新替换。自媒体虚拟主播口播切片素材12秒vlog开场片段带一次微笑不低于720p。流程客户端里输入当日选题得到语音一键合成视频成片直接导出发平台。建议参数单条控制在60秒以内方便控制合成时长8GB显存下批量出片约5–8分钟/分钟视频。过来人提醒一个定位一个模型同一张脸跨栏目乱用观众很快会腻。文档、配置和帮助去哪找常见问题的现成解法仓库里的 doc/常见问题.md 收录了拉镜像失败、建形象报错等案例提问前照自查清单过一遍。启动配置deploy/ 目录四个编排文件分别对应Windows完整、lite、Ubuntu与5090场景。API示例语音与合成接口启动后在本机即可调用示例代码见 src/main/service/video.js可直接抄走做集成。社区仓库的Issues区每天更新先查再问很多坑已经有人替你踩过。过来人提醒项目更新比较频繁先确认客户端和服务端都是最新版再谈排障。 四个高频卡点症状→原因→解法1. 拉镜像失败提示 request canceled / context canceled症状docker-compose up -d执行后出现 ✘连接 registry-1.docker.io 超时。可能原因Docker Hub官方源不稳定。解决方案在Docker Engine的JSON里加 registry-mirrors 加速源重启Docker后重新拉取。2. 新建形象报错视频必须带声音症状上传视频创建形象后立刻失败。可能原因素材无声音或声音不是人在说话程序要靠这段人声做声音克隆。解决方案重录一段10秒连续说话的片段再上传。3. 克隆时出现 Connection refused症状日志里ASR websocket连接失败报NoneType object has no attribute send。可能原因ASR服务就绪慢或内存太小16GB可能直接起不来。解决方案服务就绪后等5–10分钟再操作仍失败就把内存升到32GB。4. 镜像存放位置突然爆满症状拉取中途卡死Docker Desktop提示磁盘空间不足。可能原因约100GB镜像全部落在默认盘位置。解决方案Settings → Resources 里把镜像位置改到大盘再重启Docker。全离线、不限次、一次投入长期复用这是自己跑数字人的全部价值。打开deploy目录今晚把服务拉起来产出第一条口播视频。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考