
Duix.Avatar 数字分身从零跑通三步本地部署完整指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款可以完全离线运行的数字分身工具上传一段 10 秒左右的视频克隆出形象与声音之后只要输入文案就能生成口型对齐的口播视频。适合想批量出培训视频的团队、不想每期出镜的口播创作者以及需要把素材留在内网的用户。跟着这篇文章走从 clone 仓库到出第一条数字分身视频大约需要 1 小时其中近半小时是镜像自动下载不用盯着。 跑起来之前的两件事先看配置门槛所有算力都在本机完成硬件要求如下项目要求系统Windows 1019042.1526 及以上或 Ubuntu 22.04显卡NVIDIA 独显驱动已装好nvidia-smi能看到显卡内存16G 可用推荐 32G磁盘可用空间 100G 以上镜像下载约 70G软件Node.js 18、DockerWindows 需 WSL 2为什么值得自己搭一套云端数字人服务按量计费素材还要先上传本地部署后人脸视频、声音样本和成片全程不离开这台机器断网也能继续出片长期成本只有硬件本身。代价是前期要下载一次镜像且必须有一张 NVIDIA 显卡。 跟着做三步出第一个结果第一步把仓库拉到本地里面既有客户端工程也有服务端编排文件git clone https://gitcode.com/GitHub_Trending/he/HeyGem.ai cd HeyGem.ai你应看到目录里能打开deploy/文件夹。第二步启动三个后端服务语音识别、语音合成、视频合成首次运行会自动拉取镜像cd deploy docker-compose up -d你应看到Docker 中三个服务陆续变为Running首次下载约 70G、耗时半小时左右。客户端跑起来后就是这个主界面先记住它的样子。第三步安装客户端依赖并启动桌面程序npm install npm run dev你应看到弹出与上图一致的主界面顶部有 Create Video 与 Create Avatar 两个入口环境全部就绪。 拿它真正干点活两个典型工作流如果你要给多个部门各出一条培训视频可以这样走输入讲师本人 10 秒左右的口播视频要求有清晰人声再加一份课程文案。操作点 Create Avatar 完成一次形象与声音克隆之后每更新一版课件点 Create Video 粘贴新文案即可。产出口型自动对齐的口播视频文案支持中、英、日、韩等 8 种语言换新课程不用重拍讲师。如果你要连续更口播内容、但每期都不想出镜输入自己的一段自拍口播视频全程只需要拍这一次。操作建模完成后每期只改文案同一个模特反复使用界面支持管理多个数字分身。产出同一张脸的系列视频一次建模多次复用省掉每次拍摄和剪辑的时间。⚙️ 调一调让它更顺手内存改什么——WSL 2 的内存上限Docker Desktop → Settings → Resources → Advanced或用户目录下的.wslconfig文件。为什么改——镜像下载与三个容器启动都很吃内存给少了服务会起不来。改成多少——机器有 32G 内存时给 WSL 分 16G 以上更稳。存储改什么——Docker 的磁盘镜像位置同一设置页的 Disk image location。为什么改——镜像加运行数据约 70G 起步默认放 C 盘很容易塞满。改成多少——选一个剩余空间大于 100G 的盘。GPU改什么——显卡驱动Ubuntu 还需安装 NVIDIA Container Toolkit。为什么改——三个服务都依赖 nvidia 运行时没有驱动直接起不来。改成多少——nvidia-smi能正常显示显卡即达标50 系列显卡请改用docker-compose-5090.yml启动。以上参数的默认值都可以在 deploy/ 目录下的 docker-compose 文件中找到改完记得重启容器生效。️ 卡住了查这里File not exists新增模特时→ 上传的视频里没有声音或没有人说话程序取不到用于声音克隆的音频。重录一段 10 秒左右、人声清晰的口播视频确认 Docker 里三个服务都是 Running 再重试Connection refused克隆形象、训练时→ ASR 服务启动较慢或内存太小如 16G导致服务没起来。服务全部 Running 后等几分钟再操作内存吃紧时先用 lite 版docker-compose-lite.yml只跑视频合成服务更多报错场景见 doc/常见问题.md。⏩ 再进一步 下一步跑通之后还有几个方向值得试批量出片用同一个模特反复生成不同文案的视频声音克隆换一段自己的语音样本做出专属音色开放 API模特训练、音频合成、视频合成都有本地接口可以接进自己的脚本。项目更新比较频繁Ubuntu 桌面版和 NVIDIA 50 系列显卡方案都已支持遇到问题先看最新版本说明。现在打开终端把仓库 clone 下来第一条数字分身视频离你只差三条命令。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考