十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Duix.Avatar完全指南:4步本地克隆你的AI数字人,免费生成口播视频

Duix.Avatar完全指南:4步本地克隆你的AI数字人,免费生成口播视频 Duix.Avatar完全指南4步本地克隆你的AI数字人免费生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar是一款完全开源、免费的AI数字人数字分身工具上传一段10秒的视频就能克隆你的形象和声音输入文案即可自动生成口播视频。整个过程离线运行在你自己的电脑上不联网、视频素材不上传第三方服务器、软件费用为0用户量或营收达到一定规模的企业需签署商业许可协议详见仓库根目录的LICENSE。 它适合谁先看看是不是你自媒体创作者批量产出口播短视频不同平台用不同形象保持品牌一致企业市场/行政快速制作产品介绍、内部培训视频不用约拍摄和后期老师与培训师统一课程讲师形象课件一次制作反复使用开发者本地部署后通过开放API接入自己的业务系统注重隐私的个人视频和声音素材始终保存在本地硬盘断网也能用与商业数字人服务相比这条路线的总成本是0不付授权费、不按次收费唯一的投入是你现有的电脑。整套工具分两部分服务端承担全部AI算力面部识别、声音合成、口型渲染客户端是纯图形化界面。不想碰代码的你全程只需敲1条命令其余都是鼠标点选。️ 环境准备与一键部署核对4项配置5步跑起来配置要求一览表项目要求说明系统Windows 1019042.1526及以上/ Ubuntu 22.04其他Linux版本未做验证显卡NVIDIA显卡RTX 30/40/50系列必须正确安装驱动否则服务无法启动内存建议32GB最低16GB16GB可能无法启动ASR服务硬盘WindowsC盘≥100G D盘≥30GUbuntu≥100GC盘存镜像D盘存模型和作品注意区分lite精简版和完整版精简版只启动1个视频合成服务镜像小、占盘少适合低配机器完整版启动3个服务覆盖克隆形象声音合成口型驱动的完整流程。Ubuntu装Docker本身很简单2条命令搞定sudo apt update sudo apt install -y docker.io docker-compose装完用 docker --version 确认版本号再配置NVIDIA Container Toolkit让Docker能调用显卡装好后执行 nvidia-smi 能看到显卡信息即成功。5步部署步骤更新WSLWindows专属未安装过先执行 wsl --install网络原因失败就多试几次然后执行 wsl --update安装Docker Desktop从Docker官网下载安装包首次运行接受协议并跳过登录获取项目代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar一键启动服务在deploy目录执行下载镜像约70G、耗时约30分钟建议连WiFidocker-compose up -dUbuntu用户改用 docker-compose -f docker-compose-linux.yml up -d精简版则用 docker-compose -f docker-compose-lite.yml up -d 5. 安装客户端从项目发布页下载官方安装包Windows双击 Duix.Avatar-x.x.x-setup.exe 安装Ubuntu双击 Duix.Avatar-x.x.x.AppImage 直接运行若打不开在终端加 --no-sandbox 参数执行成功的标志Docker Desktop中出现3个服务Duix.Avatar-asr、fish-speech、Duix.Avatar-gen-video状态全部显示Running。部署完成后这3个服务在后台各管一段流程了解它们的分工排错时能立刻定位卡在哪一环Duix.Avatar-asr转写你素材视频里的人说了什么为声音克隆提供参考文本fish-speech学习你的音色之后用你的声音朗读任意文案Duix.Avatar-gen-video让模型的口型对齐音频渲染出最终视频如果C盘空闲不足100G可以在Docker Desktop的 Settings → Resources 里点 Browse 把磁盘镜像的存放位置挪到空间更大的磁盘 实战演练4步做出你的第一个数字人口播视频素材挑选要点决定克隆效果时长10-20秒最合适太短特征不够太长处理变慢声音视频中的人必须清晰说话程序用这段声音克隆你的音色无声视频会直接失败画面正面角度、光线均匀不用手和道具挡脸背景纯色或简单背景面部识别更稳定格式MP4、MOV等常见格式都可以操作4步上传素材首页点击 Create Avatar选择准备好的视频系统自动提取面部和声音特征约3-5分钟确认形象训练完成后My Avatars 列表里会出现你的模型缩略图可以命名管理写文案选中模型输入口播文本支持中、英、日、韩、法、德、阿拉伯、西语8种语言查看作品生成完成后到 My Works 列表预览口型与音频已自动对齐可直接导出点击生成后后台其实走的是三段流水线TTS服务先用你的克隆音色把文案读成音频视频渲染服务再让模型口型逐帧对齐音频最后合成输出。你在客户端看到的进度条就是按这个顺序往前走的。客户端首页就是工作区上方是 Create Avatar克隆形象和 Create Video生成视频两个入口下方是模型列表My Works 页面汇总你生成的所有口播视频右上角 Settings 菜单里的 Open Log 可以随时打开客户端日志排查问题用得上 常见问题与排查5个高频问题一次讲清1. 启动服务时镜像下载超时现象执行 docker-compose up -d 报 request canceled、context canceled 等错误。原因Docker Hub官方镜像源连接不稳定。解决打开Docker Desktop → Settings → Docker Engine在JSON配置里加上 registry-mirrors 国内镜像源列表点 Apply restart 后重新执行启动命令。Ubuntu则在 /etc/docker/daemon.json 里加同样的配置并重启Docker服务。2. 创建模特失败提示视频不可用现象上传视频、训练环节报错模型生成不出来。原因视频没有声音或声音不是本人在说话。解决重新录一段10-20秒、本人清晰说话的素材再上传。3. 定制模特报 Connection refused现象克隆形象时日志出现 Connection refused。原因Duix.Avatar-asr服务启动较慢还没就绪就被调用内存只有16G的机器可能直接起不来。解决等3个服务Running后再等2-3分钟开始克隆仍失败就升级内存到32G。4. 视频生成进度卡住或fish-speech容器反复重启现象进度停在某个百分比比如20%长时间不完成或音频容器一直在重启。原因音频合成服务内部报错常见于文件路径或权限问题。解决打开Docker Desktop找到对应容器点 Logs 页查看具体报错客户端侧也可通过 Settings → Open Log 查看日志两边对照定位。5. 服务起不来或Ubuntu上双击客户端没反应现象3个服务迟迟到不了Running或Ubuntu上AppImage双击后无响应。原因前者多半是显卡驱动没装好或磁盘空间不足本项目全部算力依赖本地NVIDIA显卡后者以root身份进桌面时沙箱机制会阻止运行。解决先执行 nvidia-smi 验证驱动再检查磁盘剩余空间Ubuntu改用终端执行 ./Duix.Avatar-x.x.x.AppImage --no-sandbox 启动。提问前先做3项自查① 3个服务是否全部Running② 终端执行 nvidia-smi 能否正常显示显卡信息③ 客户端和服务端是否都更新到最新版服务端在deploy目录重跑一次 docker-compose up -d 即可。⚙️ 进阶与性能API批量调用和提速优化用开放API接入你的业务Docker启动后服务端会在本地 127.0.0.1 暴露接口4个接口串起完整链路参考实现可直接看对应源码环节接口作用参考文件模特训练18180端口 /v1/preprocess_and_tran返回声音参考信息src/main/service/model.js音频合成18180端口 /v1/invoke用克隆音色朗读文案src/main/service/voice.js视频合成8383端口 /easy/submit提交音频和视频任务src/main/service/video.js进度查询8383端口 /easy/query用任务编号轮询状态src/main/service/video.js所有接口只监听本地回环地址局域网内其他设备无法调用这部分安全性天然有保障。批量处理的思路很简单把模型训练接口返回的参考信息存好之后每条文案都按音频合成 → 视频合成 → 轮询到完成 → 保存成品的固定套路走。写个小脚本或挂个定时任务就能让数字人夜间自动产出几十条口播视频。硬件与速度参考档位显卡内存速度参考入门RTX 3060 12G16G每个视频几分钟推荐RTX 4070 12G32G每个视频约1-2分钟专业RTX 4090 24G64G每个视频1分钟内显存只有8G的机器建议先用lite版跑通完整流程确认效果后再决定是否升级硬件。让生成更顺手的3个习惯模型和作品放在SSD上加载和写入速度明显更快保持NVIDIA驱动更新50系列显卡可直接使用deploy目录里的 docker-compose-5090.yml 专属部署配置生成前关闭占用GPU的后台程序关于容量模型和作品都存在本地硬盘Windows为D盘30G足够放几十个模型空间紧张时删掉不用的模型即可立刻释放空间。✅ 现在就开始今天就能做的一件事用手机录一段10秒的正面说话视频部署完服务后拿它当第一个模特素材半小时后你就能拥有第一段数字人口播视频。中途卡住时优先查官方文档 doc/常见问题.md 和 deploy/ 目录再到项目Issues列表搜索——社区每天在处理问题单大概率已有现成答案。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表