十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Duix.Avatar 本地部署指南:用一段 10 秒视频克隆数字人,离线生成口播视频

Duix.Avatar 本地部署指南:用一段 10 秒视频克隆数字人,离线生成口播视频 Duix.Avatar 本地部署指南用一段 10 秒视频克隆数字人离线生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款开源的数字人AI Avatar工具包支持全离线运行提交一段 10 秒左右的真人视频即可克隆形象和声音之后输入文案或上传音频就能自动生成口型同步的播报视频。对需要制作口播内容、又不想把素材上传到第三方平台的开发者来说这是一条可以在自己电脑上完整跑通的路径。部署前需要检查什么Duix.Avatar 的架构是「桌面客户端 Docker 服务端」所有算力都在本地没有 NVIDIA 显卡就启动不了核心服务。开始前先对照硬件与软件要求系统Windows 10 19042.1526 及以上或 Ubuntu 22.04 Desktop显卡必须为 NVIDIA 显卡并正确安装驱动官方已验证 RTX 40 系50 系有专用方案内存32GB 及以上必要16GB 可能无法启动 ASR 服务磁盘数据盘 30GBDocker 镜像存储盘 100GB首次拉取镜像约消耗 70GB 流量软件Node.js 18、DockerWindows 需先安装 WSL如何完成首次运行以最常用的 Windows 环境为例最短路径分三步。第一步获取项目源码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar第二步启动服务端。项目依赖三个 Docker 镜像guiji2025/fun-asr、guiji2025/fish-speech-ziming、guiji2025/duix.avatar在仓库的/deploy目录执行docker-compose up -d耐心等待半小时左右取决于网速Docker 中出现三个 Running 状态的服务即表示服务端就绪。显存较小的机器可改用docker-compose-lite.yml精简配置50 系显卡含已装 CUDA 12.8 的 30/40 系使用docker-compose-5090.yml。Linux 用户则对应使用docker-compose-linux.yml。 如果 C 盘空间不足 100GB安装 Docker 后可在设置中把镜像存储改到其他磁盘。第三步运行客户端。从官方 Releases 下载对应平台的安装包Windows 为Duix.Avatar-x.x.x-setup.exeLinux 为 AppImage无需安装双击启动后连接本机127.0.0.1的服务端即可。功能验证三个典型场景确认效果服务端就绪后建议按以下顺序验证每步都对应一个可感知的结果克隆形象与声音在客户端新建模特上传一段10 秒左右、本人正对镜头说话的视频。注意素材必须有声音且是人在说话程序会用这段声音做克隆静音视频会直接报错。文字驱动输入一段文案系统先用克隆的声音合成音频再生成口型匹配的视频。重点听音色相似度、看口型是否自然。音频驱动上传一段现成音频文件跳过文字转语音环节直接合成。适合对发音有严格要求的场景。生成的视频支持中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语共八种语言脚本。如果口型效果不理想优先换用更清晰、光照均匀、语速平稳的原片重新训练。生成失败或服务不稳定时如何排查按出现频率从高到低先自查以下四点拉镜像失败request canceled / context canceledDocker Hub 官方源不稳定在/etc/docker/daemon.json中配置registry-mirrors国内镜像源后重试Windows 用户可在 Docker Desktop 设置中完成同样配置。新增模特报 Connection refusedASR 服务fun-asr冷启动较慢服务端刚启动后请等待几分钟再克隆形象内存过小如 16GB也会导致该服务起不来。服务状态异常确认 Docker 中三个服务全部为 Running确认nvidia-smi能正常输出显卡信息。升级到最新版本服务端在/deploy重新执行docker-compose up -d客户端拉取代码后重新构建社区迭代很快很多已知问题新版已修复。排查时记得保留日志客户端可在日志入口导出日志文件服务端直接点击对应 Docker 容器复制日志附上完整日志能显著加快社区定位问题的速度。进阶开放 API 与后续使用Duix.Avatar 的服务端在本地暴露了模特训练和视频合成两组 API基于127.0.0.1调用覆盖形象训练、音频合成、视频提交与进度查询等接口适合把数字人能力嵌入自己的业务系统。接口定义可直接参考仓库中的 src/main/service/ 下的model.js、voice.js、video.js具体参数以仓库内 README 的最新说明为准。几点使用边界提醒授权支持全球免费商用但用户量超过 10 万或年营收达 1000 万美元以上的企业需签署商业许可协议商用前请阅读 LICENSE 与协议文档。能力边界本项目定位是数字人克隆与非实时视频合成不支持实时交互式对话。更新节奏服务端与客户端版本更新较快遇到问题先确认双方都是最新版本再看社区 Issue 区同类问题大概率已有答案。准备好 NVIDIA 显卡和 100GB 磁盘后从docker-compose up -d到产出第一条数字人视频通常一个下午就能完成。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表