十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Duix.Avatar 免费开源 AI 数字人:30 分钟本地部署,如何克隆专属数字分身并生成口播视频

Duix.Avatar 免费开源 AI 数字人:30 分钟本地部署,如何克隆专属数字分身并生成口播视频 Duix.Avatar 免费开源 AI 数字人30 分钟本地部署如何克隆专属数字分身并生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款免费开源、支持本地部署的 AI 数字人工具。你只需上传一段 10 秒左右的视频就能克隆自己的形象和声音再输入文案即可自动生成口播视频全程离线、无需订阅。产品定位与适用人群Duix.Avatar 把数字人克隆和视频合成两件事合并在同一套本地服务里完成。它不依赖云端所有视频、音频和模型都存放在你自己的电脑上你可以自由查看、修改甚至二次开发源码拥有完整的数据控制权。它适合以下人群自媒体与内容创作者无需出镜也能保持更新频率批量产出口播内容。教师与教育机构创建统一的数字人讲师形象制作标准化教学视频。企业宣传人员搭建品牌代言数字人用于产品介绍和市场推广。技术爱好者想深入研究数字人技术、参与开源共建的开发者。选择它的核心理由是零使用成本、数据不出本机且从克隆到成片的完整流程都能在一台普通显卡电脑上跑通。环境自检先确认电脑能不能跑部署前先对照下面这张表检查你的机器避免装到一半卡在显卡环节。项目要求验证方式操作系统Windows 1019042.1526 及以上或 Ubuntu 22.04系统设置中查看版本显卡NVIDIA 显卡已安装最新驱动命令行执行nvidia-smi能显示显卡信息即驱动正常内存32GB 及以上必要任务管理器 / 系统信息查看磁盘约 100GB 空闲空间服务镜像 30GB 以上数据磁盘管理查看剩余空间推荐参考i5-13400F / RTX 4070 级别按官方推荐配置即可如果nvidia-smi报错或无输出说明显卡驱动未正确安装需要先装好驱动再继续。快速启动30 分钟完成部署整个部署分四步预计 30 分钟左右主要耗时在镜像下载约 70GB 流量建议连 WiFi。1. 获取项目代码执行git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar把代码拉到本地得到包含deploy、src等目录的完整仓库。2. 安装 DockerWindows先执行wsl --install安装 WSL再执行wsl --update更新到最新版然后安装 Docker Desktop。看到鲸鱼图标正常启动即安装成功。Ubuntu依次执行sudo apt update、sudo apt install docker.io、sudo apt install docker-compose装完运行docker --version能显示版本号即成功。小提示Docker 默认把镜像放在系统盘空间紧张时可打开 Docker 设置 → Resources → Advanced在 Disk image location 处把存储路径改到空间更大的磁盘避免 C 盘占满。3. 启动服务端进入deploy目录后按你的环境选择对应命令Windows执行docker-compose up -d自动拉取并启动三个核心服务。Windows 显存较小8GB 左右执行docker-compose -f docker-compose-lite.yml up -d只启动单个视频生成服务。Ubuntu执行docker-compose -f docker-compose-linux.yml up -d。NVIDIA 50 系列显卡执行docker-compose -f docker-compose-5090.yml up -d。预期结果Docker 中出现 3 个 Running 状态的服务lite 版本 1 个即代表服务端就绪。4. 安装客户端从项目发布页下载对应系统的安装包Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 直接运行Duix.Avatar-x.x.x.AppImageroot 用户可加--no-sandbox参数启动。客户端打开并能连上本地服务即部署完成。第一次使用从素材到成片素材要求时长1020 秒太短特征不足太长拖慢处理。内容人物正面清晰说话光线充足、背景简洁。声音必须有清晰的说话声系统要靠它做声音克隆。操作步骤打开客户端点击创建数字人选择准备好的视频并上传。系统自动分析视频提取面部特征与声音特征通常几分钟内完成。在数字人列表中选中刚创建的模型输入文案或上传音频点击生成。等待几分钟口播视频即生成完毕。结果输出位置生成完成的视频会自动进入“我的作品”列表便于统一管理和回放数字人模型则保存在“我的模型”列表中可反复用于后续生成。进阶技巧多语言内容脚本支持中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语 8 种语言。适合做本地化内容、教学视频或跨国企业宣传同一形象即可覆盖多种语言市场。批量与自动化生成服务端暴露了模型训练、音频合成、视频合成三组 API本地127.0.0.1调用你可以脚本化提交多个任务适合需要大量产出的团队。参考 模型训练源码、视频合成源码 与 音频合成源码。成片质量优化拍摄时保证面部光线均匀、角度正面、发音清晰、背景干净能显著提升口型与画面的匹配度显存紧张时改用 lite 版本也能稳定出片。排障速查现象执行docker-compose up -d时镜像拉取超时、连接失败。原因Docker Hub 官方源连接不稳定。解决在 Docker 的 daemon 配置中添加国内registry-mirrors镜像源重启 Docker 后重新拉取。现象创建数字人时报错日志提示音频文件不存在file not exists。原因上传的素材没有声音或不是人在说话无法用于声音克隆。解决换一段包含清晰说话声的视频重新上传更多细节可查 常见问题文档。现象三个服务起不来或生成进度卡住。原因显卡驱动未装好或服务版本过旧。解决用nvidia-smi确认驱动正常并到deploy目录重新执行docker-compose up -d拉取最新服务端同时把客户端更新到最新版。开始行动清单用nvidia-smi确认显卡与驱动就绪核对内存与磁盘空间。安装 Docker 并启动 WSLWindows/ docker-composeUbuntu。克隆代码进入deploy目录按平台执行对应的 compose 命令确认 3 个服务 Running。安装客户端上传一段 10 秒左右的说话视频创建第一个数字人。输入文案生成第一段口播视频进入作品列表回看效果。更多细节可查阅 常见问题 与 部署配置遇到未列出的问题可到项目社区提问热心成员会帮你一起解决。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表