十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Duix.Avatar 完全教程:10秒视频免费克隆数字人,本地离线生成口播视频

Duix.Avatar 完全教程:10秒视频免费克隆数字人,本地离线生成口播视频 Duix.Avatar 完全教程10秒视频免费克隆数字人本地离线生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一个可以完全在本地离线运行的开源数字人工具上传一段 10 秒左右的视频就能克隆你的形象和声音之后只要输入文案或上传一段音频它就能自动生成你这个数字分身的口播视频。全程不联网素材和成片都只留在你自己的电脑上。每次改一版脚本就要重新拍是不是特别崩溃假设你要给公司内部培训录一批讲解视频。第一版录到一半市场那边说改两句口播词——对不起重新拍再录完说换个结尾——继续重拍。更扎心的是如果出镜的是真人片约、档期、妆造都是成本如果你本身不爱出镜这个需求基本就卡死了。Duix.Avatar 想解决的正是这件事先花 10 秒拍一次把形象声音克隆成数字人后面不管改多少版脚本都是文字驱动自动生成视频一次克隆反复使用。为什么选它三个理由够说服你过渡一句市面上数字人工具不少为什么偏偏是它全离线隐私放心所有算力都在你的本地显卡上跑形象和音频不上传到任何服务器商用场景里这一点非常关键。10 秒视频同时克隆脸和声音传统方案往往要分别录形象、录音色它一段说话的视频就够用口型同步也是自动完成的。免费且可商用开源协议下全球免费商用用户量超 10 万或年营收超 1000 万美元的企业需签商业许可见 LICENSE个人和小团队基本零成本。显存要求也不苛刻8G 显存的卡有对应的 lite 轻量版本可以跑。从零到第一次成功运行最短路径过渡一句说回正事先把它跑起来看到画面再谈别的。先做一件事确认你的电脑有 NVIDIA 显卡并且装好了驱动。打开命令行执行下面的命令能看到显卡信息就说明硬件没问题本项目所有计算都依赖 NVIDIA 显卡这是硬性条件驱动请到 NVIDIA 官网按你的显卡型号下载最新版nvidia-smi这一步确认显卡正常后把源码拉下来git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar 小贴士它由服务端 客户端两部分组成。服务端是 Docker 里的 AI 模型首次拉取约 70G 镜像务必连 WiFi客户端是一个桌面软件。下面分开装。启动服务端在仓库的deploy/目录执行Windows 用默认文件Linux/Ubuntu 换-f docker-compose-linux.yml8G 显存换成-f docker-compose-lite.ymlcd deploy docker-compose up -d然后耐心等半小时左右下载镜像的时间。打开 Docker 看到三个服务都是 Running 状态服务端就算成功了lite 版本只有一个服务duix-avatar-gen-video。启动客户端回到仓库根目录装依赖再启动需要 Node.js 18npm install npm run dev看到弹出一个写着 Create Video / Create Avatar 的桌面窗口就代表你完整跑通了一遍把核心功能玩明白先造分身再产视频过渡一句软件跑起来了两个入口分别负责造人和拍片搞懂这两步剩下的都是重复劳动。第一步创建数字人Create Avatar。上传一段 10 秒左右你正脸说话的视频程序会自动拆出画面和声音画面用来建你的数字形象声音用来克隆你的音色。⚠️ 提醒这段视频必须带人声且是人在说话——声音克隆全靠它。上传纯背景音乐或者静默视频创建必失败。第二步创建视频Create Video。选好刚建好的形象然后二选一直接输入文案系统自动配音或上传一段现成的音频。提交后系统自动对齐口型、合成视频几分钟到十几分钟取决于显卡和时长即可在 My Works 列表里看到成片。想让效果更好视频用 1080p、光线均匀、正对镜头、说话时别大幅度转头这些老演员经验在数字人身上同样适用。一个完整场景走一遍60 秒产品介绍口播过渡一句把前面的步骤串起来按这个流程走完你就有第一条成片了。手机架稳正对镜头录 10 秒自我介绍语气就是希望数字人说话时的语气克隆的是你的声音语调也会一起被学走。客户端点Create Avatar上传等待训练完成My Avatars 里出现你的数字分身。打开Create Video选中这个形象粘贴 60 秒左右的产品介绍文案。点生成去倒杯水回来——任务完成后列表里多了一条作品点开即可播放或保存到本地。想改文案复制这条任务改文字重新生成就行形象和声音不用动这就是一次克隆反复用的含义。踩坑记录与提速技巧过渡一句第一次部署基本都会遇到一两个坑我把社区里出现频率最高的几个整理好了对号入座。坑一Docker 拉镜像超时、转圈半天。这是 Docker Hub 官方源连接不稳定的锅。解决方式是给 Docker 配置国内镜像源Docker Desktop 右上角齿轮进 Settings在 Docker Engine 的 JSON 里加上registry-mirrors数组具体可用的镜像源地址可参考 常见问题 中的配置示例保存后重启 Docker 再执行docker-compose up -d。坑二C 盘空间不够 100G。Docker 的虚拟磁盘默认放在 C 盘可以把它挪到空间更大的盘Settings → Resources → Advanced点 Disk image location 旁的 Browse 换个位置即可。坑三服务起不来 / 功能报错。先查两个地方——客户端日志右上角 Setting 菜单里点 Open Log服务端日志在 Docker 里点开对应容器的 Logs 页签看到红色报错就右键复制到社区求助。经验上90% 的服务起不来都是显卡驱动没装好nvidia-smi先验一遍创建模特报错基本都是上传的视频没有人声。提速技巧显存 8G 左右的卡用 lite 版docker-compose-lite.yml生成进度卡在 20% 附近不动通常是显存吃紧降低输出分辨率或分批处理就能过另外服务端更新很频繁遇到问题先在deploy/目录重新docker-compose up -d拉一次新版说不定已经修好了。接下来可以玩什么过渡一句能出片之后这条路还能延伸出不少玩法。接进自己的系统服务端启动后会在本地开放 API模特训练、音频合成、视频合成三个接口参考 src/main/service/ 下的调用代码就能把自己的后台、小程序接上实现批量自动生成口播视频。做多语言口播文案支持中、英、日、韩、法、德、阿、西八种语言换个语言版本的产品介绍只需要重新生成一次。保持更新服务端在deploy/目录重新执行docker-compose up -d即可客户端拉取最新代码重新构建遇到新坑先看 doc/常见问题.md那里有完整的自查步骤和报错对照。现在先录那 10 秒的视频吧——你的数字分身离上线只差一次docker-compose up -d。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表