十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Pixelle-Video 全自动短视频引擎教程:一个主题 5 分钟生成一条成片竖屏视频

Pixelle-Video 全自动短视频引擎教程:一个主题 5 分钟生成一条成片竖屏视频 Pixelle-Video 全自动短视频引擎教程一个主题 5 分钟生成一条成片竖屏视频【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video做一条 60 秒的知识口播写脚本约 1 小时、找素材约 2 小时、剪辑合成 1-2 小时全流程 4 小时起步。Pixelle-Video 是一个开源的 AI 全自动短视频引擎你输入一个主题它自动完成文案撰写、AI 配图、TTS把文字转成语音的技术解说与背景音乐铺设2-5 分钟直接产出可发布的成片。最快上手步骤5 步跑出第一条短视频拿一条能跑的环境Windows 下载一键整合包并解压Python、uv、ffmpeg 全部内置双击start_web.bat启动macOS/Linux 则执行git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video进入目录后运行uv run streamlit run web/app.py首次会自动装依赖。浏览器自动打开 http://localhost:8501展开「⚙️ 系统配置」从预设里选一个 LLM通义千问、GPT-4o、DeepSeek、Ollama 均可填 API Key 后点「保存配置」。左侧「 内容输入」选「AI 生成内容」模式输入主题例如「为什么要养成阅读习惯」分镜数保持默认 5 个。右侧点「 生成视频」进度条会依次走过生成文案、生成配图、合成语音、合成视频四段。约 2-5 分钟后成片在右侧自动播放文件同时保存在output/目录历史记录页也能随时回看。输入什么就产出什么功能分三段看你输入主题它产出分镜脚本。一句话主题交给 LLM 拆成 5 个左右带画面感的分镜每句话对应一帧画面如果你已有现成稿子切到「固定文案内容」模式直接粘贴还能选按段落、行或句子分割跳过 AI 创作环节。你输入脚本与参数它产出每一帧画面和声音。每个分镜自动生成一张配图默认 1024x1024套进 templates/ 里按竖屏 1080x1920、横屏 1920x1080、方形 1080x1080 分类的 30 多套 HTML 模板合成画面解说文本交给 TTS 工作流内置 Edge-TTS、支持声音克隆的 Index-TTS 等生成语音再叠一层 BGM——内置的default.mp3可以直接选自己的音乐文件丢进 bgm/ 文件夹也会出现。你什么都不用输入它产出成片。图片、语音、音乐自动对齐分镜合成视频进度面板会显示「分镜 3/5 - 生成插图」这类实时状态最终落盘到output/。什么人适合用三类真实场景个人知识博主一周 3-5 条口播是常态把本周选题一次输进批量模式每行一个主题第二天历史记录页躺着全部成片单条成本约 0.01-0.05 元通义千问方案。电商与品牌运营产品讲解、活动预告批量出片固定同一套视觉模板加统一的提示词前缀整个账号画面风格一眼可辨。开发者后端是独立的 FastAPI 服务见 api/工作流是 workflows/ 里的标准 ComfyUI JSON可以只取其中的文案生成或图生能力嵌入自己的系统。三种方案怎么选以及两个最常踩的坑按你的硬件和预算对号入座如果你本地有 NVIDIA 显卡6GB 以上显存选 Ollama 本地 LLM 本地 ComfyUI单条成本 0 元数据不出机器。如果你没有显卡、预算有限选通义千问 RunningHub 云端工作流约 0.01-0.05 元/条不用装任何环境。如果你追求画质上限且能接受按量付费LLM 用 GPT-4o图像/视频走直连 API 媒体模型DashScope、Kling、Seedream 等供应商在系统配置里填各家 Key 即可。两个最常见的配置错误报错现象都很典型把config.example.yaml复制成config.yaml后只填了api_keybase_url和model留空——现象是「生成文案」步骤一直报 LLM 调用失败换 API Key 也没用。工作流前缀与密钥不匹配——runninghub/前缀的工作流必须填 RunningHub API Keyselfhost/前缀的必须有本地 ComfyUI 跑在http://127.0.0.1:8188——混用的典型现象是任务永远卡在「生成配图」这一步不动。进阶技巧克隆音色、锁死画风、直连大模型1. 用 30 秒录音克隆专属音色改什么参考音频 TTS 工作流。为什么有效Index-TTS 以你的一段短录音作声线样本解说的开口就是「你」的声音账号辨识度远高于默认音色。怎么改在 WebUI「语音设置」里上传 MP3/WAV/FLAC 参考音频选择支持克隆的 TTS 工作流点「预览语音」试听确认后再跑全片。2. 用提示词前缀锁死全片画风改什么图像的prompt_prefix。为什么有效这句英文描述会在每次生图前自动拼进 prompt5 张图共用同一风格基底画面就不会逐帧漂移。怎么改在config.example.yaml的comfyui.image.prompt_prefix里写英文风格描述比如 minimalist black-and-white matchstick figure style illustration, clean lines或直接在 WebUI「提示词前缀」输入并用「预览风格」当场验证。3. 跳过 ComfyUI 直连 API 视频模型改什么系统配置里的 API 媒体模型设置。为什么有效不装 ComfyUI 也能调用 DashScope Wan、Kling、Seedance 等视频模型生成动态镜头静态配图模板之外的video_*.html视频模板就能真正跑起来。怎么改在「⚙️ 系统配置」为对应供应商填 API Key、Base URL 和代理开关再到视觉设置里选api/...工作流。深入的资源入口官方中文文档安装、配置、快速开始、声音克隆等完整教程docs/zh/模板库竖屏/横屏/方形共 30 多套 HTML 布局模板改 CSS 即可定制品牌风格templates/预置工作流图片、视频、TTS 全套 ComfyUI JSON云端与本地两套workflows/runninghub/音色清单Edge-TTS 全部可用音色的定义配语音前先来这挑pixelle_video/tts_voices.py接口服务FastAPI 实现的生成接口供程序化调用api/写在最后Pixelle-Video 最适合内容多、时间少的人——知识博主、电商运营、想低成本起号的新手。打开 http://localhost:8501 的 WebUI挑一个你早就想讲的主题输入左侧文本框2-5 分钟后output/目录里就多一条带解说、配图和 BGM 的成品竖屏视频。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表