十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Pixelle-Video 使用指南:输入一个主题,产出带配音和背景音乐的成片

Pixelle-Video 使用指南:输入一个主题,产出带配音和背景音乐的成片 Pixelle-Video 使用指南输入一个主题产出带配音和背景音乐的成片【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一个 AI 短视频自动化工具输入一个主题它自动写好文案、为每个分镜生成配图、合成 TTS 配音并配上背景音乐最后拼成竖屏或横屏的成片。本文用 10 分钟讲清它怎么跑起来、哪 3 类参数值得调以及 2~3 份可以直接照抄的场景配置。3 分钟看懂它能干什么先说结论你给它一句主题或一整段文案它还你一个能直接发布的视频文件产物存在output/目录历史任务可在界面的「历史」页回看。自动化管线按顺序做 5 件事LLM 写脚本 → 按分镜规划画面 → 逐张生成配图 → 合成配音 → 叠 BGM 并套模板渲染成片。核心逻辑在 pixelle_video/services/video.py想看实现可以从这里入手。输入方式有 3 种AI 生成给主题LLM 自己写稿、固定脚本文案照用按段落 / 行 / 句子切分、批量模式一行一个主题最多 100 个一起排队。它的能力边界也要说清这不是剪辑软件没有时间轴可拖。你能控制的是模板、图像工作流、TTS 工作流和提示词前缀合成逻辑本身是固定的。最小路径跑起来 Windows下载官方整合包解压后双击start.bat浏览器会自动打开 http://localhost:8501 。整合包内置了 Python 环境和 FFmpeg不需要你装任何东西。macOS / Linux两条命令搞定git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py这条命令让 uv 自动装好 Python 3.11 的全部依赖并启动 Streamlit 页面你需要提前装好 ffmpegbrew install ffmpeg或apt install ffmpeg。页面打开后首次使用只做一件事展开「⚙️ 系统配置」填两项——LLM下拉选通义千问 / DeepSeek / GPT-4o 等预设填 API Key和图像生成服务本地 ComfyUI 就填地址并点「测试连接」用云端就填 RunningHub Key。保存配置输入主题点「生成视频」默认 5 分镜的片子大约 2~5 分钟出片。关键参数怎么调 ️按「输入 → 生成 → 输出」链路来看每项只讲改了之后会发生什么。输入侧生成模式切到「固定脚本」后 LLM 不再写稿你的文字原样进片。切分方式决定分镜数按段落切分镜最少按句子切最多每个分镜对应一张配图和一句配音。分镜数量范围 3~30默认 5。每加 1 个就多一次配图和配音耗时大致同比例上涨。提示词前缀英文配图的风格总开关。改成Chinese ink painting, minimal, elegant所有分镜的图都会变水墨风点「预览风格」可以先生成单张确认不用整片试错。生成侧LLM 模型决定文案语气。DeepSeek 换成通义千问解说词的风格和长短都会变其他参数不用动。TTS 工作流 参考音频换工作流就是换音色和语速选支持克隆的工作流如 Index-TTS后上传 10 秒参考音频配音会变成那个声音。图像工作流在本地 ComfyUI、RunningHub 和直连模型 API 之间切换影响速度、成本和画质RunningHub 并发上限 1~10普通会员默认 1。输出侧模板命名前缀就是类型——static_纯文字排版、不生成 AI 图image_用 AI 配图做背景video_用 AI 动态视频做背景模板同时决定画幅1080x1920 / 1920x1080 / 1080x1080和文字布局默认是1080x1920/image_default.html。全部模板在 templates/ 目录按尺寸分好。BGM无 / 内置 / 自带三选一。把 MP3 丢进bgm/文件夹就会被自动扫出来人声被盖住时把音乐音量调低。按场景抄作业 竖屏知识口播推荐配置清单模板1080x1920 的static_或简约image_模板分镜数5~8LLM 选通义千问或 DeepSeekTTSEdge-TTS选清晰的音色BGM内置轻音乐3 步操作系统配置里填 LLM Key、选图像工作流保存左栏选「AI 生成」输入主题分镜拉到 5点「生成视频」2~5 分钟后得到带配音的竖屏成片横屏电影感长视频推荐配置清单模板1920x1080 的电影模板或video_动态背景模板图像工作流RunningHub 的image_flux尺寸 1024x1024分镜数8~12TTS 选低沉音色或克隆音色BGM内置电影感音乐3 步操作模板切到 1920x1080 分组点「预览模板」确认版式AI 生成模式输入主题分镜设为 10提交后盯着右栏「分镜 x/y」进度分镜越多等待越久批量产出 10 集系列批量模式推荐配置清单批量模式一行一个主题最多 100 个模板1080x1080 方形适合社媒卡片提示词前缀固定成一种风格如Minimalist black-and-white matchstick figure style分镜数、BGM、音色全系列统一3 步操作左栏勾选「批量模式」每行写一个主题确认前缀、模板、语音与单条视频配置一致提交后系统按主题排队生成逐条在历史页回看验收容易卡住的几个点 ⚠️启动后 8501 端口打不开先在终端跑ffmpeg -version报错就是 FFmpeg 没装好端口被别的进程占着也要先关掉再启动。LLM 配了一生成就失败多半是图像服务不通ComfyUI「测试连接」亮红或 RunningHub Key 填错。逐项测通再整片跑能省掉大量等待。配图风格和预想不一致前缀要用英文且对所有分镜生效。先点「预览风格」出单张确认满意了再整片生成。到底花多少钱有 0 元方案Ollama 本地 LLM 本地 ComfyUI。省钱方案是通义千问 RunningHub花费主要在配图环节。没有显卡的机器能跑吗能。图像和视频全走 RunningHub 云端工作流或直连模型 API本机只负责最后的视频合成8GB 内存就够。还能怎么玩主线之外还有几项扩展能力一句话带过入口都给你放好自定义素材上传自己的照片或视频AI 分析后反写脚本看 pixelle_video/pipelines/asset_based.py图生视频 / 数字人口播 / 动作迁移对应入口在 web/pipelines/自定义工作流把自己写的 ComfyUI JSON 放进 workflows/重启后自动出现在下拉列表模板 DIY会 HTML 的话在 templates/ 里写新模板按命名规范就能被选中API 集成uv run python api/app.py启动服务POST /api/video/generate/async提交任务、GET /api/tasks/{task_id}轮询进度定义在 api/app.py配置文件由config.example.yaml复制而来各项的读取逻辑在 pixelle_video/config/manager.py。不用背参数你的第一步很简单把服务跑起来填上 LLM Key用「为什么吃完饭会犯困」这个主题生成一个 5 分镜的竖屏视频。看完第一个成片你自然就知道该先调分镜、换音色还是换模板了。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表