十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Pixelle-Video:主题到成片的全自动 AI 短视频引擎,从零到上手

Pixelle-Video:主题到成片的全自动 AI 短视频引擎,从零到上手 Pixelle-Video主题到成片的全自动 AI 短视频引擎从零到上手【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一款输入主题即可自动产出成片的 AI 短视频引擎覆盖文案、配图、配音、配乐与合成适合个人创作者和小团队批量出片。项目本身免费Apache 2.0LLM 可选本地 Ollama 实现零成本也可以接通义千问、OpenAI 等云端 API环境门槛主要是 Python 包管理器 uv 和 ffmpeg。最短路径clone 仓库 → 跑./start_web.sh→ 在网页里填 API Key → 输一个主题。从安装到拿到第一个成片整个过程都在 Web 界面里完成命令行部分只有两行。克隆仓库并启动git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video进入目录后执行./start_web.sh内部就是uv run streamlit run web/app.py依赖会自动装浏览器自动打开http://localhost:8501。Windows 用户也可以直接下载整合包双击start.bat跳过环境准备。系统配置面板首次必填LLM 配置写文案用。选预设通义千问 / GPT-4o / DeepSeek / Ollama会自动填 base_url 和 model只需补 API KeyOllama 走本地http://localhost:11434/v1不花钱。ComfyUI / RunningHub 配置出图和出视频的工作流引擎。本地 ComfyUI 默认http://127.0.0.1:8188点「测试连接」确认没显卡就填 RunningHub 的 API Keyrunninghub_concurrent_limit默认 1。API 媒体模型配置可选绕过 ComfyUI 直连 DashScope、OpenAI、ARK、Kling 等供应商按需填密钥和 Base URL。拿到第一个视频左侧选「AI 生成内容」主题写「为什么要养成阅读习惯」这类一句话即可分镜数默认 5模板保持默认1080x1920/image_default.htmlTTS 用默认的selfhost/tts_edge.json免费 Edge-TTS。点「生成视频」进度条会依次显示 分镜 x/N → 生成配图 → 合成语音 → 合成视频产物落在output/目录。一条管线跑完全程文案、配图、配音、合成分别由谁做整条链路在 pixelle_video/pipelines/standard.py 里能一一对应五步各有分工文案utils/content_generators.py里的generate_narrations_from_topic调 LLM 把主题拆成 N 段旁白默认 5 段单段 5~20 字可调切分粒度支持段落 / 行 / 句子由split_narration_script处理。想自己写稿就走「固定文案内容」模式一行一句。配图 prompt同一工具模块的generate_image_prompts为每段旁白生成画面描述再拼上你在界面里设置的prompt_prefix英文控制整体画风比如火柴人简笔画。出图 / 出视频由comfyui.image.default_workflow和comfyui.video.default_workflow指定默认分别是runninghub/image_flux.json和runninghub/video_wan2.1_fusionx.json本地则换selfhost/下同名文件。配音comfyui.tts.default_workflow指向selfhost/tts_edge.json换成tts_index2.json可开声音克隆此时需要上传参考音频MP3/WAV/FLAC。合成pixelle_video/services/video.py里的 VideoService 用 ffmpeg 把每帧画面按模板 HTML 渲染成段、再拼接最后叠 BGMbgm/目录放自定音乐。也就是说每个环节都能单独换后端互不影响。模型、模板、部署位置怎么选决策项推荐适用场景关键参数LLM通义千问 qwen-max有中文内容、预算敏感base_url 走 dashscope 兼容模式LLM零成本Ollama 本地有显卡 / 内网环境localhost:11434/v1图像生成RunningHub FLUX无本地显卡runninghub/image_flux.json图像生成本地selfhost FLUX / Qwen有 8G 显存selfhost/image_flux.json视频片段WAN 2.1需要动态背景runninghub/video_wan2.1_fusionx.jsonTTSEdge-TTS免费、多语言selfhost/tts_edge.jsonTTS克隆Index-TTS想要个人音色selfhost/tts_index2.json 参考音频模板按文件名前缀分三类static_*纯文字不出图最省、image_*配 AI 图、video_*配 AI 视频最贵。竖屏看templates/1080x1920/横屏看1920x1080/方形看1080x1080/。默认default_template写在config.yaml也可以在界面上直接切换并预览。高频坑与排查路径生成卡在「生成配图」不动先点系统配置里的「测试连接」确认 ComfyUI / RunningHub 可达再确认对应工作流 JSON 在workflows/下且能被扫描到本地 ComfyUI 还要检查模型是否已下载docs/zh/troubleshooting.md 有对应小节。文案风格跑偏换 LLM 或调n_scenes分镜数越多单段字数越少节奏更碎单段字数上限默认 20 字可在参数里放宽。配音不自然先试听 Edge-TTS 不同音色再考虑切 Index-TTS 并上传 10 秒以上清晰参考音频参考音频格式不对是最常见原因。依赖安装失败 / 启动报错先uv cache clean再uv sync确认ffmpeg -version能正常输出这是合成环节的硬依赖。进阶入口换画风改workflows/selfhost/image_*.json里的 ComfyUI 节点或直接在界面里加prompt_prefix。加模板往templates/1080x1920/放一个 HTML遵循static_/image_/video_前缀约定即可被扫描到。批量出片内容输入区切「批量模式」一行一个主题共用同一套模板与分镜数。扩展能力pixelle_video/pipelines/下已有 digital_human、i2v、asset_based 等独立管线可作为二次开发模板。文档站docs/zh/ 有模板、配置 schema、语音克隆等更细的章节。跑通第一个视频后把 LLM 换成更稳的模型、TTS 换成 Index-TTS 克隆音色、模板换成video_healing这类带动态背景的基本就是一套可长期用的日常出片配置。想深入看代码从 pixelle_video/service.py 的调度入口开始读管线细节看 pixelle_video/pipelines/工作流示例看 workflows/。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表