Pixelle-Video 全自动短视频生成指南:一个主题 5 分钟产出第一条 AI 竖屏视频 Pixelle-Video 全自动短视频生成指南一个主题 5 分钟产出第一条 AI 竖屏视频【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一款开源的 AI 全自动短视频引擎输入一个主题它会自动完成文案、AI 配图、配音和背景音乐约 5 分钟产出一条可发布的竖屏短视频。本指南带你从安装跑通到批量生产全程不用碰剪辑软件。还在一帧帧剪视频看看别人怎么干过去做一条 1 分钟的短视频流程是这样的自己写脚本 1 小时找素材 2 小时剪辑、卡点、加字幕再 2 小时。一周更 3 条人就废了。现在把同一个主题丢给 Pixelle-Video它会替你干完所有脏活写解说词、为每一句话生成一张 AI 插图、把文字变成人声、配上背景音乐最后按分镜顺序拼成一条 1080x1920 的成品视频。你唯一要做的事是输入主题和点一次生成按钮。上面这条风格统一的画面就是引擎输入一个主题 → 输出一条成片的典型产物。下面直接上手。最短跑通路径4 步生成第一条 Pixelle-Video 视频第 1 步把程序跑起来。Windows 用户下载一键整合包解压后双击start_web.bat其他系统用户执行git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video进入目录后运行uv run streamlit run web/app.py需要先装好uv和ffmpeg。 你会看到浏览器自动打开http://localhost:8501出现三栏式界面。第 2 步完成系统配置。展开「⚙️ 系统配置」在 LLM 下拉菜单选一个预设比如通义千问填入 API Key再选好图像/语音的工作流点保存。 你会看到配置面板收起界面上出现已配置的提示状态。第 3 步输入主题并挑模板。左侧输入框写一个主题如为什么要养成阅读习惯默认就是AI 生成内容模式中间栏挑一个视频模板默认1080x1920/image_default.html就够用。 你会看到模板列表按竖屏/横屏/方形分组点「预览模板」能先看效果再定。第 4 步点「 生成视频」然后去倒杯水。你会看到进度条依次走过生成旁白 → 生成插图 → 生成语音 → 合成画面 → 拼接视频一个 5 分镜的视频大约 2-5 分钟出炉成片自动存在output/目录页面直接给你播放预览。一句主题到一条成片内部流水线人话拆解第一次用你会疑惑它到底怎么保证不翻车拆开看其实就是一条清晰的流水线每一步都有进度条可查。起标题LLM 根据主题先定一个视频标题。写分镜脚本把主题拆成约 5 段旁白每段 5-20 个字一句话对应一帧画面——LLM 在这里就是负责写文案的大脑。如果你已有现成稿子切到固定文案内容模式它按段落/行/句子切分后直接跳过这一步。为每句话写画外提示词把旁白翻译成给生图模型看的英文描述再拼上你设置的全局风格前缀。逐分镜生产每个分镜固定走 4 个小步骤——生成语音、生成插图、用 HTML 模板合成画面、创建视频片段。进度条会显示分镜 3/5 - 步骤 2/4: 生成插图这类信息卡在哪一眼就知道。总装所有片段拼成一条视频混入你选的背景音乐把 MP3 丢进bgm/文件夹就能在界面里选用。每个环节文案、生图、TTS、视频都是可替换的模块本地 ComfyUI、RunningHub 云端、直连模型 API 三种供能方式随意组合这就是引擎二字的含义。一张图看懂四种用法不同人群的 Pixelle-Video 场景卡不同人拿到这套引擎用法差别很大对号入座知识博主日更型竖屏模板 默认 LLM 预设早上把 3 个选题输入「批量生成模式」每行一个主题上限 100 个保持页面打开让它排队跑晚上 3 条视频躺在历史记录页。收益更新频率从看心情变成日更。电商运营风格统一型固定同一套模板和prompt_prefix让整条产品线的视频像同一个设计师出的。收益店铺主页观感立刻专业。起号新手成本敏感型用固定文案内容模式贴现成稿子省掉 LLM 写稿的token生图走本地 ComfyUI整条流水线接近 0 元。无显卡用户云端型图像/视频工作流全选runninghub/前缀的填一个 RunningHub API Key 就能跑不占本地资源单条成本大约几分钱。尺寸也按平台走竖屏1080x1920发抖音快手方形1080x1080发小红书横屏1920x1080发 B 站和 YouTube。3 种配置方案对比 新手最先踩的 2 个坑按有没有显卡、预算多少对号入座即可方案适合人群关键配置大致成本一句话点评完全免费有本地显卡Ollama本地 LLMselfhost/本地 ComfyUI0 元数据不出门最省钱但首次部署要折腾环境云端经济无显卡、预算有限通义千问 runninghub/云端工作流每条约 1-5 分性价比之王配置最少专业混合追求画质与效率GPT 等 直连 API 媒体模型DashScope、Kling 等按量付费上限最高要填的密钥也最多新手最容易翻车的地方有两处坑 1只填了api_key忘了base_url。不管用 WebUI 还是改 config.example.yaml 复制出的config.yamlLLM 的api_key、base_url、model三个字段缺一不可。缺base_url时症状很迷惑——生成点下去LLM 一直报错你会怀疑是 Key 的问题。先查这三项。坑 2工作流前缀和配置混着用。带runninghub/前缀的工作流如runninghub/image_flux.json必须填 RunningHub API Key带selfhost/前缀的如selfhost/image_flux.json需要本地 ComfyUI 在http://127.0.0.1:8188跑着。两边都不满足时任务会卡死在生成插图这一步不动。选工作流前先想清楚自己走哪条供能路线。进阶 3 招把这条视频引擎用到 90 分技巧 1上传参考音频克隆你自己的声音痛点默认音色谁听了都像AI 在念稿完播率上不去。原理Index-TTS 这类工作流支持声音克隆一段几十秒的清晰人声录音就能当声线样本。做法在语音设置里上传参考音频MP3/WAV 均可TTS 工作流选支持克隆的先点「预览语音」试听再开跑。收益视频一开口就是你个人 IP 辨识度直接拉满。技巧 2用prompt_prefix锁死全片画风痛点同一个主题生成的多张配图风格会悄悄漂移拼在一起像拼盘。原理prompt_prefix会在每次生图前自动拼进提示词最前面相当于给生图模型下的统一风格军令。做法在视觉设置里填一段英文风格描述例如Minimalist black-and-white matchstick figure style illustration, clean lines点「预览风格」确认后再正式生成。收益整条视频像出自同一个设计师之手系列感立刻出来。技巧 3用图生视频 / 动作迁移让静态图动起来痛点老照片、产品图配文字太干画面没生气。原理web/pipelines/里内置了 图生视频 和 动作迁移 两条独立流水线前者把一张图变成动态镜头后者用参考视频驱动图片做动作。做法在主界面切到对应流水线标签页上传素材和参考视频/图片走同样的生成流程。收益历史人物能开口演讲、产品图变动态展示普通图文号瞬间多了高级玩法。深入入口文档、模板与源码模块想从会用走到会改按这几个入口走官方中文文档 docs/zh/安装、配置、快速开始、自定义风格、声音克隆、FAQ 全都有卡住了先翻这里。模板库 templates/按1080x1920、1920x1080、1080x1080三个尺寸分类30 多套 HTML 模板改 CSS 就是定制品牌风格命名带static_、image_、video_前缀分别对应纯文字/配图/配视频。预置工作流 workflows/runninghub/ 与 workflows/selfhost/图像、视频、TTS 全套 JSON 工作流懂 ComfyUI 还能自己加节点。配置文件样例 config.example.yaml所有可调项LLM、ComfyUI、直连供应商、默认模板、风格前缀都在这一个文件里注释写得很细。音色清单 pixelle_video/tts_voices.py所有支持的语音都在这里配 TTS 前先挑人声。流水线源码 pixelle_video/pipelines/想看懂标准流水线每一步怎么跑的从standard.py读起。今天就动手你的第一条视频在 5 步之外不用规划、不用学软件把这三件事做完第一条视频就该出锅了克隆代码git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video启动界面进入目录后运行uv run streamlit run web/app.pyWindows 用户直接双击start_web.bat配置 LLM 预设和图像工作流 → 输入一个你早就想讲的主题 → 点「 生成视频」生成完想批量再跑一批切到批量模式把选题一行一个贴进去就行。下一条视频交给引擎。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考