Pixelle-Video 全自动短视频引擎指南:零基础 5 分钟生成第一条 AI 视频 Pixelle-Video 全自动短视频引擎指南零基础 5 分钟生成第一条 AI 视频【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video上周五晚上我在 Pixelle-Video 的输入框里敲下「为什么我们还没找到外星文明」然后转身去冲了杯咖啡。回来时一条带解说、AI 配图、背景音乐、1080x1920 竖屏的完整视频已经躺在输出区全程约 5 分钟一个剪辑动作都没有。这就是这款开源 AI 全自动短视频引擎的日常你出主题它出成品。60 秒初体验从零跑通第一条视频的最短路径别急着研究安装文档最短路径其实只有四步下载 Windows 一键整合包并解压它内置了 Python、ffmpeg 等全部依赖双击start_web.bat浏览器自动打开 http://localhost:8501展开「⚙️ 系统配置」选一个 LLM 预设比如通义千问并填入 API Key保存在左侧输入框敲一个主题比如「为什么要养成阅读习惯」点「 生成视频」。从源码跑也一样简单克隆项目后执行uv run streamlit run web/app.py其余流程完全相同。接下来你会看到实时进度条依次走过「生成文案 → 生成配图 → 合成语音 → 合成视频」一个 5 分镜的视频大约 2-5 分钟出炉成片自动保存在output/目录。整个过程没有任何一处需要你动手剪辑。核心能力地图它到底帮你做了哪些事内容生成能力文案不用自己写一个字LLM大语言模型负责理解和生成文字的人工智能会把你输入的主题自动拆成带画面感的分镜脚本每句话对应一帧画面。支持通义千问、GPT、DeepSeek 和完全本地运行的 Ollama如果你已有现成稿子切到「固定文案内容」模式直接粘贴即可。视觉表现能力每个分镜配一张 AI 插图系统为每个分镜生成一张配图再套进 HTML 模板合成画面。templates/目录下按竖屏、横屏、方形分类了 30 多套模板从治愈系到霓虹灯风格应有尽有还可以用提示词前缀统一全片画风。语音交互能力配音和 BGM 一键到位内置 Edge-TTS 免费语音、Index-TTS 声音克隆等主流 TTS文字转语音方案把音乐文件丢进bgm/文件夹界面里就能直接选用背景乐。批量生产能力一晚上产出 20 条不是梦历史记录页、批量创建任务、ComfyUI/RunningHub 云端工作流随时切换还能扩展数字人口播、图生视频、动作迁移等进阶流水线。一个完整故事线美食博主小林的一夜我叫小林运营一个小红书美食号。过去一条 1 分钟的视频写脚本 1 小时、找素材 2 小时、剪辑 2 小时一周更 3 条就快被榨干。上个月我开始用 Pixelle-Video 做「深夜食堂」系列第 1 步把本周想讲的 5 个菜名一次性输进批量模式每行一个主题第 2 步视觉模板固定选image_modern.html保证每期画面风格统一第 3 步上传一段 30 秒的真人试吃录音作为参考音频克隆出「我自己的声音」第 4 步点生成然后去睡觉。第二天醒来5 条成品视频安静躺在历史记录页。单条成本约 1-5 分钱通义千问配 RunningHub 云端我却省下了每周 20 多个小时。发布后评论区有人问「小林你声音怎么变好听了」其实那本来就是 AI 克隆的。配置速查表三种方案照着抄就行方案适合人群关键配置大致成本一句话点评完全免费有本地显卡Ollama ComfyUI 本地0 元数据不出门最省钱云端经济无显卡、预算有限通义千问 RunningHub每条约 1-5 分性价比之王专业混合追求画质与效率GPT 直连 API 媒体模型按量付费灵活但要多点耐心新手最容易配错的两处第一把config.example.yaml复制为config.yaml时只填了 api_key 忘了 base_urlLLM 会一直报错第二选图像工作流时带runninghub/前缀的要填 RunningHub API Key带selfhost/前缀的要有本地 ComfyUI混着用就会卡死在「生成配图」这一步。高手才知道的 3 个技巧用参考音频克隆专属音色现象同一段解说默认音色和你自己的声音完播率天差地别。原理Index-TTS 支持声音克隆只需一段短音频作声线样本。操作在语音设置里上传参考音频MP3/WAV再选择支持克隆的 TTS 工作流。效果视频开口就是「你」的声音个人辨识度拉满。用提示词前缀锁死全片画风现象同一个主题生成的两张配图风格可能悄悄漂移。原理prompt_prefix 会在每次生图前自动拼上你写的风格描述。操作在config.example.yaml的 image.prompt_prefix 填上类似 Minimalist black-and-white matchstick figure style illustration, clean lines 的英文描述。效果整条视频像出自同一个设计师之手观感立刻专业。让一张静态照片动起来现象老照片和产品图只能配文字画面显得干。原理图生视频与动作迁移流水线能把静态图像变成动态镜头。操作在扩展工作流中上传参考视频和一张照片。效果历史人物能「开口演讲」产品图能变成动态展示一条视频瞬间有了高级感。延伸生态想深入可以从这些入口走官方文档docs/zh/覆盖安装、配置、快速开始、自定义风格、声音克隆等完整教程遇到问题先翻 docs/zh/faq.md模板库templates/ 按 1080x1920、1920x1080、1080x1080 分类改 CSS 就能定制品牌风格预置工作流workflows/runninghub 与 workflows/selfhost 提供了图片、视频、TTS 全套 JSON 工作流懂 ComfyUI 还能自己加音色清单pixelle_video/tts_voices.py 列出了所有支持的语音配 TTS 时先来这挑现在就动手你的第一条视频正在等你Pixelle-Video 最适合「内容很多、时间很少」的人——知识博主、电商运营、想低成本起号的新手。现在就动手git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video然后运行uv run streamlit run web/app.pyWindows 用户直接双击start_web.bat。找一个你早就想讲的主题输进去等你那杯咖啡放凉之前第一条完全属于你的 AI 视频就该出锅了。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考