ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

Pixelle-Video AI 全自动短视频引擎:输入主题 5 分钟出片,零剪辑基础

2026/9/4 13:50:38 拓冰建站 浏览量
Pixelle-Video AI 全自动短视频引擎:输入主题 5 分钟出片,零剪辑基础 Pixelle-Video AI 全自动短视频引擎输入主题 5 分钟出片零剪辑基础【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video一个输入、一杯咖啡、一条成片周五晚上我在 Pixelle-Video 的输入框里敲下「为什么我们还没找到外星文明」选默认 5 个分镜点下「 生成视频」。几分钟后一条带解说、AI 配图和背景音乐的 1080x1920 竖屏视频出现在右侧预览区文件已存进output/目录全程没碰任何剪辑软件。这就是 Pixelle-Video一个开源的 AI 全自动短视频引擎你出主题它出成品。 最短上手路径4 步跑通第一条视频两种方式二选一Windows 用户推荐一键整合包Mac/Linux 用户走源码Windows 用户下载 Windows 一键整合包内置 Python、ffmpeg 等全部依赖解压后双击start.bat源码用户先克隆项目git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video装好uv和ffmpeg后运行uv run streamlit run web/app.py浏览器自动打开 http://localhost:8501 展开「⚙️ 系统配置」选一个 LLM大语言模型负责理解和生成文字的 AI预设如通义千问或 GPT-4o填入 API Key调用模型服务的密钥保存在左侧输入框敲一个主题比如「为什么要养成阅读习惯」点「 生成视频」。进度条会依次走过「生成文案 → 生成配图 → 合成语音 → 合成视频」官方文档说一个 5 分镜的视频大约 2-5 分钟出炉。它替你省掉的四件活文案不用自己写一个字。LLM 会把主题拆成带画面感的分镜脚本每句话对应一帧画面支持通义千问、GPT、DeepSeek 和完全本地运行的 Ollama。已有现成稿子就切到「固定文案内容」模式直接粘贴。每个分镜自动配一张 AI 插图。生成后套进 HTML 模板合成画面templates/ 目录按 1080x1920 竖屏、1920x1080 横屏、1080x1080 方形分了三类30 多套模板从治愈系到霓虹风都有选哪套用哪套。配音和 BGM 一键到位。语音由 TTS文字转语音技术合成内置免费的 Edge-TTS 和支持声音克隆的 Index-TTS 等方案把音乐文件MP3/WAV丢进bgm/文件夹界面里直接选用当背景音乐。批量生产不用一条一条点。历史记录页加批量创建任务可以一次塞进多个主题还内置数字人口播、图生视频、动作迁移等进阶流水线本地 ComfyUI一种把 AI 模型串成「工作流」的可视化生成工具工作流是描述模型用法的 JSON 文件和 RunningHub 云端随时切换workflows/ 里就是全套预置工作流。美食博主小林的一夜之前 vs 之后小林运营一个小红书美食号。之前一条 1 分钟的视频写脚本 1 小时、找素材 2 小时、剪辑 2 小时以下时间为虚构示意一周更 3 条就快被榨干。上个月她换了流程把本周的 5 个菜名一次性塞进批量模式每行一个主题视觉模板固定选image_modern.html保证每期画面风格统一上传一段 30 秒真人试吃录音当参考音频用 Index-TTS 克隆出「自己的声音」最后点生成去睡觉。第二天醒来5 条成品安静躺在历史记录页。按官方 FAQ 的口径通义千问配本地 ComfyUI 约 0.01-0.05 元一条示意5 条也就几分钱量级而原来一条视频 5 小时的后期时间现在变成了 2-5 分钟的机器跑批时间。 避坑速查照着表格抄就行方案适合人群关键配置大致成本完全免费有本地显卡Ollama 本地 ComfyUI0 元云端经济无显卡、想省钱通义千问 RunningHub 云工作流约 0.01-0.05 元/条官方 FAQ 口径专业混合追求画质与灵活GPT-4o 直连 API 媒体模型DashScope、OpenAI 等按量付费新手最容易卡住的两处LLM 一直报错config.example.yaml官方配置示例里llm段的api_key和base_url要一起填只填密钥忘了地址是最常见的原因照文件里的预设注释逐项对照即可。卡在「生成配图」不动带runninghub/前缀的工作流要填 RunningHub API Key带selfhost/前缀的要起本地 ComfyUI默认地址 http://127.0.0.1:8188 混着用只会干等配置面板里有「测试连接」可以先验证。 三个值得试的进阶技巧用参考音频克隆专属音色。现象同一段解说默认音色和本人声音观众感受天差地别。操作语音设置里上传一段 MP3/WAV 参考音频选 Index-TTS 这类支持克隆的 TTS 工作流。效果视频开口就是「你」的声音。用提示词前缀锁死全片画风。现象同一个主题的配图风格会悄悄漂移。操作在图像设置里填英文风格描述如极简黑白线稿风到prompt_prefix它会在每次生图前自动拼上。效果整条视频像出自同一个设计师之手。让静态照片动起来。现象老照片、产品图只能配文字画面显得干。操作在扩展工作流里上传一张照片加参考视频跑「图生视频」或「动作迁移」流水线。效果产品图变成动态展示镜头历史人物能「开口演讲」。现在就去生成你的第一条Pixelle-Video 最适合「内容很多、时间很少」的人知识博主、电商运营、想低成本起号的新手。最小启动动作就两步——克隆项目后运行uv run streamlit run web/app.pyWindows 用户直接双击整合包的start.bat再敲一个你早就想讲的主题。等你那杯咖啡放凉之前第一条属于你的 AI 短视频就该出锅了中途卡住就先翻 docs/zh/ 里的安装、配置和声音克隆教程。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考