ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

Pixelle-Video:AI 短视频生成完整指南,3 个配置项跑通你的第一条视频

2026/9/5 15:19:49 拓冰建站 浏览量
Pixelle-Video:AI 短视频生成完整指南,3 个配置项跑通你的第一条视频 Pixelle-VideoAI 短视频生成完整指南3 个配置项跑通你的第一条视频【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一个 AI 全自动短视频引擎你输入一个主题比如为什么要养成阅读习惯它会自动完成文案撰写、逐句配图、语音解说、背景音乐和最终合成全程不需要你打开任何剪辑软件。整个系统跑在浏览器里核心是 Streamlit Web 界面 可插拔的 AI 工作流图像、视频、TTS、大模型这四个环节都能按需替换供应商。它能替你省下哪些环节传统短视频流程里一条 1 分钟的片子要经历写稿、找图、录音、剪辑四道工序每道工序都有各自的门槛。Pixelle-Video 把这四道工序压缩成一条流水线输入主题 → LLM 写分镜文案 → 逐分镜 AI 配图 → TTS 合成解说 → 模板渲染 BGM 合成对零基础用户来说真正有价值的三件事是文案不用写LLM 按主题自动产出结构化解说词也支持直接粘贴现成文案跳过创作环节对应固定文案内容模式。图不用找每个分镜由图像模型独立生成一张图风格靠英文提示词前缀统一控制。声音不用录默认 Edge-TTS 免费可用换 Index-TTS 还能上传一段参考音频做声音克隆。成品默认落在output/目录界面里会显示时长、分镜数、文件大小可直接回放。从 0 到跑通最短启动路径装环境两种方式二选一Windows 用户推荐官方一键整合包解压后双击start.bat浏览器自动打开http://localhost:8501不用装 Python、uv 或 ffmpeg。macOS / Linux 用户从源码启动前置依赖只有两个uv和ffmpegmacOS 用brew install ffmpegDebian 系用apt install ffmpeg然后git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.pyuv run会自动拉齐依赖无需手动建虚拟环境。一次填对三组配置首次进入界面展开「⚙️ 系统配置」面板需要填的就三组东西填错一组都会卡住后面的流程配置项作用最小可用值LLM写文案选一个预设通义千问 / GPT-4o / DeepSeek / Ollama填 API Key本地零成本可选 Ollamabase_url 为http://localhost:11434/v1ComfyUI / RunningHub出图、出视频、出语音的工作流底座本地 ComfyUI 填http://127.0.0.1:8188并点测试连接或只填 RunningHub API Key 走云端API 媒体模型可选直连 DashScope / OpenAI / Kling 等供应商绕开 ComfyUI不用直连就不填不想用图形界面的可以直接编辑 config.example.yaml 复制出的config.yaml结构一目了然。保存后点「保存配置」即可。三步生成第一条视频界面是三栏布局左栏选输入模式AI 生成 / 固定文案并挑 BGM中栏选 TTS 工作流和视觉模板右栏点「 生成视频」。生成时右侧会实时推进度例如分镜 3/5 - 生成插图完成后自动播放预览。第一次跑建议选最简单的组合AI 生成模式 内置 BGM selfhost/tts_edge.jsonimage_default模板先把整条链路走通再谈风格。按内容选模板比调参数更重要模板决定画面长相比任何参数都影响观感。templates/ 目录按分辨率分三个子目录竖屏 25 套、横屏 5 套、方形 1 套命名即类型这个约定值得记一下static_*.html纯文字排版不调用任何图像模型出片最快适合金句卡片类内容image_*.htmlAI 生成图片作背景性价比最高的默认选择video_*.htmlAI 生成动态视频作背景沉浸感最强也最耗时耗钱。按内容类型给三组可验证的搭配知识科普用image_book横屏版本同样存在见上方配图情感、治愈类用竖屏的video_healing影视感、剧情向用横屏image_film。选模板时先点「预览模板」它能直接渲染样例画面不用等一条完整视频跑完才发现问题。卡住时先查这四处按出现频率排序的排查清单ComfyUI 连不上先确认服务进程在跑、8188 端口可达Docker 里起 Pixelle-Video 而 ComfyUI 在宿主机的把地址改成host.docker.internal:8188。出图风格忽好忽坏问题多半出在提示词前缀——它是英文的且直接决定全局画风。固定一条经过验证的前缀再配合固定随机种子一致性会明显改善。配音听着机械换音色、调语速是最快的两条路想要自己的声音切到 Index-TTS 工作流并上传参考音频支持 MP3/WAV/FLAC。想要免费跑全链路LLM 用 Ollama 本地推理 本地 ComfyUI一分钱不花显存不够就把 LLM 换成通义千问成本极低图像走 RunningHub 云端。更多细节可以翻 docs/ 下的 FAQ 和故障排查页侧边栏里也内置了常见问题入口。下一步把默认流水线改造成自己的当固定模板用腻了有三层可动的空间难度递增换工作流workflows/ 下selfhost/和runninghub/两个目录分别对应本地与云端方案共 20 多个现成 JSONflux、qwen、wan2.2 等图像/视频/TTS 工作流。新建一个 ComfyUI 工作流导出为 JSON 放进对应目录下拉菜单里就能选到。写模板模板就是一个带占位符的 HTML 文件参考templates/1080x1920/里现有的结构改配色和布局保存后界面自动识别。直连 API 供应商不走 ComfyUI在系统配置里给 DashScope / OpenAI / Kling / ARK 填 Key 和 Base URL图像、视频、素材分析都能直连调用还能为每个供应商单独开关本地代理。三条路都验证过可行之后剩下的就是批量了界面支持批量创建视频任务历史记录页可以回看之前所有产出。从能跑通到跑得顺通常只差换一轮模板和一条顺手的提示词前缀。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考