
Open Generative AI 完整指南14 个工作室、400 模型的免费 AI 视频生成平台【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一个开源免费的 AI 视频生成与图像生成工作台。它把 Flux、Midjourney、Kling、Sora、Veo 等 400 多个模型装进 14 个工作室支持文生视频、图生视频、唇形同步和本地推理。MIT 许可证可自托管无内容过滤器。为什么你会需要这样一个工具先说几个常见的卡点闭源平台按月度收费Midjourney、Runway、Kling 的订阅加起来每月上百美元提示词会被拦截或改写某些题材直接拒绝生成上传的参考图和生成结果都放在别人的服务器上想在自己的产品里嵌入生成功能得重新对接各家 APIOpen Generative AI 的做法是反过来代码开源、模型统一走一个 API 网关、数据默认留在本地。你可以把它当成个人创作工具也可以直接改成自己品牌的工作室。项目描述写得很直白The free, open-source alternative to AI Video Platforms.Generate AI images and videos using 400 state-of-the-art models across 14 studios — no content filters, no closed ecosystem, no subscription fees.核心功能逐个拆解整个应用是一个 Next.js monorepo所有工作室 UI 都来自共享组件库packages/studio。下面按使用频率挑重点讲。图像工作室双模式自动切换图像工作室src/components/ImageStudio.js有一个很省心的设计根据你是否上传了参考图自动切换模型集合。模式触发条件可用模型文生图未上传参考图50 个 t2i 模型Flux、Nano Banana 2、Seedream 5.0、Midjourney、GPT-4o…图生图上传参考图后55 个 i2i 模型Kontext、Nano Banana 2 Edit、Seededit、Upscaler…值得一提的是多参考图输入Nano Banana 2 Edit 一次最多接受 14 张参考图Flux Kontext、Kling O1、GPT-4o Edit 等最多 10 张。上传后图片会按你勾选的顺序发送给模型适合做参考这套视觉风格这类任务。视频工作室从文案到成片视频工作室src/components/VideoStudio.js和图像工作室同一套逻辑文生视频40 个模型覆盖 Kling v3、Sora 2、Veo 3、Wan 2.6、Seedance 2.0、Hailuo 2.3、Runway Gen-3图生视频60 个模型上传一张首帧图就能动起来Seedance 2.0 I2V 甚至支持最多 9 张参考图视频时长和比例是动态选项取决于所选模型。比如 Seedance 2.0 支持 5/10/15 秒和 16:9、9:16、4:3、3:4 四种比例Grok Imagine 支持最长 15 秒。唇形同步工作室9 个模型两种玩法唇形同步src/components/LipSyncStudio.js解决一个具体需求让画面里的人物嘴巴跟着音频动。输入组合结果肖像图 音频说话的人像视频已有视频 音频口型重同步视频图像输入模式有 4 个模型Infinite Talk、Wan 2.2 Speech to Video、LTX 2.3 Lipsync、LTX 2 19B视频输入模式有 5 个Sync、LatentSync、Creatify、Veed、Infinite Talk V2V。生成历史单独存在lipsync_history里页面刷新后未完成任务会自动恢复。电影工作室把镜头参数变成提示词电影工作室src/components/CinemaStudio.js的思路比较特别你不需要会写镜头提示词只要选参数。相机Modular 8K Digital、Full-Frame Cine Digital、70mm Film、Classic 16mm Film 等 6 种镜头Creative Tilt、Extreme Macro、Warm Cinema Prime、Vintage Prime 等 11 种焦距8mm 超广角、35mm 人眼视角、50mm 人像、85mm 特写光圈f/1.4 浅景深、f/4 均衡、f/11 深焦选完之后应用自动把它们转成优化过的提示词修饰符。比如选了 Classic 16mm Film 24mm f/4出来的画面就带胶片颗粒感和那个焦段的透视。工作流工作室拖拽连接多个模型工作流工作室src/components/WorkflowStudio.js是一个节点式编辑器不用写代码就能把多个模型串成流水线。比如文生图 → 图生视频 → 自动剪辑这条链。它能做的事从模板起步图片链、视频流水线等预置模板浏览社区用户发布的流程直接运行在 Playground 里交互式跑一遍表单填参数结果内联渲染每个工作流都可以通过 API 调用方便接进你自己的系统本地模型推理不想交 API 费就本地跑桌面应用内置了两个独立的本地引擎入口都在Settings → Local Models引擎是什么适合sd.cpp自带stable-diffusion.cpp 的 C 引擎跑在本机图像模型。Apple Silicon 走 MetalLinux/Windows 走 CUDA/Vulkan/ROCmWan2GP自管服务器指向你自己跑的 Wan2GP Gradio 服务器视频模型Wan 2.2、Hunyuan、LTX和大图像模型Flux、Qwen-Image服务器端需要 NVIDIA/AMD GPUsd.cpp 自带 6 个模型SD 1.5 系列约 2.1 GBSDXL 约 6.9 GBZ-Image Turbo/Base 约 2.5–3.5 GB另需 2.4 GB 的 Qwen3 文本编码器和 335 MB 的 FLUX VAE 两个共享文件。硬件上有个明确的坑8 GB 内存的 M 系列 Mac 跑 Z-Image 会卡死系统官方建议那类机器只用 SD 1.5Z-Image 建议 16 GB 起步。Wan2GP 之所以要单独起服务器是因为它的运行时Sage attention、flash-attn、AWQ/GGUF 内核只支持 CUDA没有 Apple Silicon 路径。所以你的 Mac 可以只跑桌面应用把推理甩给局域网里的游戏本或者租的 GPU 实例。上手路径三条路按需选路线一装桌面应用最省事去 Releases 页下载预构建安装包macOSarm64.dmgApple Silicon或x64.dmgIntelWindows.exeNSIS 安装包Linux.AppImage或.deb三个平台都有首次启动的小麻烦官方 README 给了具体解法macOS未签名首次打开会被 Gatekeeper 拦。终端跑xattr -cr /Applications/Open Generative AI.app然后右键 → 打开只需做一次WindowsSmartScreen 警告点更多信息 → 仍要运行即可Ubuntu 24.04AppArmor 会拦 Chromium 沙箱推荐直接装.deb自带 AppArmor profile用 AppImage 的话执行sudo sysctl -w kernel.apparmor_restrict_unprivileged_userns0路线二从源码跑开发者需要 Node.js v18 和一个 MuAPI 访问密钥。git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup # 二选一 npm run electron:dev # 桌面应用Electron Vite npm run dev # Web 版本Next.js→ http://localhost:3000注意npm run setup不能省——它负责拉子模块工作流和 Agent 包、装依赖、构建 workspace 包。只跑npm install是启动不了的。路线三只用本地模型完全不上云首次启动会提示输入 MuAPI 密钥。如果你只打算跑本地推理直接跳过这步就行sd.cpp 和 Wan2GP 都不需要 API 密钥。进阶技巧与配置多参考图怎么排顺序选多参考图模型时上传面板会切换成多选模式每张图带一个序号角标模型按你勾选的顺序接收一次从文件对话框选多张批量上传上传按钮上显示当前已选张数还有空位时会出现角标点 Use Selected 确认模型下载放在哪sd.cpp 默认把引擎、权重、临时文件都放在应用数据目录macOS~/Library/Application Support/open-generative-ai/local-aiWindows%APPDATA%\open-generative-ai\local-aiLinux~/.config/open-generative-ai/local-ai几个 GB 的权重不想占系统盘的话启动前设置环境变量OPEN_GENERATIVE_AI_LOCAL_AI_DIR指向别的盘应用会在里面建bin/、models/、tmp/三个子目录。怎么确认 Metal 加速真的生效了Mac 上最快的自检办法是直接跑sd-cli就是应用用的那个二进制APP_DATA$HOME/Library/Application Support/open-generative-ai/local-ai DYLD_LIBRARY_PATH$APP_DATA/bin $APP_DATA/bin/sd-cli \ -m $APP_DATA/models/DreamShaper_8_pruned.safetensors \ -p a serene mountain lake at sunrise \ -o /tmp/sd15-test.png \ --steps 12 -H 512 -W 512输出里出现VRAM 1969.78MB说明走了 Metal如果是VRAM 0.00MB说明 dylib 回退到了 CPU去 Settings → Local Models 重装一次引擎。生成历史与上传历史生成历史所有出图/出视频记录存在浏览器 localStorage可以回看、下载原分辨率文件上传历史参考图只上传一次之后在 3 列缩略图网格里点一下就能复用不用重复传API 密钥存在浏览器 localStorage只发给 MuAPI不会传给其他服务器代码层面怎么改模型所有模型定义集中在 packages/studio/src/models.js这是单一数据源桌面版和在线版共用。要加一个新模型改这一个文件两边同时生效。UI 入口在 packages/studio/src/components/每个工作室一个 jsx 文件。适合谁用短视频创作者一次出多个视频变体图生视频模式用一张首帧图反复迭代影视团队做前期电影工作室快速出镜头风格参考工作流工作室搭概念图 → 动态分镜流水线需要配音/本地化的团队唇形同步工作室批量产出多语言口型版本想白牌二次开发的人MIT 协议packages/studio是可以直接搬进自己产品的组件库模型目录改一个文件隐私敏感场景本地推理路径下提示词和素材完全不离开你的机器写在最后Open Generative AI 没有追求单一爆款功能而是把多模型 × 多工作室 × 本地云双通道做成了完整组合。420 模型、14 个工作室、两个本地推理引擎每一项都对应一个具体的创作环节。如果你正在对比订阅制平台或者想在自己的产品里嵌一套生成能力这个仓库值得放进候选清单。项目采用 MIT 许可证源码结构清晰Web 入口在 app/共享组件库在 packages/studio/Electron 桌面壳在 electron/本地推理测试在 tests/。从源码读起比从文档读起更快理解它的工作方式。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考