Open-Generative-AI 实战指南:6 个步骤,带你自托管 AI 图像与视频生成工作室
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
Open-Generative-AI 是开源、可自托管的 AI 图像与视频生成工作室,聚合 Flux、Midjourney、Kling、Sora、Veo 等 600+ 模型,无订阅费、无内容过滤器。克隆、装依赖、启动三件事,免费生成自己的 AI 图片与视频。
30 秒认识 Open-Generative-AI
| 方案 | 模型规模与开放程度 | 过滤 / 自托管 / 数据归属 |
|---|---|---|
| Open-Generative-AI | ✅ 600+ 模型,MIT 协议全开源 | ✅ 无过滤器,可自托管,数据留在本地 |
| 订阅制 AI 视频平台 | ⚠️ 仅自家模型,闭源 | ❌ 提示词会被拦截改写,按月付费 |
| ComfyUI 类本地自组框架 | ⚠️ 模型自备、硬件自组 | ✅ 无过滤,但搭起来步骤多 |
它解决的是两类人的问题:被平台过滤器卡住创意、又想把数据握在自己手里的创作者;以及想直接站在 600+ 模型目录上做二次开发的开发者。
🚀 安装与首次配置:从零到第一次生成
最短路径 6 个步骤:
- 克隆仓库(必须带子模块)
- 执行
npm run setup安装依赖并构建工作区 - 执行
npm run electron:dev启动桌面应用 - 首次启动时填入 Muapi API Key(只用本地模型可跳过)
- 打开 Image Studio 或 Video Studio
- 选模型、写提示词,生成第一张图
git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run electron:dev首次启动必改的 4 项设置:
- Muapi API Key:首次使用弹窗里只粘贴密钥值,不要填密钥名称;密钥存在浏览器 localStorage,只会发往 Muapi,不会经过其他服务器。
- 推理引擎选择:设置 → Local Models 里一键安装随包自带的 sd.cpp 引擎做本地图像生成;视频和大参数模型需要自部署 Wan2GP 服务器。
- 本地模型目录:多 GB 的模型权重想放其他磁盘时,启动前设置环境变量
OPEN_GENERATIVE_AI_LOCAL_AI_DIR,应用会在那里自动建bin/、models/、tmp/三个子目录。 - 参考素材库:第一次上传的参考图会自动带缩略图存进本地上传历史,之后复用直接从面板点选,不用重复上传。
启动后的主界面长这样,默认落在 Image Studio,左侧选模型、中间写提示词:
Open-Generative-AI 的图像生成工作台:选一个模型、写一句提示词就能出图
🧩 核心能力拆解:图像、视频、电影感
Image Studio:70+ 模型与 14 张参考图融合
- 适用场景:手里有几张产品图和一张风格参考图,想让同一主体换到新场景里。
- 操作路径:① 在 Image Studio 上传参考图,模型集自动切换到 70+ 的图生图档;② 选 Nano Banana 2 Edit 这类多图画模型;③ 在参考图选择器勾选最多 14 张(带顺序编号),点确认生成。
- 隐藏技巧:单图模式提示词必填,图生图模式下提示词变成可选——想保持原图主体时可以把提示词写短。
Video Studio:85+ 文生视频与 120+ 图生视频
- 适用场景:一张满意的静帧,需要变成 5–15 秒的动态镜头。
- 操作路径:① 切到 Video Studio,上传起始帧(或直接用文生视频);② 在 Kling v3、Sora 2、Veo 3、Seedance 2.0 里挑一个;③ 时长设 5/10/15 秒,生成后一键下载全分辨率视频。
- 隐藏技巧:Seedance 2.0 Extend 能对上一次生成无缝续拍,风格、动作和音频都保留,适合把短视频接长。
Video Studio 可调用 MiniMax Hailuo 等 85+ 文生视频模型
Cinema Studio:虚拟摄影机拍摄
- 适用场景:想要一张照片级写实图,但要求画面像"真实摄影机拍的",而不是 AI 直出感。
- 操作路径:① 打开 Cinema Studio;② 依次选机身(70mm 胶片等 6 种)、镜头(Warm Cinema Prime 等 11 种)、焦距 8mm–85mm 共 6 档、光圈 f/1.4–f/11 共 3 档;③ 点生成,参数会被自动翻译成优化过的提示词修饰符。
- 隐藏技巧:35mm 标注为 Human Eye(人眼视角)、f/4 是平衡档,拿不准时就选这对组合,出错概率最低。
Cinema Studio 用 f/1.4 光圈档生成的浅景深电影感画面
⚡ 效率工具箱:常用操作速查与组合拳
| 操作 | 入口 | 一句话说明 |
|---|---|---|
| 文生图 / 图生图 | Image Studio | 各 70+ 模型,按有无参考图自动切换 |
| 多图参考 | 参考图选择器 | 最多 14 张,顺序编号即发送顺序 |
| 文生视频 / 图生视频 | Video Studio | 85+ 与 120+ 模型,时长 5/10/15 秒 |
| 口型驱动说话人 | Lip Sync Studio | 人像图或现成视频加音频,9 个模型 |
| 相机参数拍摄 | Cinema Studio | 机身/镜头/焦距/光圈自动转提示词 |
| 多步流水线 | Workflow Studio | 拖节点连线模型,Playground 直接跑 |
| 本地推理 | 设置 → Local Models | 装 sd.cpp 或填 Wan2GP 服务器地址 |
| 历史回看 | 各 Studio 历史面板 | 本地持久化,可下载全分辨率结果 |
组合拳一:静帧到短视频(每步的输出就是下一步的输入):
- Image Studio 出图(10 字)
- 切到 Video Studio
- 上传为起始帧
- 选模型设 10 秒,下载
组合拳二:把单次生成固化成流水线:
- 打开 Workflow Studio
- 拖图像、视频节点连线
- Playground 跑全流程
- 同一流程经 API 供自有应用调用
🚑 踩坑急救站:3 个高频故障
- 症状:
npm run dev报 "Couldn't find a 'pages' directory"。定位:克隆时漏了子模块导致工作区包缺失,或没在仓库根目录执行命令。处置:重跑npm run setup安装子模块并构建工作区,确认当前目录下能看到app/和package.json。 - 症状:macOS 首次双击应用,Gatekeeper 提示被阻止、打不开。定位:应用未经 Apple 公证签名,属于正常的首次拦截,只发生一次。处置:终端执行
xattr -cr "/Applications/Open Generative AI.app",然后右键应用选"打开"。 - 症状:Ubuntu 24.04+ 上 AppImage 启动即闪退。定位:系统 AppArmor 限制非特权用户命名空间,Chromium 沙箱起不来。处置:优先装
.deb包——安装时自动写入 AppArmor 配置,无需改动系统全局设置。
🗺️ 进阶路线图:从跑通到二次开发
第 1 周
- 跑通桌面应用,在 Image Studio 和 Video Studio 各完成一次生成
- 一键安装 sd.cpp 引擎,用 2.1 GB 的 Dreamshaper 8 跑通本地出图
- 把常用参考图沉淀进上传历史,建立自己的素材库
第 1 个月
- 自部署一台 Wan2GP 服务器,接入 Flux、Wan 2.2 本地模型
- 在 Workflow Studio 搭一条"图像 → 视频"链路并在 Playground 稳定运行
- 固定一套 Cinema 参数组合(6 机身 × 11 镜头里挑 3 组),产出风格一致的镜头序列
长期
- 往模型目录里补新模型,保持生成能力随上游更新
- 基于 studio 组件库封装自己业务需要的自定义工作室
- 用打包脚本产出团队内部使用的桌面版本
资源引用:
- packages/studio/src/models.js:600+ 模型定义的唯一数据源
- packages/studio/src/components/:14 个工作室界面组件源码
- packages/studio/src/muapi.js:API 客户端,提交后轮询结果的两步模式
- electron/lib/:本地推理引擎、模型目录与路径逻辑
- scripts/package-linux-deb.js:Linux deb 打包脚本
- docs/assets/:官方演示截图与示例图
Open-Generative-AI 把 14 个工作室、600+ 模型和全部源码都放在 MIT 协议下,剩下的事只有一件:把仓库克隆下来,让第一张自己生成的图出现在 10 分钟后。
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考