Open-Generative-AI 实战指南:6 个步骤,带你自托管 AI 图像与视频生成工作室
2026/9/4 11:01:43 网站建设 项目流程

Open-Generative-AI 实战指南:6 个步骤,带你自托管 AI 图像与视频生成工作室

【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI

Open-Generative-AI 是开源、可自托管的 AI 图像与视频生成工作室,聚合 Flux、Midjourney、Kling、Sora、Veo 等 600+ 模型,无订阅费、无内容过滤器。克隆、装依赖、启动三件事,免费生成自己的 AI 图片与视频。

30 秒认识 Open-Generative-AI

方案模型规模与开放程度过滤 / 自托管 / 数据归属
Open-Generative-AI✅ 600+ 模型,MIT 协议全开源✅ 无过滤器,可自托管,数据留在本地
订阅制 AI 视频平台⚠️ 仅自家模型,闭源❌ 提示词会被拦截改写,按月付费
ComfyUI 类本地自组框架⚠️ 模型自备、硬件自组✅ 无过滤,但搭起来步骤多

它解决的是两类人的问题:被平台过滤器卡住创意、又想把数据握在自己手里的创作者;以及想直接站在 600+ 模型目录上做二次开发的开发者。

🚀 安装与首次配置:从零到第一次生成

最短路径 6 个步骤:

  1. 克隆仓库(必须带子模块)
  2. 执行npm run setup安装依赖并构建工作区
  3. 执行npm run electron:dev启动桌面应用
  4. 首次启动时填入 Muapi API Key(只用本地模型可跳过)
  5. 打开 Image Studio 或 Video Studio
  6. 选模型、写提示词,生成第一张图
git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run electron:dev

首次启动必改的 4 项设置:

  1. Muapi API Key:首次使用弹窗里只粘贴密钥值,不要填密钥名称;密钥存在浏览器 localStorage,只会发往 Muapi,不会经过其他服务器。
  2. 推理引擎选择:设置 → Local Models 里一键安装随包自带的 sd.cpp 引擎做本地图像生成;视频和大参数模型需要自部署 Wan2GP 服务器。
  3. 本地模型目录:多 GB 的模型权重想放其他磁盘时,启动前设置环境变量OPEN_GENERATIVE_AI_LOCAL_AI_DIR,应用会在那里自动建bin/models/tmp/三个子目录。
  4. 参考素材库:第一次上传的参考图会自动带缩略图存进本地上传历史,之后复用直接从面板点选,不用重复上传。

启动后的主界面长这样,默认落在 Image Studio,左侧选模型、中间写提示词:

Open-Generative-AI 的图像生成工作台:选一个模型、写一句提示词就能出图

🧩 核心能力拆解:图像、视频、电影感

Image Studio:70+ 模型与 14 张参考图融合

  • 适用场景:手里有几张产品图和一张风格参考图,想让同一主体换到新场景里。
  • 操作路径:① 在 Image Studio 上传参考图,模型集自动切换到 70+ 的图生图档;② 选 Nano Banana 2 Edit 这类多图画模型;③ 在参考图选择器勾选最多 14 张(带顺序编号),点确认生成。
  • 隐藏技巧:单图模式提示词必填,图生图模式下提示词变成可选——想保持原图主体时可以把提示词写短。

Video Studio:85+ 文生视频与 120+ 图生视频

  • 适用场景:一张满意的静帧,需要变成 5–15 秒的动态镜头。
  • 操作路径:① 切到 Video Studio,上传起始帧(或直接用文生视频);② 在 Kling v3、Sora 2、Veo 3、Seedance 2.0 里挑一个;③ 时长设 5/10/15 秒,生成后一键下载全分辨率视频。
  • 隐藏技巧:Seedance 2.0 Extend 能对上一次生成无缝续拍,风格、动作和音频都保留,适合把短视频接长。

Video Studio 可调用 MiniMax Hailuo 等 85+ 文生视频模型

Cinema Studio:虚拟摄影机拍摄

  • 适用场景:想要一张照片级写实图,但要求画面像"真实摄影机拍的",而不是 AI 直出感。
  • 操作路径:① 打开 Cinema Studio;② 依次选机身(70mm 胶片等 6 种)、镜头(Warm Cinema Prime 等 11 种)、焦距 8mm–85mm 共 6 档、光圈 f/1.4–f/11 共 3 档;③ 点生成,参数会被自动翻译成优化过的提示词修饰符。
  • 隐藏技巧:35mm 标注为 Human Eye(人眼视角)、f/4 是平衡档,拿不准时就选这对组合,出错概率最低。

Cinema Studio 用 f/1.4 光圈档生成的浅景深电影感画面

⚡ 效率工具箱:常用操作速查与组合拳

操作入口一句话说明
文生图 / 图生图Image Studio各 70+ 模型,按有无参考图自动切换
多图参考参考图选择器最多 14 张,顺序编号即发送顺序
文生视频 / 图生视频Video Studio85+ 与 120+ 模型,时长 5/10/15 秒
口型驱动说话人Lip Sync Studio人像图或现成视频加音频,9 个模型
相机参数拍摄Cinema Studio机身/镜头/焦距/光圈自动转提示词
多步流水线Workflow Studio拖节点连线模型,Playground 直接跑
本地推理设置 → Local Models装 sd.cpp 或填 Wan2GP 服务器地址
历史回看各 Studio 历史面板本地持久化,可下载全分辨率结果

组合拳一:静帧到短视频(每步的输出就是下一步的输入):

  1. Image Studio 出图(10 字)
  2. 切到 Video Studio
  3. 上传为起始帧
  4. 选模型设 10 秒,下载

组合拳二:把单次生成固化成流水线:

  1. 打开 Workflow Studio
  2. 拖图像、视频节点连线
  3. Playground 跑全流程
  4. 同一流程经 API 供自有应用调用

🚑 踩坑急救站:3 个高频故障

  1. 症状npm run dev报 "Couldn't find a 'pages' directory"。定位:克隆时漏了子模块导致工作区包缺失,或没在仓库根目录执行命令。处置:重跑npm run setup安装子模块并构建工作区,确认当前目录下能看到app/package.json
  2. 症状:macOS 首次双击应用,Gatekeeper 提示被阻止、打不开。定位:应用未经 Apple 公证签名,属于正常的首次拦截,只发生一次。处置:终端执行xattr -cr "/Applications/Open Generative AI.app",然后右键应用选"打开"。
  3. 症状:Ubuntu 24.04+ 上 AppImage 启动即闪退。定位:系统 AppArmor 限制非特权用户命名空间,Chromium 沙箱起不来。处置:优先装.deb包——安装时自动写入 AppArmor 配置,无需改动系统全局设置。

🗺️ 进阶路线图:从跑通到二次开发

第 1 周

  • 跑通桌面应用,在 Image Studio 和 Video Studio 各完成一次生成
  • 一键安装 sd.cpp 引擎,用 2.1 GB 的 Dreamshaper 8 跑通本地出图
  • 把常用参考图沉淀进上传历史,建立自己的素材库

第 1 个月

  • 自部署一台 Wan2GP 服务器,接入 Flux、Wan 2.2 本地模型
  • 在 Workflow Studio 搭一条"图像 → 视频"链路并在 Playground 稳定运行
  • 固定一套 Cinema 参数组合(6 机身 × 11 镜头里挑 3 组),产出风格一致的镜头序列

长期

  • 往模型目录里补新模型,保持生成能力随上游更新
  • 基于 studio 组件库封装自己业务需要的自定义工作室
  • 用打包脚本产出团队内部使用的桌面版本

资源引用:

  • packages/studio/src/models.js:600+ 模型定义的唯一数据源
  • packages/studio/src/components/:14 个工作室界面组件源码
  • packages/studio/src/muapi.js:API 客户端,提交后轮询结果的两步模式
  • electron/lib/:本地推理引擎、模型目录与路径逻辑
  • scripts/package-linux-deb.js:Linux deb 打包脚本
  • docs/assets/:官方演示截图与示例图

Open-Generative-AI 把 14 个工作室、600+ 模型和全部源码都放在 MIT 协议下,剩下的事只有一件:把仓库克隆下来,让第一张自己生成的图出现在 10 分钟后。

【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询