AI视频生成开源工作室:Open Generative AI 免费自托管、400+模型
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
Open Generative AI 是一个可自托管的开源 AI 图像与视频生成工作室,把 Flux、Midjourney、Kling、Sora、Veo 等 400 多个主流模型收进同一个界面,提示词不带任何内容过滤。它最实用的一点:MIT 协议免订阅,桌面版支持本地模型推理,数据不出你的机器。
上手:三步跑通本地生成环境
- 克隆仓库并装依赖:
git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI,进入目录后执行npm run setup。子模块必须初始化,否则工作区目录为空、无法启动。 npm run dev启动 Web 版,打开 http://localhost:3000 即可用;不想装 Node.js 的话,直接去 Releases 页面下载桌面安装包(macOS DMG、Windows NSIS、Linux DEB)。- 首次启动在弹窗里填入 Muapi API Key 就能用云端模型生成;只用本地推理可跳过。
本地推理硬件方面:桌面版内置 sd.cpp 引擎,支持 CPU、Apple Metal、CUDA/ROCm 加速,Z-Image 系列模型建议 16GB 内存,8GB 机器选 SD 1.5 模型。
能做什么:三个典型生产场景
先出成片:文本转视频或图片转视频
- 40+ 文本转视频模型:Kling、Sora 2、Veo 3、Seedance 2.0、Hailuo 2.3、Runway 等,Seedance 支持 5/10/15 秒时长与 basic/high 两档质量
- 60+ 图片转视频模型:上传首帧图片就能动起来,Seedance 2.0 I2V 最多接受 9 张参考图
- 单条片段结束后用 Seedance 2.0 Extend 无缝续接,风格、运动与音频保持一致
视频生成主组件见 src/components/VideoStudio.js,对外集成走"提交-轮询"两段式调用:
import { generateVideo } from './muapi.js'; const result = await generateVideo(apiKey, { model: 'seedance-2.0', prompt: '夜晚城市街道,霓虹闪烁,缓慢推镜', aspect_ratio: '16:9', duration: 5, }); console.log(result.url); // 成片地址再让角色开口:配音与唇形同步
- 肖像模式:上传肖像图加音频,Infinite Talk、Wan 2.2 Speech to Video、LTX 2.3 / 19B Lipsync 四个模型输出说话视频
- 视频模式:现有视频加新音频,LatentSync、Veed、Creatify 等 5 个模型直接替换口型
- 分辨率可选 480p 到 1080p,唇形同步历史单独保存,页面刷新后未完成的任务自动续跑
最后预演镜头:电影感镜头与概念图
- Cinema Studio 提供相机(70mm 胶片、8K 数字等)、11 种镜头、焦距 8mm 超宽到 85mm 特写、光圈 f/1.4 到 f/11,系统会把选择翻译成提示词修饰符
- 图像侧 50+ 文生图、55+ 图生图模型,Nano Banana 2 Edit、Flux Kontext 等编辑模型一次最多吃 14 张参考图
- 参考图上传一次就存进本地历史,跨会话复用不用重传
配置与进阶:上手后真正会碰的三个调优点
| 调优点 | 操作 | 效果 |
|---|---|---|
| 本地模型挪盘 | 启动桌面版前设置环境变量OPEN_GENERATIVE_AI_LOCAL_AI_DIR指向目标盘 | 数 GB 权重不占系统盘,应用自动建 bin/models/tmp 子目录 |
| 低内存机器选模型 | 在 Settings → Local Models 选 Dreamshaper 8 等 SD 1.5 模型(约 2.1GB) | Z-Image 系列权重加计算缓冲超 10GB,8GB Mac 已知会卡死 |
| 本地跑视频模型 | 在一台 CUDA/ROCm GPU 机器上跑 Wan2GP 服务,在 Settings → Local Models 填 URL 并 Test | Mac 上也能把 Wan 2.2、LTX、Hunyuan 视频任务甩给局域网 GPU |
技术栈一览
Next.js App Router + React + Tailwind CSS v3 + npm workspaces 单体仓库,桌面端 Electron + Vite,本地推理引擎为 C++ 的 sd.cpp。每个 Studio(Image、Video、Lip Sync、Cinema、Workflow 等)都是共享包 packages/studio 里的独立组件,400+ 模型定义集中在 models.js。
资源与社区
- 文档:README.md 的 Quick Start 一节覆盖源码安装、本地推理配置、桌面打包与常见报错
- Issue:bug 报告与功能请求走仓库 Issue 区提交
- 社区:README 顶部附官方 Discord 入口,讨论模型更新与使用问题
克隆仓库跑完npm run setup后,先在 Video Studio 里出一条 5 秒片段,横向对比几个模型的画面质感。
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考