Open Generative AI:400+模型免费开源AI视频生成工作室
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
做短视频时,最耗时间的往往不是创意,而是文生图、文生视频、配音这几个环节要分散在好几个付费平台里完成。Open Generative AI 是一个免费的开源 AI 视频生成工作室,一个应用里集成了 400+ 个模型,覆盖图像、视频、唇形同步和电影感镜头,没有内容过滤器,也可以整套部署在自己机器上。
💡 它替你解决了什么
用商业 AI 视频平台时,常见痛点有两个:一是订阅制,多用一个模型就要多一份月费;二是提示词会被内容过滤器拦截,创意还没开始就被打回。想自己把数据留在内部的人,还会遇到第三个问题——云平台的素材全部上传到外部,而自建又得自己搭一整套服务。
Open Generative AI 把这些收敛成一个方案:一个 MIT 协议的应用直连各家 400+ 模型,提示词不做拦截,可以自托管,素材和生成记录都留在本机。
- 免费开源:无订阅、无付费墙,MIT 协议可随意 fork 修改
- 无内容过滤器:不拦截提示词,不设平台护栏
- 可自托管:跑在自己的机器或内网,素材不出门
- 本地推理:桌面版内置推理引擎,还能挂自己的 GPU 服务器
🚀 最快上手路径
浏览器直接打开
官方有在线 Web 版,免安装、不需要 Node.js,打开就能用,14 个工作室全部可用,模型跟随官方版本更新。想先试试手感,这是最省事的一条路。
桌面版一键安装
桌面版提供 macOS(Intel 与 Apple Silicon)、Windows(x64)、Linux(AppImage/DEB)的一键安装包。macOS 首次启动需要解除一次系统拦截;Windows 若出现 SmartScreen 警告,点"更多信息 → 仍要运行"即可。桌面版也是唯一支持本地推理的形态。
三条命令自托管
自托管需要 Node.js 18+。仓库包含子模块,克隆时记得带上--recurse-submodules:
git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI && npm run setup npm run devnpm run dev后在 localhost:3000 打开 Web 版;想用桌面开发版,把最后一步换成npm run electron:dev。首次使用会提示填入 Muapi 访问密钥,它是云端模型的入口;只打算跑本地模型可以跳过。
🎬 功能拆解
按"出图出片 → 让它开口 → 控制画面质感"的工作流来看,各工作室共用同一套界面,生成历史都保存在本地,可随时回看下载。
一句话提示词出图出片
输入描述、选模型,就能出图或出视频。不传参考图时是文生图/文生视频模式(50+ 图像、40+ 视频模型);上传参考图后自动切到图生图/图生视频模式(55+ 和 60+ 模型),涵盖 Kling、Sora、Veo、Flux、Midjourney 等各家。关键选项:画面比例、分辨率与质量、时长(部分模型支持 5/10/15 秒),个别编辑模型最多接收 14 张参考图。适合想快速出素材的所有人。
让图片开口说话:唇形同步两种模式
上传肖像图加音频,直接生成会说话的视频;或者拿现有视频加音频,让人物口型跟着新声音走。共 9 个模型,分辨率可选 480p/720p/1080p(依模型而定),提示词可辅助引导动作风格。适合配音、本地化和虚拟人设内容制作。
用相机参数拍镜头:电影感画面控制
Cinema Studio 把虚拟摄影机的参数摆出来让你调:6 种机身(16mm 胶片、70mm 大画幅、全画幅数字等)、12 种镜头(变形宽银幕、移轴、微距等)、8mm 到 85mm 焦段、f/1.4 浅景深到 f/11 深焦。选择会自动转成提示词修饰,输出带电影质感的画面。适合做概念图、故事板预演和风格参考。
把模型串成流水线:可视化工作流
Workflow Studio 用节点编辑器把图像、视频、音频模型接成多步流水线,内置模板、社区工作流和可交互的 Playground,全程不写代码。适合批量生产和固定产线的场景,同一条流水线也能通过 API 调用。
👥 典型用例
独立短视频创作者:上传产品图、写一句文案,几分钟得到 5 秒动态广告素材。对比找素材、录屏、逐帧剪辑的旧流程,单条内容省下一整天。
本地化与配音团队:上传成片视频加目标语言音频,唇形同步一次生成配音版本,不用逐帧对口型。多语言批量处理走同一套流程。
技术团队自托管:三条命令在内网跑起来,素材和生成记录全在内部服务器,可以改造成自己的品牌工具,不产生按席位收取的订阅费。
⚙️ 参数调优与常见坑
- 先用 480p 试参数,交付再上 720p/1080p
- 8GB 内存机器用 SD 1.5,Z-Image 会卡死
- 克隆必须带子模块,否则工作区为空
- 本地推理只在桌面版可用
- macOS 首次启动被拦,终端清一次标记即可
- 参考图只传一次,之后可反复复用
🏗️ 技术栈与社区
- Next.js App Router + React + Tailwind CSS,npm workspaces 单仓库
- 共享的 packages/studio 组件库承载各工作室界面,模型清单是单一数据源
- 云端模型走统一 API 网关,本地模型由内置推理引擎或外接 GPU 服务器承担
架构说明见 README.md,完整模型清单在 packages/studio/src/models.js,社区讨论在项目 Discord。
- 400+ 模型覆盖图像、视频、唇形同步、电影镜头,且不做内容拦截
- Web 版、桌面版、自托管三种用法,本地推理仅限桌面版
- MIT 协议,数据可自托管,可自由 fork 改造
fork 仓库本地跑一遍,或者直接打开在线 Web 版,生成你的第一张图。
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考