2026/9/9 22:06:50

Open Generative AI:开源 AI 视频生成工作台,440 个模型自托管,零订阅

Open Generative AI:开源 AI 视频生成工作台,440 个模型自托管,零订阅 Open Generative AI开源 AI 视频生成工作台440 个模型自托管零订阅【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI做一条 30 秒竖屏短片传统流程要过分镜、拍摄、剪辑、调色至少一周。Open Generative AI 把这条流水线压成一次提示词一行镜头描述加一个模型选择成片直接出来。它是免费、开源MIT 许可的 AI 视频生成工作台内置 Flux、Midjourney、Kling、Sora、Veo 等 440 个模型可完全自托管无内容过滤。 项目定位速览Open Generative AI 是一个模型聚合与自托管工作台它把 440 个模型的调用、排队和界面打包给你但它不是训练/微调平台也不替代非线性剪辑套件没有时间线剪辑和调色台。维度内容它是什么Next.js monorepo14 个工作室图像、视频、音频、唇形同步、影视、营销、工作流、Agent 等它不替代什么模型训练平台、剪辑软件云端能力依赖你自带的 MuAPI 访问密钥BYOK模型规模440 个文生图 72 / 图生图 75 / 文生视频 90 / 图生视频 132 / 视频转视频 36 / 唇形同步 15 / 音频 17 / 换身 3许可证与费用MIT无订阅费模型数量可按packages/studio/src/models.js自行核对平台Web 在线版 Electron 桌面端macOS / Windows / Linux本地推理仅桌面端最适合谁要自托管、要无内容过滤、想把生成能力接进自己产品的开发者与创作者 从 0 到第一次出片到第一次出片有三条路径桌面端、在线端、本地推理最短路径 5 分钟内跑通。桌面端推荐1下载 v1.0.9 安装包macOS arm64/x64 DMG、Windows x64 NSIS、Linux AppImage 或 DEB无需 Node.js2macOS 首次启动被拦截时右键→打开或执行xattr -cr /Applications/Open Generative AI.appWindows SmartScreen 点仍要运行3首次启动粘贴 MuAPI 访问密钥申请方式见 README Quick Start进任一工作室写提示词生成。在线端浏览器直接打开全部 14 个工作室注册免费账号即可生成模型列表与最新发布保持同步零安装。本地推理仅桌面端1Settings → Local Models 一键安装内置 sd.cpp 引擎2下载 2.1 GB 的 SD 1.5 模型Dreamshaper 8 等3Image Studio 里切到模型选择器旁的 ⚡ Local 开关无需 API 密钥全程离线。硬件要求最低 8 GB RAM本地图像推理Z-Image 大模型推荐 16 GB RAMWan2GP 远程视频推理需要一台 CUDA/ROCm GPU 机器。在线端浏览器直接运行全部工作室无需安装 核心能力拆解14 个工作室按你要完成的任务组织这里拆四个最高频的。把一段文字变成 5 秒成片Video Studio 是双模式不传参考图时开放 90 个文生视频模型上传一张静帧图后自动切到 132 个图生视频模型池。模型Kling、Sora 2、Veo 3、Wan 2.6、Seedance 2.0、Hailuo 2.3、Runway Gen-3时长5 / 10 / 15 秒按模型支持动态过滤画幅16:9 / 9:16 / 4:3 / 3:4随所选模型变化质量basic / high 两档图生视频模式支持传多张参考帧引导运动prompt: 雨夜霓虹小巷一只猫穿过画面35mm 手持感 model: seedance-2.0 ratio: 9:16 duration: 5s同一个模型同时覆盖图像与视频输出实现见 packages/studio/src/components/VideoStudio.jsx。让静态肖像跟着音频开口Lip Sync Studio 有 9 个专用模型、两种模式肖像图 音频 → 说话视频已有视频 音频 → 唇形同步视频。图像模式Infinite Talk、Wan 2.2 Speech to Video、LTX 2.3 Lipsync、LTX 2 19B视频模式Sync、LatentSync、Creatify、Veed、Infinite Talk V2V分辨率480p / 720p / 1080p按模型支持提示词可选用于引导动作风格历史单独存储刷新页面后任务自动续跑mode: 肖像图像 model: ltx-2.3-lipsync resolution: 1080p input: 肖像.jpg 配音.mp3实现见 packages/studio/src/components/LipSyncStudio.jsx。用虚拟相机拍一镜电影感镜头Cinema Studio 把相机、镜头、焦段、光圈四组虚拟参数翻译成优化过的提示词修饰符产出照片级写实镜头。相机Modular 8K Digital、70mm Film、Classic 16mm Film 等 6 种预设镜头Tilt、Anamorphic、Macro、Bokeh、Halation Diffusion 等 11 种焦段8mm 超广到 85mm 特写人像6 档光圈f/1.4 浅景深 / f/4 均衡 / f/11 深焦Classic 16mm Film 预设复古胶片质感的镜头参数实现见 packages/studio/src/components/CinemaStudio.jsx。把多张参考图统一成一次编辑Image Studio 按是否传参考图在 72 个文生图与 75 个图生图模型池之间自动切换兼容模型最多吃 14 张参考图按选择顺序发给模型。多图模型Nano Banana 2 Edit14 张、Flux Kontext、GPT-4o Edit、Seedream Edit 等多选带序号徽章支持批量上传Use Selected 确认上传历史本地持久化同一张图不用重复上传输出分辨率按模型最高 4Kmodel: nano-banana-2-edit images: ref1..ref6有序 prompt: 统一这 6 张图的黄昏暖调光影图像工作室提示词输入与模型切换实现见 packages/studio/src/components/ImageStudio.jsx。⚙️ 进阶玩法与自动化批量与集成场景有两级入口可视化工作流和 API 直调。Workflow Studio节点式拖拽编辑器把图像/视频/音频模型串成流水线自带模板库和社区公开工作流Playground 里交互运行每个工作流都可以通过 API 调用一次请求跑完整条多步流水线底层是统一两段式POST/api/v1/{endpoint}提交轮询 GET/api/v1/predictions/{request_id}/result直到 status 为 completed认证走x-api-key头import { executeWorkflow } from studio; // Workflow Studio 里保存的流水线可直接代码驱动 const run await executeWorkflow(API_KEY, workflow_id, { prompt: 城市夜景霓虹闪烁, ratio: 9:16 });外部系统不依赖 JS 也行照上面的两段式模式直接调任意模型端点即可。 踩坑指南与性能调优四个高频问题都给出直接解法。macOS 首次启动被 Gatekeeper 拦截应用没有 Apple 公证。跑一次xattr -cr /Applications/Open Generative AI.app或走系统设置 → 隐私与安全性 → 仍要打开之后不再需要。Ubuntu 24.04 上 AppImage 秒崩内核策略apparmor_restrict_unprivileged_userns挡了 Chromium 的用户命名空间沙箱。改用 .deb 包最直接自带 AppArmor profile坚持用 AppImage 就执行sudo sysctl -w kernel.apparmor_restrict_unprivileged_userns0。Z-Image 本地生成卡死整机权重 7.4 GB 加 2.4 GB 计算缓冲8 GB 内存的 M 系 Mac 扛不住。8 GB 机器改用 2.1 GB 的 SD 1.5 模型Dreamshaper 8 / Realistic Vision 5.1要跑 Z-Image 就升级到 16 GB 内存。npm run dev报 Couldnt find a pages directoryworkspaces 没构建或没在仓库根目录执行。用git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI重新拉取跑一次npm run setup再在仓库根目录执行。 技术栈一览技术版本作用Next.js15.5宿主 Web 版App Router 服务端组件React19.214 个工作室的 UI 组件Tailwind CSS3.4实用优先样式Electron Vite33.4 / 5.4桌面壳承载本地推理npm workspaces-monorepo共享packages/studio组件库sd.cpp内置本地图像推理引擎Metal / CUDA / ROCm 社区与持续演进项目的实际入口都摆在仓库里四个常用入口如下。README.md 的 Quick Start分平台安装、本地推理、排障是本文内容的完整出处packages/studio/src/models.js模型目录唯一事实源440 个条目托管版与自托管版共用此文件模型更新两边同时生效tests/本地推理链路资产、路径、进度上报的单元测试Discord 社区模型讨论与使用求助邀请链接在 README 顶部上手前把 README.md 的 Quick Start 与 Hardware Notes 两节读完避免选到你这台机器跑不动的模型。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考