Open Generative AI400模型自托管AI视频与图像创作工作室完整指南【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一款可自托管的开源 AI 视频生成与图像创作工作室内置 14 个创作工作室接入 Flux、Midjourney、Kling、Sora、Veo 等 400 余个模型MIT 许可免费使用无内容过滤器数据可完全留在本地。做一条短片为什么要挨个付费订阅工具多数创作者遇到的现实是想要的功能散落在不同商业平台里——图像在一个、视频在另一个、对口型还得再找一个每个都要月费而且提示词动不动被审核拦截素材和记录都沉淀在别人的云上。Open Generative AI 的思路是把这件事反过来一个开源程序装下全部能力模型按厂商横向铺开你在一个界面里完成生图 → 图生视频 → 对口型 → 镜头质感的完整链路。你关心的点闭源付费平台Open Generative AI费用按功能订阅通常每月 8120 美元MIT 许可免费模型来源自家单一系列400 模型跨多家厂商内容审核提示词可能被拦截或改写无过滤器数据去向平台云端自托管留在自己机器二次开发不可完整源码可自由修改 三种上手方式按需求选一条方式一桌面应用推荐零代码去仓库 Releases 页面下载对应安装包即可不需要装 Node.js 或开终端macOS提供 Apple Siliconarm64与 Intelx64两个 DMGWindowsNSIS 安装包x64SmartScreen 若报警点更多信息 → 仍要运行即可LinuxAppImage 或 .deb 包Ubuntu 24.04 以后建议用 .deb它自带 AppArmor 配置macOS 首次打开会被系统拦截应用未做 Apple 公证在系统设置 → 隐私与安全性里点仍要打开或执行一次xattr -cr /Applications/Open Generative AI.app即可之后可正常启动。方式二从源码运行适合想改界面、加模型或排查问题的用户需要 Node.js 18git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup # 安装依赖并构建 packages/ 下的共享工作区必做 npm run dev # Web 版打开 http://localhost:3000 npm run electron:dev # 桌面版注意npm install单独用是不够的必须走npm run setup否则工作区包未构建开发脚本会报找不到页面目录。方式三直接用托管在线版不想搭环境的话官方提供免安装的在线版本注册后浏览器里即可使用全部工作室模型目录与自托管版同源、保持同步。 14 个工作室按用途分组功能入口按场景归到几组新手不必逐个认识按任务找即可图像Image Studio 是双模式设计——不传参考图时列 50 文生图模型上传参考图后自动切换到 55 图生图模型Nano Banana 2 Edit、Flux Kontext 等模型最多接受 14 张参考图上传后带序号多选按你选择的顺序发给模型。视频Video Studio 同样是双模式40 文生视频模型Kling、Sora、Veo、Seedance、Hailuo、Runway与 60 图生视频模型另有 Vibe Motion 做风格化动效、AI Clipping 从长视频自动剪出高亮片段。人物与声音Lip Sync Studio 对口型、Audio Studio 生成和编辑音乐语音、AI Influencer 维护一致的 AI 人设形象。镜头与质感Cinema Studio 用相机参数控制画面下节细讲。批量与自动化Workflow Studio 可视化搭流水线、Agent Studio 对话式执行多步任务、Design Agent 做画布式自主设计、Marketing Studio 从单一输入批量出营销素材外加 Apps 模板目录与 MCP/CLI 入口。组件源码按同名文件组织在 src/components/ 下共享的 React 组件库与模型定义集中在 packages/studio/模型清单的唯一数据源是 packages/studio/src/models.js。 Cinema Studio用相机参数控制电影感这个工作室解决的是画面总差口气的问题它把选相机的专业选项直接变成对提示词的增强修饰而不是让你自己琢磨怎么写 prompt。可调项包括机身16mm 胶片、70mm 大画幅胶片、全画幅电影数字机、S35 摄影棚机、8K 模块数字机等 6 种镜头经典变形宽银幕、复古 Prime、暖调电影 Prime、旋焦人像、极致微距等 11 种焦距8mm 超广角到 85mm 特写人像共 6 档光圈f/1.4 浅景深、f/4 均衡、f/11 深景深每种预设对应一张官方示例图存放在 public/assets/cinema/选之前可以先预览质感差异。️ Lip Sync两种输入方式做会说话的视频配音、本地化、虚拟主播这类需求靠它完成。9 个对口型模型分两组肖像图 音频 → 说话视频Infinite Talk、Wan 2.2 Speech to Video、LTX Lipsync 等可选 480p 到 1080p 分辨率已有视频 音频 → 重对口型Sync、LatentSync、Creatify、Veed、Infinite Talk V2V操作路径固定切换模式 → 传图或视频→ 传音频 → 可选填一段动作提示 → 选模型生成。历史单独存档刷新页面后未完成任务会自动续上不用守着等。 数据全部留在本地两套本地推理引擎调用云端 API 只是默认路径之一。桌面应用内置两个互不依赖的本地引擎在设置 → Local Models里各自配置引擎运行位置能跑的模型适合谁sd.cpp应用本机内置下载SD 1.5 / SDXL / Z-Image 等图像模型Apple SiliconMetal 加速与有 CUDA/Vulkan/ROCm 的机器Wan2GP你自建的 GPU 服务器Wan 2.2、Hunyuan、LTX 视频模型Flux、Qwen-Image 大图像模型有一台局域网 CUDA/ROCm 机器的用户客户端本身跑 Mac 也行硬件上的两个实际提醒sd.cpp 最低 8GB 内存可用跑 Z-Image 系列建议 16GB8GB 机器上已知会卡死请改用 SD 1.5 模型Wan2GP 的推理运行时只支持 CUDA所以 Mac 用户把它当远程服务器用把推理甩给家里的游戏机或租来的 GPU 实例是官方推荐玩法。模型权重默认存在应用数据目录可通过环境变量OPEN_GENERATIVE_AI_LOCAL_AI_DIR挪到别的磁盘。 进阶工作流编排与 API 调用模式Workflow Studio 提供节点式编辑器把图像、视频、音频模型拖出来连成流水线存成自己的工作流也可以直接跑社区发布的模板Playground 里表单化运行、结果内联显示。每条工作流同时可通过 API 触发等于把你的自动化流程开放给外部系统。客户端与服务端之间的通信是一个统一的两步模式实现在 src/lib/muapi.js先用x-api-key头提交POST /api/v1/{模型端点}拿到 request_id再轮询GET /api/v1/predictions/{request_id}/result直到状态变为 completed。文件上传走独立的 multipart 接口多参考图模型则以images_list数组一次性转发。了解这一模式后你想把某个工作室接进自己的脚本或应用照着改就行。️ 适合谁不适合谁个人创作者零费用、无审核适合日常出片和多模型横向对比隐私敏感团队自托管 本地引擎组合素材不离开内网开发者npm workspaces 单仓库Next.js React Tailwind改packages/studio/src/models.js一处自托管与托管版同时生效不太适合没有 GPU 又想跑本地视频模型、且不愿为云端 API 付费的场景——本地视频推理确实需要一块 NVIDIA/AMD 显卡 许可、文档与社区项目采用 MIT 许可可自由使用、修改和再分发。入手顺序建议先读 README.md 的安装与本地推理章节再看 docs/ 里的说明与示例素材遇到问题可以到 README 中给出的 Discord 社区入口提问那里同时反馈模型更新节奏。工作区包、代理路由和上传接口的细节分别落在 app/api/ 与 electron/ 目录想深入时按路径找即可。工具本身不难用真正的价值在于它把多个平台的月费 审核 数据上云换成了一台机器 一份开源代码。把常用模型组合固定成一条工作流之后这套自托管工作室会越用越顺手。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考