
Open Generative AI440 模型的自托管 AI 视频生成工作室零订阅费怎么跑【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一个自托管的 AI 图像与视频生成工作室MIT 许可证可自由部署和修改。仓库内的模型定义文件 models.js 按类别维护了 440 个模型条目90 个文本转视频、132 个图像转视频、15 个唇形同步、17 个音频覆盖 Kling、Sora、Veo、Flux、Midjourney、Seedance 等模型全部生成不设内容过滤器。它有三种跑法下载预编译桌面应用、源码自托管 Web 版、桌面应用内的本地推理。三条路径跑起来预编译应用、源码自托管、在线版不想碰终端的话从仓库 Releases 页下载预编译安装包是最短路径macOS 有 Apple Silicon 和 Intel 两个 DMGWindows 是 NSIS 安装包Linux 提供 AppImage 和 deb。macOS 首次启动会被 Gatekeeper 拦下按 README 里的说明执行一次xattr命令或走系统设置 → 隐私与安全性放行即可之后正常打开Windows 的 SmartScreen 警告点更多信息 → 仍要运行就过了。需要改代码或部署给团队用时走源码路径。先装 Node.js v18然后克隆仓库必须带--recurse-submodules工作流和 Agent 两个工作区包是子模块拉取的运行仓库提供的npm run setup一条命令装依赖并构建全部 workspace 包之后npm run electron:dev起桌面端npm run dev起 Web 版浏览器打开http://localhost:3000。如果 Web 版报找不到 pages 目录基本都是没在仓库根目录执行或漏拉了子模块重跑一次 setup 即可。还有一条零门槛路径README 里挂了一个托管在线版浏览器直接注册免费账号就能用全部工作室不用装任何东西。注意它是云端 API 驱动模型跑在对方服务器上——在意数据隐私的话还是走自托管或本地推理。能力边界一张图怎么变成一段视频图像转视频首帧驱动 智能模式切换项目最核心的生成链路是图像转视频你上传一张静态图作为首帧模型负责把它变成动态视频VideoStudio.jsx 里接入了 132 个图像转视频模型包括 Kling I2V、Veo3 I2V、Seedance 2.0 I2V、Midjourney v7 I2V、Hunyuan I2V 等。上传首帧后提示词变成可选项画幅、时长、清晰度这些控件会根据所选模型的能力自动增减——比如 Seedance 2.0 给 5/10/15 秒三档时长和 16:9、9:16、4:3、3:4 四种画幅Grok Imagine 则给 6/10/15 秒。不上传图就走文本转视频分支对应 90 个 t2v 模型。生成结果进历史记录可回看、可全分辨率下载未完成的生成任务刷新页面后会自动续跑。图像编辑走同样的双模式设计50 多个文本转图像模型一传参考图就自动切到 75 个图像转图像模型其中 Nano Banana 2 Edit 和 Flux Kontext 这类模型一次最多吃 14 张参考图多张参考图按你勾选的顺序传给模型。唇形同步9 个模型做口播两种输入模式唇形同步工作室提供两种模式对应不同的素材起点上传一张肖像图 一段音频生成人物开口说话的视频Infinite Talk、Wan 2.2 Speech to Video、LTX 2.3 Lipsync 等 4 个图像输入模型输出 480p 到 1080p 可选或者给一段已有视频换口型LatentSync、Veed、Sync 等 5 个视频输入模型。音频和画面是分开上传的运动风格可以用可选的提示词微调。三个真实场景产品动效、口播出海、批量出片给产品图加动态电商和独立开发者最常用的一条链路。上传产品图作首帧在视频工作室选一个图像转视频模型提示词描述期望的运动比如镜头缓慢推进产品旋转展示几分钟后拿回一条可直接投流的短视频。配合上传历史功能同一批产品图只传一次跨会话反复复用。一张肖像做成多语种口播先用图像工作室把人物形象定下来再进唇形同步工作室把同一张肖像配上不同语言的配音各生成一条口播视频——形象一致、口型逐条对齐适合做账号矩阵或本地化内容。批量出片和长视频工作流工作室支持把图像、视频、音频模型串成多步流水线节点编辑器拖拽连接还能套用社区模板营销工作室则从单个输入生成一批广告创意变体。长视频不够时长时用 Seedance 2.0 Extend 这类视频续写模型接着延长风格与音轨会延续下去。进阶本地推理、Cinema 镜头参数与工作流 API本地推理8GB 内存能跑什么16GB 能跑什么云端模型需要一个 MuAPI 的 API Key如果推理也要留在本地桌面应用内置两个独立引擎设置 → 本地模型里配置Web 版没有这个能力。引擎形态能跑什么硬件底线sd.cpp内置随应用一键下载的 C 引擎模型存在应用数据目录SD 1.5、SDXL、Z-Image 等 6 个图像模型CPU 可跑Z-Image 建议 16GB 内存8GB 的 M 系 Mac 上会卡死只建议跑 2.1GB 的 SD 1.5Wan2GP自备服务器你在 CUDA/ROCm GPU 机器上跑的 Python 服务应用只做 HTTP 客户端Flux.1 Dev、Qwen Image、Wan 2.2、Hunyuan Video、LTX Video服务器端需独显桌面端本身可以在 Mac 上跑Wan2GP 这种应用和推理分离的设计有个实际好处只有一台 Mac 的人可以把局域网里的游戏本或租的 GPU 实例当推理服务器把视频模型的活儿全甩过去。sd.cpp 的模型权重默认放在系统应用数据目录下想挪到别的盘可以设OPEN_GENERATIVE_AI_LOCAL_AI_DIR环境变量。Cinema 镜头参数和工作流 API电影工作室把电影感做成了参数而不是玄学6 种机身从 70mm 胶片到 8K 数字、11 种镜头变形宽银幕、旋焦人像、极微距等、8mm 到 85mm 的焦距、f/1.4 到 f/11 三档光圈选择会被翻译成提示词修饰词交给模型CinemaStudio.jsx 里能看到完整映射。工作流层面每个已发布的工作流都能通过 API 直接执行意味着你调试好的一条图生视频 口播 剪辑流水线可以被自己的后端服务反复调用相当于把这套工作室变成自己产品的生成引擎。想扩展模型时改packages/studio/src/models.js这一个文件即可——它是模型清单的唯一事实来源。起步清单硬件下限、常见卡点、下一步场景最低要求备注在线体验任意设备 浏览器免费账号云端推理桌面应用 云端模型任意设备需要一个 API Key只存在浏览器 localStorage本地图像推理sd.cpp8GB 内存跑 SD 1.516GB 跑 Z-Image模型 2.1GB 到 7.4GB 不等首次下载较慢本地视频推理Wan2GP一台 CUDA/ROCm GPU 机器消费级显卡上 Wan 2.2 较慢LTX 最快常见卡点克隆时漏了--recurse-submodules导致工作流包为空、npm install之后没跑npm run setup导致 dev 脚本起不来、Ubuntu 24.04 用 AppImage 启动即闪退改装 deb 包它自带 AppArmor 配置。下一步建议按这个顺序试先在线版用文本转视频跑通一次完整生成 → 桌面端本地跑一个 2.1GB 的 SD 1.5 模型验证本地链路 → 最后再上 Wan2GP 做本地视频。第一条命令就是克隆仓库git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考