ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

Open Generative AI:免费 AI 视频生成工作室,10 分钟从安装到第一支短片

Open Generative AI:免费 AI 视频生成工作室,10 分钟从安装到第一支短片 Open Generative AI免费 AI 视频生成工作室10 分钟从安装到第一支短片【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一个开源的 AI 图像与视频生成工作室集成 Flux、Midjourney、Kling、Sora、Veo 等 400 个主流模型覆盖 14 个工作室图生视频、唇形同步、电影级镜头、工作流编排等。它适合需要自托管部署、希望通过 API 调用这些模型的开发者与普通创作者无内容过滤器MIT 许可证Web 版或桌面应用都能跑通第一支短片。 30 秒速览先看这张表快速判断它是否匹配你的需求。特性说明适用场景400 模型矩阵覆盖文本转图像50、图像转图像55、文本转视频40、图像转视频60、唇形同步9 个等类别按任务挑选表现最好的模型14 个工作室图像、视频、音频、唇形同步、电影、营销、工作流、Agent 等一个应用内完成完整创作流程本地推理桌面应用内置 sd.cpp 引擎SD 1.5 / SDXL / Z-Image可再接 Wan2GP 远程服务器无 API Key 的私密生成多图参考编辑类模型最多一次接收 14 张参考图风格迁移、多角度一致性电影级镜头控制Cinema Studio 提供相机、焦距8–85mm、光圈f/1.4–f/11参数写实电影感画面自托管 APInpm 或 Docker 均可自托管全部工作流可通过 API 调用嵌入你已有的产品 快速上手两条路径预构建的桌面安装包或从源码启动。下面是最短路径。安装步骤前置条件Node.js v18以及一个 Muapi.ai 访问密钥用于云端模型调用只用本地模型可跳过。克隆仓库必须带子模块否则工作流与 Agent 包缺失并安装依赖git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup启动npm run dev得到 Web 版http://localhost:3000或npm run electron:dev启动桌面应用。不想从源码构建可直接从仓库 Releases 页下载预构建安装包macOS DMG、Windows EXE、Linux AppImage / DEB。拿到第一个结果首次打开时应用会提示输入API Key粘贴密钥值即可。进入Video Studio默认就是文本转视频模式。输入一段提示词并选择模型完整列表见 models.js文本转视频有 40 个。设置画幅比例与时长控件会按所选模型支持的值自动适配。点击生成任务完成后即可下载视频。 场景实战教程挑了三个最常被用到的场景每个都按最短操作路径走。场景一把一张产品图变成短片问题你有一张静态图产品、角色或场景想让它动起来变成视频素材。在 Video Studio 上传一张起始帧图片工作室自动切换到图像转视频模式60 个模型。可选地补一句提示词描述运动方向例如镜头缓推、角色转头。选择模型与时长Seedance 2.0 I2V 等模型支持 5 / 10 / 15 秒。生成并下载。预期结果得到一段以静帧为第一帧的几秒动态视频提示词能引导运动方向效果不满意就换模型重跑。场景二用肖像图 音频做口播视频问题需要一个数字人替你念脚本比如短剧、商品讲解或课程录播。进入 Lip Sync Studio选择肖像图模式。分别上传一张人像图片和一段音频文件。可选填一句提示词调整动作风格。选择模型Infinite Talk、LTX 2.3 Lipsync 等 9 个之一和分辨率480p / 720p / 1080p。生成。任务在页面刷新后自动续上不用重新提交。预期结果人物口型与音频对齐的说话视频。如果手里已有实拍视频切换到视频模式用新音频重做口型即可。场景三批量出电影感镜头问题做短片需要一组镜头质感统一的画面。进入 Cinema Studio选择相机如 Classic 16mm Film、Grand Format 70mm Film。选择焦距8mm 超广角到 85mm 特写和光圈f/1.4 浅景深、f/11 深焦。输入场景描述。生成多组镜头横向对比后留用最好的。预期结果镜头参数会被转成提示词修饰器生成画面带有对应胶片/镜头的质感可直接当参考素材或成片镜头。⚙️ 进阶技巧除界面操作外有两种更高效的用法工作流编排和 API 调用。工作流编排Workflow Studio 用节点编辑器把图像、视频、音频模型串成管线内置模板库和社区工作流每条工作流同样可以通过 API 执行适合批量跑同一流程。API 集成客户端是提交 轮询两步——先POST /api/v1/{endpoint}提交任务再轮询/api/v1/predictions/{request_id}/result直到状态 completed密钥走x-api-key请求头。想在自己的服务里直接调用参考 muapi.js 的封装import { generateVideo } from ./muapi.js; // 源文件在 packages/studio/src/muapi.js const result await generateVideo(apiKey, { model: 列表中任一 t2v 模型 ID, prompt: 城市夜景霓虹灯闪烁, aspect_ratio: 16:9, duration: 5, }); console.log(result.url); // 输出视频地址本地推理桌面应用 Settings → Local Models 是两个本地引擎的统一入口。sd.cpp 一键下载安装Wan2GP 需要你自己起一台带 CUDA / ROCm 的 GPU 服务器把地址粘贴进去点 Test 再 Save。⚠️ 避坑与实用建议以下都是仓库中明确记录的约束先看一遍能少走弯路。8GB 的 Mac 别本地跑 Z-ImageREADME 注明在 8GB 基础款 M 系列 Mac 上它会卡死系统Z-Image 建议 16GB 内存约 7.4GB 权重 2.4GB 计算缓冲。8GB 机器用 SD 1.5 模型约 2.1GB。本地推理只在桌面应用里托管 Web 版始终走云端 API别在 Web 版里找本地引擎。从源码启动必须npm run setup单独npm install不会构建工作区包studio、workflow、agents。报 Couldnt find a pages directory 通常是子模块没拉全或没有在仓库根目录执行。API Key 只发给模型接口密钥存在浏览器 localStorage仅发送给 Muapi API。只用本地模型时可以不填 Key。首次启动的系统拦截macOS 应用未做公证需执行xattr -cr或在隐私设置里点仍要打开Ubuntu 24.04 的 AppImage 可能因 AppArmor 启动失败建议改用 .deb。 技术栈与社区前端Next.jsApp Router ReactTailwind CSS。架构npm workspaces 单仓共享组件库在 packages/studiomodels.js 是模型目录的单一事实来源。桌面端Electron 外壳本地推理基于 sd.cpp C 引擎localInference.js。社区入口README.md 有完整的安装、构建指南与 Discord 社区入口Bug 与功能请求走仓库的 Issue 区。Open Generative AI 把文生视频、唇形同步、工作流编排这几条主线收敛进一个可自托管的开源工作室模型目录和界面都可以直接二次扩展。把仓库克隆下来今晚就能跑出自己的第一支 AI 短片。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进