ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

Open Generative AI 完整指南:AI 图像视频生成从入门到进阶

Open Generative AI 完整指南:AI 图像视频生成从入门到进阶 Open Generative AI 完整指南AI 图像视频生成从入门到进阶【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI把一句文字描述变成一段 15 秒的动态视频在很多平台要付每月几十美元的订阅费。Open Generative AI 把这件事做成免费开源的它是一个可自托管的 AI 图像视频创作工作室内置 400 模型支持文本到图像、图像到视频与唇语同步且没有内容过滤。 三句话看懂 Open Generative AI 能做什么它用一个统一界面把图像、视频、电影特效和唇语同步打包在一起所有模型都集中在 packages/studio/src/models.js 一个文件里维护更多细节见 README。三句话讲清它是什么它是什么一个免费、开源MIT 协议、可自托管的 AI 图像视频创作工作室基于 Next.js 与 React 构建覆盖14 个工作室和400 模型models.js清单实际已登记 500 个。解决什么问题让创作者不必为 Midjourney、Runway 等订阅按月付费也不受提示词被拦截或改写的限制本地部署时数据不离开自己的机器。和付费方案比省在哪零订阅费、零使用上限。Midjourney 约 $10–$120/月、Runway 约 $12–$76/月这部分钱直接省下还能把界面换成自己的品牌。 按你的投入程度选上手路径三条路径都能完成第一次生成区别只在你愿意配多少环境。轻用户浏览器里直接生成打开托管版页面注册一个免费账户。进入 Image 或 Video 工作室选模型、填提示词、点 Generate。结果自动存入本地生成历史可一键下载原图。提示托管版默认走云端 API模型总是最新的适合不想配环境、只想快速出图出视频的人。进阶用户装桌面版并启用本地推理从 Releases 下载对应平台安装包macOS 用.dmg分 Apple Silicon / IntelWindows 用.exeLinux 用.AppImage或.deb。打开应用后进入Settings → Local Models一键安装 sd.cpp 引擎并下载模型。在 Image Studio 点模型选择器旁的⚡ Local开关即可本地生成无需 API key。开发者从源码构建前置准备 Node.js v18要用云端模型再备一个 Muapi.ai 接口密钥只用本地模型可跳过。运行git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI进入目录后执行npm run setup它会自动npm install并构建 studio / workflow / agents 等 workspaces只跑npm install是不够的。桌面版跑npm run electron:dev网页版跑npm run dev后访问localhost:3000。 按目标场景用核心能力按你想做成什么找入口不用纠结技术模块。给一张产品图「动起来」上传一张静态起始帧选一个图像到视频模型静态画面就变成 5/10/15 秒短视频。比如把一张电商主图生成背景缓缓流动的展示视频或给插画里的雨加上飘动效果。把文字直接变成图或视频不传图就是文本到图像 / 文本到视频模式填一句提示词即可。比如输入清晨森林中的小木屋阳光透过树叶洒下斑驳光影选 Flux Dev 或 Nano Banana 2 出图选 Kling、Veo 或 Wan 2.6 出视频。让照片开口说话Lip Sync Studio 用9 个专用模型覆盖两种输入肖像图 音频 → 会说话的视频或已有视频 音频 → 唇语同步视频。比如上传一张人物肖像和一段录音生成口型对齐的讲解视频或给外语视频配上本地语言的口型。调出电影质感的镜头Cinema Studio 把相机、镜头、焦距、光圈的选择转成优化过的提示词修饰符焦距覆盖 8mm 超广角到 85mm 特写光圈有 f/1.4 浅景深到 f/11 深景深。比如选 Premium Modern Prime 镜头 f/1.4就能让人物特写带上有质感的电影光斑。三档硬件配置怎么选本地推理只对桌面版开放托管网页版一律走云端 API所以这一节主要面向桌面版用户。三档配置建议档位配置能跑什么说明最低8GB 内存SD 1.5 图像模型8GB M 系列 Mac 跑 Z-Image 会卡死系统只建议用 Dreamshaper 8 这类 2.1GB 的 SD 1.5 模型推荐16GB 内存Z-Image、SDXL、部分视频模型Z-Image 需要约 7.4GB 权重 2.4GB 计算缓冲16GB 才稳高端16GB 内存 独立 GPUCUDA/ROCmFlux、Wan 2.2、Hunyuan 等视频模型视频大模型交给 Wan2GP 服务器桌面端可以是任意设备含 Mac两个本地推理引擎sd.cpp内置基于 stable-diffusion.cpp 的 C 引擎与 App 同机运行Apple Silicon 走 Metal GPU 加速Linux/Windows 走 CUDA/Vulkan/ROCm适合纯图像模型比如 Dreamshaper 8、Realistic Vision v5.1、SDXL Base 1.0。Wan2GP自备服务器HTTP 客户端连你自己跑的 Wan2GP 服务器Python PyTorch需 CUDA/ROCm GPU适合视频大模型比如 Flux.1 Dev、Wan 2.2 T2V/I2V、Hunyuan Video、LTX Video。桌面端本身可以跑在 Mac 上把推理甩给局域网里的 GPU 机器。提示词、多参考图与工作流把单次生成做成稳定产出主要靠这三招。提示词怎么写给对写具体把环境、光线、氛围写进去比如清晨森林中的小木屋逆光丁达尔效应。加风格词带上油画、水彩、赛博朋克等艺术风格词模型会更贴合预期。用负面提示明确排除不想要的元素比如无文字、不模糊、避免多余肢体。按模型调参支持的模型才显示质量/分辨率选择器比如 Nano Banana 2 能选 1K/2K/4Kflux-schnell 则不显示。多张参考图一次喂进去兼容的编辑模型最多支持14 张参考图Nano Banana 2 Edit选择器带序号徽章、支持批量上传。比如做产品换背景时把主图 3 张风格参考按顺序选中系统会按你选择的顺序发给模型。用工作流把多步串起来Workflow Studio 提供模板、社区工作流和拖拽节点编辑器把图像、视频、音频模型连成流水线。比如文生图 → 图生视频 → 加配乐三步连成一个工作流之后用 Playground 一键跑完也能直接通过 API 调用。⚠️ 三个高频坑的现象与解法macOS 首次打开被拦截现象双击应用提示已损坏或 Gatekeeper 阻止打开。原因应用未经 Apple 公证notarized。解法终端执行xattr -cr /Applications/Open Generative AI.app再右键点打开确认一次或走系统设置 → 隐私与安全性 → 仍要打开只做一次。8GB 内存跑 Z-Image 卡死现象选 Z-Image Turbo/Base 后系统假死、应用无响应。原因Z-Image 权重约 7.4GB 2.4GB 缓冲8GB 基础内存装不下。解法8GB M 系列 Mac 改用 Dreamshaper 8 等 SD 1.5 模型约 2.1GB想要 Z-Image 就升到 16GB。源码启动报找不到 pages 目录现象npm run dev后 Next.js 报 Couldnt find a pages directory。原因没带 submodule 克隆或没执行npm run setup导致 workspaces 包缺失。解法确保从含app/、package.json、next.config.mjs的仓库根目录运行并重新npm run setup补齐packages/Vibe-Workflow等子模块。适合想免费、无内容过滤地出图出视频并且愿意为隐私自己托管的创作者以及需要多张参考图、电影级镜头这类付费平台没细项的人。如果你手头有一台 16GB 的机器现在就可以下载桌面版从 SD 1.5 的 Dreamshaper 8 跑出第一张图。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表