ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

Open Generative AI:3 步跑通本地 AI 绘图视频工作室

Open Generative AI:3 步跑通本地 AI 绘图视频工作室 Open Generative AI3 步跑通本地 AI 绘图视频工作室【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一个可自托管的开源 AI 图像与视频生成工作室14 个工作室覆盖绘图、视频、口型同步等场景接入了 Flux、Midjourney、Kling、Sora 等 400 多个模型。它的核心是运行在你自己的机器上提示词和生成数据不出本机没有订阅费也没有内容过滤。但它真正好用的地方不是能画图而是怎么把它接进你的产出流程。下面按实际任务拆给你看。凌晨还在手动调同一张图的色调先还原两个你可能熟悉的场景。场景一你在做独立游戏需要 30 张场景概念图。传统流程是画一张、改一张凌晨两点还在手动调同一张图的色调而外包一张的概念报价已经排到下个月。场景二你想用 AI 加速但订阅费在叠——Midjourney 一个月十几美元Runway 一个账号Pika 一个账号每个平台都要单独登录提示词稍过一点就被内容过滤器打回来你只能把同一句话换三种委婉写法反复试。后来我试了 Open Generative AI流程变成了一个本地界面400 多个模型在同一个模型选择器里切换提示词想怎么写就怎么写数据全程不出本机。 从一句描述到可用的角色立绘、场景和口型用 Nano Banana 2 出 4K 角色概念图你输入什么一段角色描述比如穿机械护甲的流浪枪手沙漠风全身立绘正面视角加上可选的参考图。它做了什么Image Studio 在没有参考图时走文生图模式70 模型上传参考图后自动切到图生图模式70 模型。模型按各自能力显示对应的分辨率和宽高比选项你选参数直接生成结果进入右侧历史面板。你拿到什么多张可下载的角色候选图历史面板里随时回看、复用。模型定位输出规格Nano Banana 2文生图支持分辨率选择1K / 2K / 4KFlux Dev文生图1024pxSeedream 5.0文生图8 种宽高比最高 4KNano Banana 2 Edit图生图最多 14 张参考图1K / 2K / 4K踩坑提示多参考图模型如 Nano Banana 2 Edit上传时是带序号的多选图片按你勾选的顺序发给模型顺序会影响融合结果别乱勾。把静帧动画成 5 秒场景你输入什么一句场景描述文生视频或者一张刚出的概念图作为首帧图生视频加时长、宽高比参数。它做了什么Video Studio 和 Image Studio 同样的双模式逻辑——不传图走 85 文生视频模型传了首帧自动切到 120 图生视频模型。首帧是你自己生成的概念图时风格和构图能直接延续。你拿到什么一段可直接预览、下载的视频用于氛围演示或过场原型。模式代表模型参数文生视频Kling、Sora、Veo、Wan、Hailuo、RunwaySeedance 2.0 支持 5 / 10 / 15 秒图生视频Kling I2V、Veo3 I2V、Midjourney I2V、Wan I2V首帧可选最多 9 张参考图Seedance 2.0 I2V进阶一步Seedance 2.0 有 Extend 端点可以在保持风格、运动和音频的前提下无缝续写 5 到 15 秒适合把短镜头攒成完整段落。把一段音频贴到角色嘴上你输入什么一张角色肖像或一段已有动画加一个音频文件可选一句引导动作风格的提示词。它做了什么Lip Sync Studio 有 9 个专用模型分两种模式肖像图 音频 → 说话视频视频 音频 → 口型同步视频。生成走提交 → 轮询两段式刷新页面任务不会丢自动恢复。你拿到什么一段嘴型对得上的说话视频可以直接用在对白演示或 NPC 互动原型里。模式模型分辨率肖像图 音频Infinite Talk、Wan 2.2 Speech、LTX 2.3 / LTX 2 19B Lipsync480p 到 1080p视频 音频LatentSync、Veed、Creatify、Infinite Talk V2V沿用原视频规格踩坑提示肖像图模式下选正脸、光线均匀的照片侧脸和逆光素材的口型准确度会明显掉。第一次打开到出第一张图的 5 步以源码方式跑通为例最省事的是直接下官方 Releases 页的桌面安装包macOS / Windows / Linux 都有不用 Node装好 Node.js 18然后克隆仓库。--recurse-submodules不能省Workflow 和 Agent 的包在子模块里git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI进目录后执行npm run setup。光跑npm install不够它还要构建 workspace 里的 studio、workflow、agents 包。执行npm run dev启动 Web 版桌面版用npm run electron:dev浏览器打开http://localhost:3000。首次使用会弹出 API key 输入框填 Muapi.ai 的 key 即可调用云端模型如果你只想跑本地模型可以直接跳过。进 Image Studio选个模型写一句提示词点生成。本地模型路线是Settings → Local Models一键安装内置的 sd.cpp 引擎下载 SD 1.5约 2.1GB这类轻量模型之后在模型选择器旁点 ⚡ Local 开关切换全程不需要 key。注意启动时报Couldnt find a pages directory说明子模块没拉全补一次git submodule update --init --recursive再跑npm run setup。模型定义集中在 packages/studio/src/models.js想看每个模型的参数和能力读这一个文件就够本地推理逻辑在 electron/lib/localInference.js。两个真实量级的用法一个人做的 2D 平台游戏。目标是两周内出演示版本需要一套风格统一的背景概念图和主角精灵参考。做法是先用 Flux Dev 出主角概念挑中意的丢给 Nano Banana 2 Edit把 2 到 3 张参考图一起喂进去统一风格背景用 Seedream 5.0 拉 4K 大图再裁切所有候选都在历史面板里中意的直接下载废的留在库里对照。效果上原来一天画 3 张概念图现在一个下午能过 20 多张候选最后只挑 3 张进人工精修。小团队接的 30 秒游戏宣传片。目标是给一款俯视角射击游戏剪一支带旁白的预告。做法是Cinema Studio 里选 16mm 胶片相机加 f/1.4 浅景深定镜头基调出静帧再把静帧当首帧丢进 Video Studio 用图生视频模型动画化旁白录好后进 Lip Sync Studio把配音贴到片中解说角色的嘴上。整个流程三轮候选下来原来排期一周的活儿两天交付客户改的是要第 2 版而不是重做。明天就能试的第一步打开 Image Studio先拿你项目里最丑的那张资产试试用同样的提示词分别跑一次 Nano Banana 2 和 Flux Dev看 4K 输出和 1024px 输出差在哪再决定哪个模型进你的主力管线。数据留在你自己机器上的 400 多个模型不是摆设——从AI 能不能画出来到AI 能不能画进你的生产流程就是这一张图的距離。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表