ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

3分钟出片:全自动AI短视频引擎 Pixelle-Video 完整上手指南

3分钟出片:全自动AI短视频引擎 Pixelle-Video 完整上手指南 3分钟出片全自动AI短视频引擎 Pixelle-Video 完整上手指南【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video想日更短视频却卡在写文案、找素材、录配音这三件事上如果你也试过AI 写稿 手动 PPT 自己配音这套半自动流程大概率已经放弃了。Pixelle-Video 做的事很简单你只输入一个主题它自动完成写文案、生成配图或视频、合成语音、加背景音乐最后拼出一条能直接发布的短视频。下面这篇评测基于项目真实代码和配置带你把它跑通并调顺。30秒看懂Pixelle-Video 到底是什么一句话概括它是一个本地跑的开源短视频生成引擎输入一句话主题输出一条带旁白、BGM 和封面的完整视频文件。输入一个主题比如为什么要养成阅读习惯或者你自己写好的完整文案处理LLM 写分镜脚本 → AI 逐镜生成配图/动态视频 → TTS 合成旁白 → 套 HTML 模板排版 → ffmpeg 合成输出保存在output/目录的成片界面里直接预览、显示时长和分镜数最快的上手方式macOS/Linux 装好uv和ffmpeg后克隆仓库执行uv run streamlit run web/app.py浏览器自动打开 http://localhost:8501 Windows 用户可以直接下项目自带的一键整合包双击start.bat就能开界面不用装 Python 环境。核心流程从一句话提示词到成片分 5 步走完整个主流程写在 pixelle_video/pipelines/standard.py 里代码注释把流程拆得很直白对照着界面看基本不会迷路。第 1 步配好 LLM这是全流程的发动机打开界面里的⚙️ 系统配置面板下拉选一个预设通义千问、GPT-4o、DeepSeek、Ollama 等预设定义在 pixelle_video/llm_presets.py填 API Key 即可。选 Ollama 的话走本地模型一分钱不花选通义千问成本也很低。跑完这一步你得到的是后续所有文案、分镜、配图提示词都能自动生成。第 2 步选内容模式输入主题左侧栏有两种模式AI 生成内容只给主题AI 写稿和固定文案粘贴现成文案跳过创作支持按段落/行/句子分割。这一步同时能设置分镜数默认 5 个。跑完得到一份可预览的解说脚本。第 3 步挑 TTS 工作流决定声音中间栏的 TTS 下拉菜单会自动扫描 workflows/ 目录内置了 Edge-TTS免费、零配置和 Index-TTS支持声音克隆等选项对应workflows/selfhost/tts_edge.json、workflows/runninghub/tts_index2.json这些 JSON 文件。想克隆自己的声音就上传一段参考音频MP3/WAV/FLAC 均可先试听再正式生成。这一步产出的是每个分镜的旁白音频。第 4 步选图像工作流和模板决定画面图像生成有三条路可选本地 ComfyUI、云端 RunningHub、直连模型 APIDashScope、OpenAI、可灵、字节 Seedream 等默认走runninghub/image_flux.json。模板决定排版templates/目录按尺寸分了三个文件夹命名即含义static_*.html纯文字不用 AI 生图、image_*.html套 AI 配图、video_*.html套 AI 生成的动态视频。界面里可以点预览模板先看看效果。第 5 步点生成看进度拿成片右侧 生成视频按钮会实时显示进度分镜 3/5 - 生成插图这种粒度底层由 pixelle_video/services/comfy_base_service.py 这类服务基类异步驱动。完成后视频自动播放文件落在output/文件夹。深入剖析 3 个杀手级功能数字人口播上传一张人像照片就能开口说话入口在 web/pipelines/digital_human.pyUI 是三栏布局左边上传角色图像中间选工作流和参数右边预览。底层配合 workflows/runninghub/digital_combination.json 这类工作流把人物图 文案 TTS 串成口播视频。适合做知识讲解、课程切片不用真人出镜也不用录棚。图生视频与动作迁移静态素材也能动起来图生视频在 web/pipelines/i2v.py把一张静态图交给 WAN 2.1/2.2 这类视频模型生成动态片段工作流文件在 workflows/runninghub/如video_wan2.2.json、video_wan2.1_fusionx.json。动作迁移web/pipelines/action_transfer.py更野一点你上传一段参考视频 一张目标图片参考视频里的动作会被迁到图片主体上官方示例是一只跳舞的小猫。做舞蹈教学、产品展示素材时这招很实用。模板即产品力换模板 换一条视频的皮这是我觉得最被低估的设计。模板就是 templates/ 目录下的 HTML 文件按1080x1920竖屏、1920x1080横屏、1080x1080方形分组同一段文案配不同模板就是三种完全不同的成片。横屏的image_film.html是黑底电影感image_wide_darktech.html是深色科技卡片风方形的image_minimal_framed.html适合直接发图文流会点 HTML 的话可以自己往目录里扔模板界面下拉菜单会自动识别——模板系统本身就是半个插件机制。配置调优指南最常改的 4 个字段配置文件把 config.example.yaml 复制成config.yaml就能用文件头特别提醒别把它提交到 Git。下面四个字段是 80% 场景下你要动的字段作用推荐取值comfyui.image.default_workflow决定配图走哪条生成链路没本地显卡选runninghub/image_flux.json有本地 ComfyUI 选selfhost/image_flux.jsoncomfyui.runninghub_concurrent_limit云端 RunningHub 并发上限1-10普通成员保持1会员按套餐调高超了会排队报错llm.modelllm.base_url写文案的大脑追求性价比qwen-max完全免费走 Ollamabase_url填http://localhost:11434/v1template.default_template默认排版模板发抖音/视频号1080x1920/image_default.html发 B 站横屏1920x1080/image_film.html另外两个容易忽略的comfyui.image.prompt_prefix是配图风格前缀注意要写英文比如火柴人简笔画风改这一个字段就能统一整条视频的画面风格TTS 默认工作流在comfyui.tts.default_workflow默认指向selfhost/tts_edge.json。实际应用场景举例知识口播号日更主题输入 固定 TTS 音色 竖屏image_default模板一条为什么我们还没找到外星文明式的科普视频全自动产出适合没时间剪辑的知识区博主课程/产品介绍用数字人管道传一张讲师照片配合固定文案模式把写好的讲稿变成口播视频适合培训机构和企业内训素材盘活手里有一堆静态图和一段参考视频用图生视频 动作迁移把旧素材变成动态内容配 BGM 后直接当短视频发适合自媒体二次创作常见问题与踩坑指南更完整的排查清单在 docs/FAQ_CN.md这里挑最容易卡住的几个。TTS 总是失败、报错不稳定默认 Edge-TTS 走微软免费接口网络波动时失败率偏高官方 FAQ 里也承认了这点。解决切到 ComfyUI 链路的 TTS 工作流下拉菜单里tts_前缀的其他选项比如 Index-TTS稳定性明显更好。报错 Could not find a Chrome executable你的系统没装 Chrome 内核。装一个 Google Chrome 就行模板渲染环节依赖它把 HTML 截成画面。LLM 配了但生成文案直接报错按顺序查三样base_url是否多了空格或多余后缀、API Key 是否有效有余额、模型名拼写是否正确。选预设会自动填对前两项手填的话最容易在 URL 上翻车。配置改完不生效优先检查两点一是界面里配完要点保存配置二是如果你同时在config.yaml和 WebUI 里改过同一个字段以后者优先的字段为准别在两个地方各写一个值。总结它适合谁不适合谁适合内容量大、单条视频复杂度不高的创作者——科普号、知识卡、课程口播、产品短视频以及想研究AI 短视频全链路怎么串的开发者模块化程度很高管道在 pixelle_video/pipelines/服务在 pixelle_video/services/各是各的好读好改。不适合追求电影级叙事和精细剪辑的片子——它是自动出活路线不是精修路线重度依赖 RunningHub 云端方案的话要注意 API Key 费用和并发上限纯本地免费方案Ollama 本地 ComfyUI对显卡有要求。改进空间也很明确模板和 TTS 音色库还可以再厚一些视频片段的时长和旁白对齐目前靠尽量匹配偶尔需要手动看一眼。如果你就想用最低成本先出一条能发的视频我的建议克隆仓库git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video用 Ollama 本地 ComfyUI 的免费组合跑通第一条再逐步升级到云端模型提画质。项目文档在 docs/ 下中英文都有快速开始从 docs/zh/getting-started/quick-start.md 看起就行。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表