ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

自动生成解说视频的开源神器:从主题到成片,5分钟上手的免费教程

自动生成解说视频的开源神器:从主题到成片,5分钟上手的免费教程 自动生成解说视频的开源神器从主题到成片5分钟上手的免费教程【免费下载链接】auto-video-generateor自动视频生成器给定主题自动生成解说视频。用户输入主题文字系统调用大语言模型生成故事或解说的文字然后进一步调用语音合成接口生成解说的语音调用文生图接口生成契合文字内容的配图最后融合语音和配图生成解说视频。项目地址: https://gitcode.com/gh_mirrors/au/auto-video-generateor深夜十一点你刚改完口播稿还得去找配音、找配图、剪片子——如果这是你的每周日常我太懂那种被做视频拖垮的感觉了。今天想认真安利一个开源项目Auto-Video-Generator自动视频生成器你只要输入一个主题它就能帮你自动生成解说视频从文案、语音、配图到成片一条龙全包把几小时的工作压到几分钟。它是怎么做到的其实不玄乎就是把写稿→配音→配图→剪片这四件套串成了一条智能流水线你站在一头扔进主题词另一头就滚出一个能直接发的 MP4。下面我从它有哪些亮点、怎么跑起来、实际能省多少时间三件事讲清楚读完你就能自己上手。图主界面把故事、图像、语音三类参数放在同一屏改完就能一键生成上手前先认识 4 个让你省心的设计亮点1一套代码四个版本按需挑同一个仓库用一个启动参数切换定位这是我觉得最贴心的设计python main.py 1v1 极简版全流程的最小实现适合技术党先验证效果python main.py 2v2 千帆版接百度千帆大模型内容质量更稳定python main.py 3v3 免费版全程用免费资源跑通零 API 成本python main.py 4不带参数即默认v4 专业校对版支持素材逐条校对适合正经做内容的人。建议先跑 v3 免费版熟悉流程真要出作品时切到 v4两档之间只差一个数字。亮点2一键生成之外每一步都能单独控制别被自动两个字吓到。生成故事、切分文本、合成语音、生成图像、创建记录、生成视频六个环节拆得明明白白。想换音色重配某一段语音单独重跑那一步就行不用全部推倒重来。具体逻辑都在 auto_video_generateor/video_generateor.py 里想研究随时可以翻。亮点3素材能逐条校对AI 说的不算你说了算这是 v4 版最值钱的地方。生成完的文本、语音、图像会以文字 波形 预览图的形式并排展示你可以逐条检查不满意就取消勾选、单独重新生成确认无误再合成视频。做口播内容的朋友应该懂AI 一次性输出 90 分容易每条都对味才是真需求。图校对界面把文字、语音波形、图像预览平铺开哪里不对改哪里亮点4老素材自动缓存系列化内容不再重复造轮子所有生成过的资源都会按用户名/代号存到mnt/materials/目录metadata.json记录参数、story.txt存文案、audio和image分目录管理。下次做同系列视频时加载参数 加载资源两步就能把旧素材调回来只重新生成需要改动的部分迭代效率直接翻倍。三步本地跑起来从克隆到出片第1步装依赖、改配置git clone https://gitcode.com/gh_mirrors/au/auto-video-generateor cd auto-video-generateor pip install -r requirements.txt然后改根目录的config.env。默认文本生成走 DeepSeek、语音合成走豆包 TTS作者原话是DeepSeek 接口很便宜10 元能用一年豆包 TTS 玩一玩基本不耗钱。想一分钱不花直接切 v3 免费版即可。第2步一条命令启动python main.py # 默认 v4 专业校对版 python main.py 3 # 想免费体验就带个参数第3步浏览器里开工打开 http://127.0.0.1:9020输入主题 → 一键生成 → 校对素材 → 生成视频然后去泡杯咖啡等它出片。如果你手里有现成的 PPT/PDF 更省事直接在界面里上传PPT 用备注写逐字稿系统会自动把每页幻灯片当画面、逐字稿当解说词需要额外装 LibreOffice细节见 ppt_utils.py。图主题、模板、图像、语音参数一次配好一键生成跑完整个流水线三个真实场景各自省了多少时间教育微课历史老师想做中国古代四大发明科普视频传统流程要写稿、录音、找图、剪辑大半天起步用这个工具主题词一输几分钟出粗剪再校对微调就能用制作效率提升 80% 以上。系列课程还能用代号统一参数模板保证风格一致。电商产品介绍几十款产品各要一条 30 秒短视频手工做一周都紧张。把产品信息批量喂进去系统自动出文案、配音、配图配合本地缓存 代号复用第二条起的重复劳动几乎为零。自媒体日更日更博主最怕从零开始。把 PPT 直接拖进去转视频一页一图一解说10 页的干货稿半小时内能出一版能发的内容还能反复改语音和图片直到满意。图加载参数 加载资源把历史项目的配置和素材调回系列内容不再重复造轮子新手最容易踩的 3 个坑以及解法想跳过流程直接改素材建议先把一键生成或分步流程完整跑一遍尤其是创建记录这步再单独改单条素材否则后台数据容易错位。生成的图片变成了文字图片大概率是后台文生图接口临时抽风稍后再试即可系统会用文字卡片兜底不影响流程体验。担心 API 费用先用 v3 免费版跑通全流程确认输出符合预期再决定要不要上付费接口——两档切换只差一个启动参数。为什么这个项目值得你点个 Star它解决的正是想做视频但不想被工具绑架这个高频痛点而且项目本身也是很好的学习样本从 v1_simple_webui.py 的极简实现到 v4_free_checking_webui.py 的完整校对流程代码注释齐全、目录清晰想二次开发的人照着读就能掌握LLM TTS 文生图 视频合成的完整落地链路。仓库还提供在线体验入口关注趣聊机器人公众号即可拿到账号密码试玩建议先在线摸一遍确认效果符合预期再本地部署。现在就动手5 分钟给自己来条视频流程就三步克隆仓库 → 改config.env→python main.py。别想太多先拿为什么人要睡觉这种小主题跑一遍全流程亲眼看着主题词变成能播放的成片时你会回来 star 的 【免费下载链接】auto-video-generateor自动视频生成器给定主题自动生成解说视频。用户输入主题文字系统调用大语言模型生成故事或解说的文字然后进一步调用语音合成接口生成解说的语音调用文生图接口生成契合文字内容的配图最后融合语音和配图生成解说视频。项目地址: https://gitcode.com/gh_mirrors/au/auto-video-generateor创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表