
各位做内容创作的朋友大家好。如果你刷到过那些画面像漫画、剧情却很紧凑、甚至带点悬疑反转的“动态漫”应该会对这类内容有印象。最近两年AI 漫剧也有人叫它 AI 动态漫、AI 短剧在各大内容平台上的热度持续走高很多个人创作者靠两三个人的小团队甚至一个人就能稳定产出成系列的作品。这篇文章会围绕 AI 漫剧的完整制作链路展开从选题剧本、分镜设计、画面生成、配音配乐到最后的剪辑成片把核心流程和常见坑点一次性讲清楚尤其是很多人最头疼的“人物崩坏”问题我会给出完整的解决思路和提示词示例。无论你是刚接触 AI 绘画的小白还是已经有一些短视频制作经验的创作者这篇文章都能帮你建立一套可落地的 AI 漫剧制作流程。1. 为什么大家都在做 AI 漫剧背景与核心概念1.1 什么是 AI 漫剧AI 漫剧简单说就是利用 AI 工具生成漫画风格的画面再通过配音、剪辑、配乐等方式组合成带有剧情叙事的视频内容。它介于“静态漫画”和“传统视频”之间画面的主体通常有漫画线条感、色彩鲜明但人物和场景又有一定的写实或半写实质感配合镜头运动和台词最终呈现为带剧情、有声音、有节奏的“动态漫画短剧”。与传统短剧相比AI 漫剧最大的不同在于画面不是实拍而是 AI 生成的数字绘画。制作周期相对短不需要实景搭建、演员档期、服化道。表现力上限很高可以生成现实中难以拍摄的场景例如玄幻法术、星际穿越、古风宫斗等。制作门槛主要在流程控制而不是资金和场地。1.2 AI 漫剧解决的核心问题传统漫剧或短剧的痛点很明显实拍短剧成本高人员、场地、器材、后期一部稍微像样的短剧成本可能几万到几十万。手工漫画产量低一个熟练画师一天才能产出有限的分镜图连载压力大。内容同质化严重大家拍的都是相似题材难以快速试错。AI 漫剧把“画面生产”这件事变成了“提示词生成 批量重绘 局部修复”让一个人也有可能完成以前一个工作室的产能。它的核心价值不是“省掉画师”而是让没有绘画基础的内容创作者也能把脑子里的画面快速呈现出来。1.3 适合做 AI 漫剧的人群从实际经验看以下几类人最适合入局有网文写作经验的作者可以利用现成的剧本能力快速改编。有短视频运营经验的编导擅长抓爆款选题和节奏。对 AI 绘画感兴趣的技术型创作者能折腾 Stable Diffusion、ComfyUI 等工作流。想低成本验证内容创业方向的个人或小团队。1.4 AI 漫剧的常见分类按照画面风格AI 漫剧大致可以分为类型特点典型题材日漫风线条干净、角色美型、色彩明亮恋爱、校园、异世界韩漫风人物修长、五官精致、光影细腻复仇、豪门、娱乐圈国漫风古风元素多、水墨感、服装精致仙侠、宫斗、历史写实漫画风介于真实与绘画之间质感强悬疑、都市、剧情2. 制作环境与工具选型2.1 硬件环境AI 漫剧的硬件需求取决于你使用什么工具如果使用 Midjourney、即梦等云端工具普通电脑即可建议 16GB 以上内存因为后期剪辑和浏览器多开会比较吃资源。如果使用本地 Stable Diffusion 或 ComfyUI推荐 N 卡NVIDIA独显显存 8GB 起步12GB 以上更流畅。8GB 显存可以勉强跑 SD 1.5 模型SDXL 会比较吃力24GB 跑 SDXL 或视频模型更舒服。磁盘建议保留至少 100GB 可用空间因为模型文件、生成的序列帧和视频素材都很占空间。2.2 工具链总览AI 漫剧制作涉及“文生图”“图生视频”“配音”“剪辑”等多个环节。下面按流程给出常见工具环节工具类型常见选择剧本、分镜文本大语言模型ChatGPT、Claude、文心一言、通义千问角色设定、分镜图文生图工具Midjourney、Stable Diffusion、即梦、可灵图生视频/动态化视频生成工具Runway、Pika、可灵、即梦、Luma Dream Machine配音TTS/声音克隆ElevenLabs、剪映配音、GPT-SoVITS、Fish Audio剪辑视频剪辑软件剪映、Premiere Pro、After Effects、FFmpeg音乐音效配乐生成Suno、剪映音效库这里需要特别说明AI 工具更新换代非常快具体版本和功能要以官方最新信息为准。本文重点讲清楚流程和思路工具只是载体。2.3 工具选型的核心思路很多新手误区是“先挑工具再学流程”实际上应该反过来先确定你的内容类型和画风。如果是国漫古风Stable Diffusion 配合国风 LoRA 可能比通用模型更合适。再评估你的预算。Midjourney 是付费服务Stable Diffusion 本地部署免费但需要折腾。最后考虑你的设备。只有普通办公本就不要强求本地跑 SDXL直接用云端工具效率更高。3. AI 漫剧制作全流程拆解AI 漫剧的制作流程可以概括为六个步骤选题与剧本 → 角色设定 → 分镜脚本 → 画面生成 → 配音配乐 → 剪辑成片下面逐步讲解。3.1 剧本与选题3.1.1 选题思路AI 漫剧的选题逻辑和短剧类似讲究“黄金三秒”和“情绪钩子”。常见爆款选题包括逆袭打脸类废柴主角反杀观众有代入感。重生复仇类开局就进入对抗信息密度高。豪门豪门类身份错位、误会冲突适合女性向。穿越系统类规则新奇、节奏快适合男频改编。提醒平台对内容审核要求比较严格冒险、暴力、擦边等内容尽量不要碰。健康向上的选题也能做出爆款安全合规是长期创作的前提。3.1.2 利用大模型写剧本如果你有网文或短剧剧本基础可以直接改编。如果没有可以让大模型辅助生成。示例提示词可以复制到任意大模型对话框你是一名擅长写短剧的编剧。请帮我写一个 AI 漫剧剧本要求 1. 题材为“都市逆袭”主角从被所有亲戚瞧不起到凭借隐藏身份站出来。 2. 时长约 3 分钟台词约 450 字分 8 个小场景。 3. 每个场景包含场景编号、画面描述、人物动作、台词、情绪提示。 4. 结尾要有一个反转钩子方便下集延续。大模型生成的剧本通常可以直接当分镜描述的雏形但你还需要二次加工把画面描述改写成适合 AI 绘画的提示词。3.2 角色设定让人物“先立住”这一步是解决“人物崩坏”的第一道关卡。AI 漫剧的角色设定不是单纯描述“男主很帅”而是要输出一张或多张可复用的角色参考图。常见做法用文生图工具生成一个角色的标准立绘。保存这个角色的脸部特写、半身像、全身像。在后续所有画面中通过角色参考特征或局部重绘来保持一致。以 Midjourney 为例可以使用--cref参数Character Reference来保持角色一致性。示例a handsome young man in black suit, urban night background, upper body portrait, anime style --cref https://example.com/character.png --cw 80--cw是 character weight数值越高人物面部特征越接近参考图但构图自由度会下降。一般设置在 60 到 100 之间。如果你使用的是 Stable Diffusion则更推荐训练一个专门的 LoRA或者在生成时配合 InstantID、IP-Adapter 等工作流来锁定角色。3.3 分镜脚本设计分镜是漫画到视频的“施工图纸”。一个好的分镜脚本至少包含镜头编号景别画面内容台词时长秒情绪01全景主角站在老宅门口亲戚们指指点点“都说了他没资格继承。”3压抑02近景主角抬起头眼神坚定“父亲留下的东西我有权利知道。”3坚定03特写手从口袋里拿出一枚徽章无2悬念分镜脚本建议在表格工具或 Typora 中维护方便后续按镜头批量生成提示词。3.4 画面生成画面生成是 AI 漫剧最核心的环节也是工作量最大的地方。3.4.1 文生图提示词结构一个标准的漫剧画面提示词建议包含六个部分主体描述角色、服装、动作、表情场景环境地点、天气、时间镜头语言景别、角度、景深风格限定漫画风格、模型风格画质标签high detail、8k、best quality 等负面提示词仅 SD 本地部署需要示例Stable Diffusion 风格positive: 1boy, black short hair, black suit, confident smile, standing at old mansion entrance, night, rainy, full shot, looking at viewer, textured anime style, detailed face, cinematic lighting, high contrast, best quality negative: bad anatomy, bad hands, missing fingers, extra fingers, blurry, low quality, watermark, text, signature3.4.2 从静态图到动态视频生成静态图片后还需要用“图生视频”工具让画面动起来。你可以使用可灵、即梦、Runway 等工具上传静态图再输入一段运动描述。例如镜头缓缓向前推进人物头发在风中微微飘动背景雨水下落人物嘴唇微动眼神逐渐坚定。注意图生视频的运镜越简单生成成功率越高。不要指望 AI 能处理好复杂的人物动作和镜头调度尽量选择“缓慢推进”“缓慢拉远”“摇镜头”这类基础运镜。3.5 配音与音效3.5.1 配音方案配音可以分三档档位方案优点缺点入门剪映内置 AI 配音免费、操作简单音色单一、情感弱进阶ElevenLabs / Fish Audio音色多、情感可控需要付费或配置高级GPT-SoVITS 声音克隆可以用自己的声音部署门槛高3.5.2 声效与音乐背景音乐可以根据剧情情绪选择悬疑、热血、抒情等类型。音效脚步、门声、心跳、雨声推荐使用免费音效库或剪映音效。混音在剪辑软件中人声声轨保证听得清音乐声轨通常压到 -20dB 到 -15dB 左右。3.6 剪辑合成剪辑阶段需要完成三件事按分镜顺序拼接视频片段。同步配音与字幕。加转场、音效、调色、特效文字。常用工具新手推荐剪映操作直观内置字幕识别和配音功能。进阶推荐Premiere Pro 或 Final Cut Pro。自动化批处理FFmpeg适合拼接大量素材。下面是一个用 FFmpeg 将多个视频片段无损拼接的示例# 将多个 mp4 片段合并为一个视频文件 # 先创建一个文件列表 list.txt内容示例 # file clip01.mp4 # file clip02.mp4 # file clip03.mp4 ffmpeg -f concat -safe 0 -i list.txt -c copy output.mp4但需要提示如果视频片段的分辨率、帧率、编码不一致-c copy会报错建议统一转码后再拼接。4. 解决 AI 漫剧人物崩坏问题“人物崩坏”是 AI 漫剧制作中最高频的难题。所谓崩坏指的是同一个角色在前后镜头中出现脸部不一致、服装变化、体型突变、五官扭曲等情况。这也是观众弃剧的第一大原因。4.1 人物崩坏的根本原因要理解为什么崩坏先要知道 AI 文生图的原理没有长期记忆AI 模型不理解“这是第 3 集中的男主”它只是根据当前提示词生成一张图。提示词细节冲突不同镜头的提示词里角色描述不完全一致。模型随机性同一提示词在不同批次下生成的细节也不一样。图生视频放大局部错误图像一旦有小瑕疵动态化之后瑕疵会被放大。4.2 常用解决方案方案一角色参考图锁定最通用、最简单的方法。确保每个镜头都使用同一张角色参考图。Midjourney 用--crefStable Diffusion 用 IP-Adapter 或 InstantID。方案二固定角色描述模板在项目开始时定义一套“角色识别标签”每次生成画面都复制粘贴。例如Character 001: male, 25 years old, black short hair, sharp eyes, black suit, silver pocket watch, tall, serious expression.之后所有提示词都带上这串文字再配合参考图一致性会大幅提高。方案三训练专属 LoRA如果角色是系列作品的常驻角色建议在 Stable Diffusion 中训练一个 LoRA。LoRA 会把角色的脸部特征、服装风格压缩成一个几十 MB 的模型文件之后只要调用这个 LoRA生成的角色都能保持相似。LoRA 训练需要准备 20 到 50 张同一角色的不同角度图片对新手有一定门槛但值得学习。方案四局部重绘修复有时候整张图只有脸部崩了可以使用 Photoshop 的 AI 填充或者在 SD 中使用 Inpaint 局部重绘功能只圈选脸部区域重新生成。局部重绘的提示词只需要描述脸部特征即可不需要重新描述整张图。4.3 一个连贯的角色一致性示例假设我们要做一个叫“林辰”的现代角色下面是一组过程第一步生成角色标准像a young Chinese man named Lin Chen, 25 years old, short black hair, narrow eyes, wearing a black suit with a white shirt, serious expression, upper body portrait, anime style, high detail第二步生成一个剧情镜头使用角色参考图a young man in black suit standing in a luxurious office, one hand in pocket, looking out of window at city skyline, back angle three-quarter view, cinematic lighting, anime style --cref https://example.com/lin_chen_ref.png --cw 85第三步生成另一个场景身体角度变了但脸保持不变close-up portrait of same young man in black suit, sitting in car, night street lights outside window, determined eyes, anime style --cref https://example.com/lin_chen_ref.png --cw 100在这个例子中--cw在第三部提到 100是为了让脸部特征高度接近参考图即使环境和构图完全不同角色依然“像同一个人”。5. 完整实战制作一个 60 秒 AI 漫剧片段下面我们用一个虚构的短剧本走一遍从 0 到 1 的制作流程。这个例子不一定是一次生成就完美但它能帮你建立索引式的工作习惯。5.1 项目需求时长60 秒左右题材都市逆袭画风类韩漫风格角色男主“林辰”、反派“赵经理”输出一个横屏或竖屏短视频建议竖屏 9:16适合短剧平台5.2 剧本文本场景一办公室林辰被赵经理当众羞辱。 赵经理“公司不养闲人你明天不用来了。” 林辰垂下眼帘沉默不语周围的同事窃窃私语。 场景二林辰走出大楼手中的手机震动收到一条加密短信 “林总海外集团 3 亿资金已到账请您签字确认。” 林辰面无表情抬头看天空深吸一口气。 场景三第二天林辰穿着笔挺西装走进会议室赵经理彻底愣住。 林辰“赵经理这份收购协议请你签一下。”5.3 分镜脚本表格镜头景别画面内容台词/音效时长01中景赵经理指着林辰骂赵经理台词5s02近景林辰低头沉默周围同事讨论同事议论声4s03全景林辰走出办公大楼风声、脚步声3s04特写手机屏幕显示加密短信手机提示音3s05中景林辰抬头眼神坚定林辰内心独白4s06全景林辰穿西装走进会议室开门声5s07近景赵经理表情惊愕轻音乐变调3s08特写林辰把文件推过去林辰台词4s5.4 画面生成提示词关键词这里不逐一列出所有镜头的完整提示词给一个“角色 场景 风格 参考图”的组合模板[角色描述], [场景描述], [运镜描述], [画风描述], --ar 9:16 --cref [参考图链接] --cw [0-100]例如镜头 01a middle-aged man in grey suit, angry expression, pointing finger at a young man, modern office interior, blurred background with colleagues watching, medium shot, korean webtoon style, high detail --ar 9:16 --cref https://example.com/zhao_ref.png --cw 85镜头 06a young man in black suit, walking into a modern conference room, confident calm expression, wide shot, glass walls, morning light, korean webtoon style, high detail --ar 9:16 --cref https://example.com/lin_chen_ref.png --cw 955.5 配音与字幕配音台词要精简口语化。60 秒视频的台词量控制在 250 字以内否则语速太快观众会吃力。配音工具选择优先用剪映 AI 配音选择适合“成熟男性”的角色音色语速调至 1.1 倍左右增加情绪停顿。5.6 剪辑流程把所有生成好的视频片段拖入剪映按分镜顺序排列。先铺人声轨用自动识别字幕功能生成字幕。再铺背景音乐选择情绪中性偏紧张的纯音乐。添加关键处音效脚步声、开门声、手机提示音。对整个视频做统一的调色滤镜让画面风格一致。导出发布。6. 常见问题与排查思路问题现象常见原因解决思路同一个角色在不同镜头里长得不一样没有使用角色参考图或提示词角色描述不一致建立角色参考图固定角色描述模板面部细节扭曲、手指数量异常AI 模型限制或提示词缺少负面词使用局部重绘修复手部和脸部增加 negative prompt生成的静态图很好看图生视频后人物变形视频模型对复杂人物动作处理能力有限选择简单运镜避免大幅面部特写和复杂动作画面风格不统一不同镜头用了不同画风词全局统一画风关键词后期统一调色配音和画面口型对不上没有做音频对齐处理优先使用“先配音后剪画面”的顺序视频导出后字幕有错别字自动识别误差人工检查一遍字幕平台限流或审核不通过选题或画面涉及敏感内容遵守平台规则使用安全选题常见的本地部署报错例如“CUDA out of memory”通常是因为显存不足可以把 batch size 降到 1或者换成分辨率更低的基础模型。7. AI 漫剧的进阶优化和变现思路7.1 进阶优化方向使用 ComfyUI 搭建自动化流程把“角色一致性 批量生成分镜 局部重绘”串联起来提升产量。训练自己的角色 LoRA建立系列 IP 壁垒。用大语言模型自动拆解剧本、生成分镜表和提示词只做人工校对。建立自己的素材库将常用场景、动作、表情的提示词分类存储方便复用。7.2 内容分发平台选择AI 漫剧的常见发布渠道包括短剧类平台红果短剧、抖音、快手等。中视频平台B 站、西瓜视频、YouTube。图文笔记平台小红书可以用漫剧切片引流。每个平台的推荐时长、内容规范、分成政策都不一样。发布前建议先研究目标平台的官方入驻规则和创作者学院的说明不要轻信非官方渠道的“搬运月入过万”类信息。7.3 个人创作者如何变现个人的变现路径大致有几种平台分成/播放激励部分平台对优质原创短剧提供收益激励。内容付费在支持付费短剧的平台上架。广告植入当账号有了稳定粉丝基础可以接动画或软件推广。知识付费将你的制作流程整理成课程或模板出售。代做服务为品牌、小说推广方制作动态漫视频。这里需要提醒几点不要被“零门槛月入过万”的广告冲昏头脑。AI 漫剧是内容行业优质内容才是核心工具只是降低制作门槛。音乐、字体、音效要注意版权尽量使用平台自带素材或明确标注可商用的素材。涉及真实人物形象、商标、品牌时要注意授权问题。用 AI 生成内容要在平台允许的范围内注明“AI 生成”避免违规。8. 总结与下一步建议这篇长文从 AI 漫剧的概念、工具选型、完整制作流程、人物一致性解决方案到实战案例已经把最核心的链路讲清楚了。对于零基础的朋友建议不要一上来就追求“500 集的大系列”而是先完成一个 60 秒到 90 秒的单集小样走通整个流程再考虑升级制作效率。如果你已经具备一定 AI 绘画基础下一步可以重点攻克 ComfyUI 工作流把角色一致性、批量出图、局部重绘变成一套可复用的流程。这能极大解放你的生产力也是从“爱好”走向“可稳定产出”的关键一步。最后补充一句AI 漫剧赛道目前仍然处于上升期但竞争也在快速增加。内容创作的长期护城河从来不是某个工具和模型而是你对选题的理解、对节奏的把控、对人物和故事的情感塑造。工具会不断迭代而创作者对好内容的感觉才是真正值钱的东西。如果这篇文章对你有帮助可以收藏起来后面真正动手制作时按章节查阅。也欢迎在评论区交流分享你自己在 AI 漫剧制作中踩过的坑和总结出的经验。