一个人做AI漫剧:从写剧本到成片的完整流程

前几天,一个很久没联系的大学室友突然发消息问我:现在学AI漫剧还来不来得及。他说刷到了不少AI做的短剧,心里痒,想自己捣鼓几条试试。
我的回答很干脆:放心做,没问题。
放在2025年,我大概会劝他再等等。那会儿工具还没这么顺手。但到了2026年,AI漫剧的门槛真的被踏平了。你不用找演员,不用管灯光布景,不用为剪辑特效烧钱。一个人、一台电脑,几天时间就能做出一部完整的AI漫剧。真正需要你提供的,只有一个想讲的故事。
五步走完一部AI漫剧
整个流程其实就五件事:写剧本、出分镜、文生图、图生视频、剪辑合成。
第一步,写剧本。 别小看这一步,画面可以靠AI,故事得靠你自己。定题材、定角色、定分集大纲。一部8到12集的短剧,每集一两分钟,你需要一个能钩住人的开头和一个有反转的结尾。
第二步,出分镜。 把剧本拆成一个镜头一个镜头。每个镜头对应一个画面,写清楚镜号、景别、画面内容、台词、时长。这一步做得细,后面生图就顺。
第三步,文生图。 这是工作量最大的一步。把每个分镜的画面描述转成生图提示词,批量出图。用豆包或即梦都行。
第四步,图生视频。 挑关键镜头,让静态的图动起来。人物发丝飘动、树叶落下、镜头缓慢推近,这些细节能让画面活起来。
第五步,剪辑合成。 图片加关键帧运动,配上配音、字幕、音效、BGM,导出成片。

最头疼的问题:角色一致性
做AI漫剧的人,几乎都会栽在同一个坑里:角色长得不一样。第一集女主角是黑长直红瞳,第三集就变成了棕色卷发,观众会瞬间出戏。
解决方法是"先定妆,再拍戏"。
先用AI生成角色的三视图和表情包,把形象锁定下来。然后给角色写一个固定的描述词,比如"林晚,黑发红瞳,红色汉服,手持长剑",每一集都用这一句,别改。最后,出分镜图的时候把定妆照作为参考图传上去,能大幅降低角色跑偏的概率。
还有一个容易被忽略的点:全剧统一用一个画风前缀。别一集日系、一集国风,风格乱跳是AI漫剧的大忌。
提示词怎么写才稳定
写生图提示词,记住一个公式:画风前缀 + 角色固定描述 + 动作 + 表情 + 场景 + 光线 + 镜头。
举一个例子,日系动漫风格,林晚,黑发红瞳,红色汉服,转身拔剑,眼神凌厉,竹林中,逆光,中景,动态模糊,高细节。
画面里的信息都在这一句里了,模型不会瞎猜。
配音这一步,别省
画面出来之后,声音是决定观感的关键。AI漫剧的配音一般用豆包或剪映完成,先把分镜台词整理出来,每一句标清楚情绪、语速、重音,再交给AI配音。
提示词里写一句"用御姐音,清冷但带一点焦急,语速中速",出来的效果比只丢一段文字强很多。配音和画面一样,是靠描述引导的。
字幕也别落下。把配音文本顺手转成SRT字幕格式,剪映里直接导入,省得逐句对时间轴。
发到哪个平台
AI漫剧目前主要发在抖音、小红书、视频号三个地方,B站也有不错的土壤。所以从一开始就建议直接生成竖屏9:16的图,这几个平台的播放器都是竖屏优先,省得后面再裁。
不同平台的节奏不一样。抖音和小红书吃"钩子",前两秒决定观众走不走;B站观众更有耐心,可以做得完整一点。一条片子可以剪几个版本,分别适配不同平台的胃口。
别踩的坑
第一,商用之前确认清楚AI生成内容的版权和平台授权规则。不同的平台和工具,条款不一样,别等发了才发现问题。
第二,不要生成知名IP的角色。画一个"古风女杀手"没问题,画一个具体的、有版权的角色就是给自己找麻烦。
第三,别指望一次出图就满意。AI生图是抽卡逻辑,一批出四张,多抽几批,从中挑顺眼的,再垫图修正。专业人士也是这么干的,不是玄学。
AI漫剧这件事,现在确实到了一个普通人也能上手的时间点。工具是现成的,流程是清晰的,剩下的就是你的故事。室友最后问我要不要一起做,我说你先写个开头出来,我们再看。
相关文章
归藏 PPT Skill:在 Claude Code 内直接制作令人惊艳的 HTML 幻灯片
归藏 PPT Skill 可将任意文章变成精致 HTML 幻灯片——电子杂志风或瑞士风、AI 配图、演讲者工具;可通过 npx 或 git clone 安装。
2026年9月最佳AI图像生成器排名
GPT Image 2.5、Midjourney V8.2、Nano Banana 2、Flux 2 等,按价格和任务推荐排名。
Flux 2 对比 Stable Diffusion 3.5:开源图像竞赛已有明显领先者
Flux 2 在质量上领先,Stable Diffusion 3.5 拥有最深厚的生态。2026 年如何在两者之间选择。
谁拥有 AI 生成图像?版权与 Firefly 漏洞
许可、赔偿以及 Adobe Firefly 的法律保障:2026 年你可以安全发布什么。