AI漫剧制作教程:2026零基础直接上手,从生图、分镜到配音剪辑(保姆级全流程)

AI漫剧其实不难,看完这个教程,你今晚就能做出一集。
工具就3~4样,豆包、ChatGPT、即梦、剪映,六个步骤。三样工具都有免费额度,零基础也能直接跑通
这篇教程把整个流程压缩成三样工具、六个步骤。三样工具都有免费额度,固定的六步工作流:写剧本 → 出分镜 → 文生图 → 图转视频 → 剪辑配音 → 发布,下面逐步拆解。
即梦生成

豆包生成剧本与分镜
做视频的第一步,是需要一个故事。很多人上来就写帮我写个故事,风格没锁定,AI的回答不合心意,问题在提问方式。
向AI提问,都套这个公式:
角色设定:给AI贴专业标签,比如假设你是一位资深作者,同时具备《万妖图录传》、《谁让这个文盲修仙了》的叙事能力,拥有多年的剧本创作经验。
需求描述:明确描述你想做什么。比如“请帮我写一个雨后探索废弃神社的故事,包含一个充满活力的小男孩和他的柴犬伙伴,风格为新海诚式的唯美治愈与夏日清新,字数约450字”。
格式要求:规定输出格式,比如出15个分镜,或以表格/markdown形式输出。
剧本分镜生成
方法一:快速出稿
套用上述公式,让AI生成分镜表格。优点是快,缺点是AI发挥不稳定,逻辑容易有瑕疵。
方法二:先故事后分镜
先让AI写一篇400-500字的完整微小说,先让它生成设定集和细纲,你修改确认满意后,再让AI:“基于以上故事,帮我拆解成15个镜头的视频分镜表”。

提示词示例:
假设你是一个顶尖的新海诚风格动画导演,拥有多年的动画电影创作经验,擅长唯美风景与细腻情感表达。 请创作一个以【雨后探索废弃神社】为背景的【夏日清新治愈】短片脚本。
要求: 一共设计15个镜头,每个镜头不超过4秒。
必须包含:镜头序号、时长、画面描述(包含视觉细节和镜头运动)、台词/旁白。 请以Markdown表格的形式输出。
方法三:小说转剧
把现有的小说复制喂给豆包,让它提炼剧情,并按照写实3D国漫风格转换为视频分镜表。

用ChatGPT/即梦生成资产
这一步不直接生成视频,而是先生成图片,作为视频的底图,这里和ChatGPT/即梦都可以。图片资产分两类:人物和场景。

1.人物基准图
为了防止主角在不同镜头里长得不一样,必须先给主角建档,描述角色的年龄、长相、穿着、发型。
避坑秘籍:
- 必须要求纯白背景,千万不要带任何场景
- 姿势要求正面、双臂自然下垂、无表情
- 画面比例选9:16竖屏
- 如果遇到复杂动作,最好在提示词里加上生成角色三视图,让AI画出正面、侧面、背面
提示词模板:
【风格要求】新海诚2D动画电影风格,日系清新治愈。
【人物基础特征】8岁小男孩,活泼好动,体型偏瘦。
【头部细节】黑色短发,刘海微乱,大眼睛,眼神有神采。
【身体与穿搭】轻便探险夹克,结实徒步靴,小背包,双臂自然下垂。
【技术与环境限制】纯白色背景;全局柔和漫反射光,无死黑阴影。全身立绘,从头到脚完整呈现入镜。人物正视前方,面无表情。头顶和脚底保留适当留白
角色三视图(可与基准图合并):
参考我提供的图片,生成三视图(正面、侧面、背面),全身,可爱充满活力的年轻小男孩,活泼的短发,富有神采的大眼睛,轻便探险夹克,结实的徒步靴,小背包,双臂自然下垂,动漫风格,线条干净利落,白底,细节丰富,设计统一。纯白色背景,全局柔和漫反射光,无死黑阴影
生成满意的图片后,下载并重命名为“主角-小男孩.png”。这张图就是你后续所有视频的参考图。
2. 生成场景底图
提示词来源:复制分镜表里的画面描述,加上和人物同样的风格要求即可。
避坑秘籍:
- 画面中绝对不能出现人物!提示词里要加上无人物、空镜头
- 如果在场景图里生成了人,后面视频里就会出现畸形或“两个人”
- 画面比例选16:9横屏
按分镜顺序下载,命名为“场景1-神社.png”、“场景2-森林.png”。

用即梦生成视频
资产准备齐了,开始合成视频。
操作步骤:
- 进入即梦的“视频生成 → 图片生成”
- 上传场景图:把“场景1-神社.png”传到主图区
- 上传参考图:把“主角-小男孩.png”上传到参考图区域
- 输入提示词:复制分镜表里的动作描述
- 视频时长选择5秒(通常足够了,太长容易崩)
- 模型选择v4.6或v5.0(v4.6保持人物一致性更好)
- 点击生成并抽卡

提示词示例(建议拆分成5-10秒一个的视频):
类型:快节奏、令人振奋的动画电影,新海诚风格
场景:雨后废弃神社,巨大朱红色鸟居和木制回廊,部分浸没在清澈海水中,绿苔、藤蔓、发光植物。
风格与视觉效果:
画质:顶级电影级动画质感,背景细节惊艳,色彩鲜艳生动。
光影:充满情感的夏日阳光,体积光束,绚丽镜头光晕。
镜头与构图:高速镜头运动,动态运动模糊,快速追踪与静态固定结合。
动画/物理效果:极强速度感,激起水花,随风飘动的头发与衣物。
一致性:严格保持角色、光影和环境视觉一致性。
音频与音效:
快节奏振奋配乐;水花飞溅、木板上奔跑脚步声、呼啸风声、狗狗喘息声,无人声对话。
角色:翔太(小男孩),多多(柴犬)。
时间轴与动作:
0–7秒:后方追踪镜头,翔太和多多在浅水中全速奔跑,冲向巨大鸟居。
7–14秒:静态低角度镜头,二者高速掠过镜头,运动模糊。
14–22秒:360度高速环绕追踪,跃过盘根错节的树根。
22–30秒:无人机式后拉镜头,抵达鸟居脚下急停,眺望地平线。 负面提示词:无对话、无文字、无字幕、无UI;无黑暗恐怖元素;无视觉不连贯、无画面闪烁、无角色畸变
注意:AI视频生成经常会有瑕疵,如果不满意,微调提示词(去掉抽象的形容词),再次生成。如果画面没问题但细节有乱码,不用管,视频重在动作氛围。

剪辑与发布
打开剪映,将命名好的视频片段1-1.mp4到1-15.mp4拖入轨道。

配音:复制分镜表中的旁白/台词,使用剪映自带的文本朗读功能,选择合适的情感音色作为旁白。
字幕与音效:使用剪映的识别字幕功能生成字幕。在动作剧烈的地方添加对应的音效。
导出:检查无误后,导出视频即可发布。

避坑宝典
不要直接让AI生成包含人和背景的完整视频,一定要拆分开。先做纯白背景的人物卡,再做无人的空场景图,最后生成视频。这是目前控制AI最有效的手段。
在生成图像时,提示词越少越好,风格词比形容词更重要。写分镜剧本时,你可以让AI描述得很文艺,如晨光熹微,树影婆娑,但在生成图片时,一定要删掉这些抽象词,只保留客观存在的物品(窗户、阳光、床、闹钟)。AI听不懂文艺的形容词,写多了反而容易出废图。
多建立文件夹,硬盘里一定要建好剧本、人物图、场景图、视频素材四个文件夹,后期几十个片段找起来更轻松。
先做完图,再集中做视频,不要生成一张图就去转一个视频。正确的工作流是一口气把15个分镜的场景图全画完,筛选满意后,再丢进视频模型里转视频,这样效率最高。

工具清单
工具 | 用途 | 免费额度 |
豆包 | 写小说、剧本、分镜表 | 有 |
ChatGPT / 即梦 | 文生图、图转视频 | 有 |
剪映 | 剪辑、字幕、配音 | 有 |
3~4样工具,六个步骤,零基础也能左。把上面的提示词复制过去,改改角色和场景,你的第一部AI漫剧就出来了。

塔猴是一个专业的AI接单平台,汇聚海量真实商单。所有商单均经人工审核认证,真实有效。入驻零门槛,零保证金,交易通过三方监管账户托管,专业运营团队全流程参与交付,阶段验收达标后结款。
同时,塔猴也为想提升技能的用户提供AIGC实战课程与前沿资讯,让你在学习和实战中成长。

