文章摘要
2026年AI漫剧制作进入量产阶段,文章提供两条主流创作路线及操作步骤,包括角色设定、故事板生成、视频生成等。还分享了Seedance2.0提示词写法,如角色锚定、时间控制等。同时给出脸崩、动作不连贯等问题的避坑指南及后期剪辑、发布建议,强调熟悉适合自己的流程,创意才是爆火关键。

2026年,AI漫剧制作已进入量产阶段,但我见过太多作者,花了时间、金钱,产出的却是PPT式漫剧,角色张嘴就僵硬,画面毫无电影感。


其实现在主流玩法已经固定,不会写分镜提示词也没事,有 ChatGPT/Claude帮忙,你只要会剪辑就行。角色变脸、动作割裂、叙事混乱,这篇文章带你一次性避开三个大坑。


有两条主流的创作路线,任选一即可。

路线A :GPT Image 2生成角色图 → ChatGPT/Claude生成故事板 → Seedance 2.0生成视频

路线B :Higgsfield MCP — 接入Claude语义理解 + Seedream 5.0 Pro生图 + 多模型视频生成


Higgsfield MCP生成


1.png

工具一览


环节

路线A工具

路线B工具

剧本/分镜

ChatGPT / Claude

Claude(通过Higgsfield MCP)

角色生图

GPT Image 2

Seedream 5.0 Pro

视频生成

Seedance 2.0

Seedance 2.0 / Kling 3.0 / Sora 2 等

配音

ElevenLabs / Fish Audio

Higgsfield内置语音克隆

剪辑

剪映

一站式合成;剪映辅助


2.png

路线A

第一步:用GPT Image 2生成角色设定


下载 (18).jpg


角色一致性是漫剧的命门,第一步,就是用GPT Image 2生成规范的角色设定板,作为视觉锚点。


不要一张一张生成角色图,让AI在一张图片里生成主视觉、多角度转面、头部研究和服装细节。一张图,让角色从此有身份证。


角色图提示词模板:

横版宽幅角色设定提案板,浅灰中性背景。自由非对称拼接画排版,主次分明:中央置入一张电影感主视觉全身立像;周边环绕全身多角度转面图(正面、3/4侧、正侧、背面、3/4背);侧边附带头部详细研究组图(正面、3/4、正侧、低头、抬头、动态角度);嵌入一张富有叙事感的情绪特写肖像;局部附服装与配件拆解说明及材质标注引线。
角色为[填写名字],[填写外貌特征],身穿[填写服装]。风格为[填写风格方向]。
画面要求:[风格]


为什么这种方才是正解?


锁定角色全貌:设定板包含了从正面到背面的所有关键角度,任意镜头都能从中找到参考;

服装细节完整:配件拆解和材质标注让AI理解蓝色领巾系法、百褶裙褶皱走向这类容易被忽略的细节;

全角度一致:AI在同一提示词中生成的所有角度共享同一套特征参数,比分开生成的多张图稳定得多。 场景设定板和道具设定板同理,把角色替换成场景或道具,再填入对应的描述即可。


第二步:用GPT/Claude生成故事板提示词


下载 (19).jpg


有了角色设定板,接下来把你的故事交给GPT或Claude,让它转换成可供Seedance 2.0使用的提示词。


不要自己一字一句写分镜,让AI生成分镜头描述 + Seedance 2.0提示词,这样能完整配对。如果手头有国外大神的分镜提示词模板,可以喂给模型作为参考样例,输出质量会再上一个台阶。


推荐喂给模型一个优秀样例,比如我之前文章里的分享,粘贴给GPT/Claude,告诉它:“请模仿这个格式和详细程度。”


输入你的故事概要:

请帮我为一个战斗漫剧生成分镜脚本,分为多个15秒故事单元。总剧情为:
[在这里粘贴你的故事梗概]

角色设定参考我提供的角色图:[粘贴角色特征]
场景设定:[描述场景]

要求输出格式:
- 每个15秒故事单元为一个独立板块
- 每个镜头按"镜头编号、时长、景别、角色、动作描述、相机运动、对白、场景"结构化输出
- 每个镜头附带一段可直接复制到Seedance 2.0的提示词
- 每个镜头的Seedance 2.0提示词必须包含:镜头类型、主体动作、相机运动、场景氛围、质量控制


模型会给你多个15秒的故事单元。


【故事单元示例】

镜头1(0-3秒)——低角度固定镜头。葵瘫坐在课桌间的瓷砖地板上,右侧高窗透进阴沉的日光,周围散落着翻倒的课桌和笔记本,汗水浸透了她的刘海,领巾松开,一只手按在腹部,呼吸急促。墙上的钟滴答作响。
镜头2(3-5秒)——葵放在瓷砖上的手的特写镜头,指甲变黑变长,变成利爪,皮肤下青筋暴起,肌肤泛起淡淡的红晕;急促的呼吸渐渐变成湿漉漉的咔哒声。
镜头3(5-8秒)——快速三帧剪辑,葵变成怪人:象牙色的脊椎刺破衬衫;下颚裂开,骨白色的骨板覆盖头骨;第二层眼睑在锁骨上撕裂,灰色的虹膜滚落到位。


【Seedance 2.0 提示词】

镜头1:低角度固定镜头,9:16竖屏,葵(参考角色图)瘫坐在教室瓷砖地板上,周围翻倒课桌和笔记本散落,阴沉日光从右侧高窗射入,汗水浸湿刘海,一只手按腹部呼吸急促,墙上时钟滴答作响,电影感写实风格,保持角色面部身份、发型、水手服蓝色领巾不变,无文字无标志扭曲。
镜头2:特写镜头,9:16竖屏,葵(参考角色图)的手放在瓷砖地面上,指甲变黑变长成利爪,皮肤下青筋暴起泛红晕,呼吸声从急促变为湿漉漉的咔哒声,阴天冷色调光线,保持角色手部形态自然,禁止手指变形或穿模。
镜头3:快速三帧剪辑效果,9:16竖屏,葵(参考角色图)变身成怪人(参考变身角色图),象牙色脊椎刺破背部衬衫,下颚裂开骨白色骨板覆盖头骨,第二层眼睑撕裂灰色虹膜滚落到位,湿裂音效伴随,冷冷的蓝灰色光线透过粉色纸巾,保持角色身形比例一致,禁止扭曲变形或模糊。

第三步:将提示词丢给Seedance 2.0生成


拿到GPT/Claude生成的配对提示词后,逐个粘贴到Seedance 2.0中,上传参考图,并@对应图片,生成即可。


原则: 角色由设定板锁定,提示词负责描述动作、运镜和场景变化,不要在提示词中重复描述角色外貌,否则可能引入偏差。


GPT Image 2生成角色设定板 → GPT/Claude生成故事板+Seedance提示词 → Seedance 2.0逐个生成视频片段 → 剪辑拼接成完整漫剧

3.png

路线B


下载 (19).png


推荐使用Higgsfield MCP,这是国外目前主流的AI视频平台,新推出的MCP连接器将Claude变成了一站式AI视频生成器。


连接后,Claude可直接调用Higgsfield平台的所有模型和功能。你描述想要的镜头,Claude选择合适模型、配置参数、启动生成,生成视频。


通过这个连接,Claude可以调用30多种视频和图像模型,包括:

视频模型:Veo 3.1、Sora 2、Kling 3.0、Seedance 2.0、Wan 2.6、MiniMax Hailuo

图像模型:Soul 2.0、Nano Banana Pro、Flux 2.0、Seedream 4.5等


输出最高可达4K分辨率,单片段最长15秒,支持任意宽高比。


第一步:连接Higgsfield到Claude


  1. 访问higgsfield.ai,复制MCP链接
  2. 在Claude中打开 设置 → Connectors → 添加
  3. 命名,粘贴 https://mcp.higgsfield.ai/mcp
  4. 点击连接


第二步:角色训练与锁定


Higgsfield的Soul Character功能非常强大,可以从几张参考照片训练一个角色,确保不同场景下角色还能稳定。


操作: 上传3-5张同一角色的不同角度照片,训练一个Soul Character,后续所有生成直接调用这个角色ID,解决变脸问题。


语音也可以同样方式克隆,只要有1分钟样音,就能跨语种配音。


第三步:故事转换成视频


下载 (20).png


Higgsfield MCP最强大的地方,就是不需要提示词技巧。


直接把你的故事丢给他,让他生成漫剧片段,他就能理解你的意图,选择最合适的模型,生成符合Seedance 2.0的提示词,调用Higgsfield平台执行生成,把成品视频带回对话中。


你也可以同时向多个模型发送同一需求,对比结果后选择最好的一个。


其实路线B的方法和路线A一致,只是更加省事,本质是 Seedream5.0pro生成角色设定板 → GPT/Claude生成故事板+Seedance提示词 → Seedance 2.0逐个生成视频片段 → 剪辑拼接成完整漫剧。


4.png

Seedance 2.0提示词分享


下面我用一个完整案例,带大家逐帧拆解Seedance 2.0的提示词技巧。


1. 角色锚定


ezgif-8c7d75e6d0d2cbe7 (1).gif


写法:

葵@图片1;怪人@图片2;澪@图片3;莲@图片4;教室@图片5
所有镜头均发生在教室


开头给每个角色和场景分配参考图,并后锚定当下场景,这是解决角色一致性的最有效方法。


2. 时间控制


写法:

镜头1(0-3秒)— 低角度固定镜头。葵瘫坐在课桌间的瓷砖地板上...
镜头2(3-5秒)— 葵放在瓷砖上的手的特写镜头...
镜头3(5-8秒)— 快速三帧剪辑,葵变成怪人...

用秒级标注镜头时长,让模型理解剧情推进的节奏。哪个时间段发生什么事,一清二楚,新手很难把握具体描述,所以推荐采用GPT/Claude生成提示词。


3. 特效描述


ezgif-642ff1e531916fdf (1).gif


写法:

快速三帧剪辑,葵变成怪人:象牙色的脊椎刺破衬衫;下颚裂开,骨白色的骨板覆盖头骨;第二层眼睑在锁骨上撕裂,灰色的虹膜滚落到位。硬切,湿裂声,粉色纸巾上透着冷冷的蓝灰色光线。


这里需要葵变成怪物,而变形是AI视频最难处理的动作之一。你需要把变形过程拆解成一系列物理变化,脊椎刺破、下颚裂开、骨板覆盖,要具体描述,不能笼统地说变身。同时加入音效提示和光影描述(冷冷的蓝灰色光线),让场景更有质感。


4. 角色交互与台词


写法:

镜头5(10-12秒)——镜头在昏暗的走廊里。澪和莲手持镰刀和锤子,朝着左侧的木门飞奔而去;他们冲进灰蒙蒙的日光中,瞬间僵住。澪认出了怪人的水手领。
澪(日语,低声):“迟到了。”
镜头6(12-13.5秒)——低角度镜头。莲率先冲锋,锤子挥向怪人的腿;反击将他击飞,穿过桌子撞到软木板墙上,钉子上的纸张散落一地。


每个角色独立动作,一个镜头只出现一个角色,这样澪和莲各有分工,不是两个人一起打,模型更容易处理。被击飞后,加入环境反馈,环境的破坏增强了动作的冲击力

5.png
避坑指南

坑1:脸崩了


下载 (21).png


症状: 同一个角色,不同镜头里长得不一样。


方案

最简单:在每个镜头的提示词里写入完全相同的、具体的角色描述,形成文本锚点

最稳定:上传角色定妆照作为参考图,提示词只写动作和场景


坑2:动作不连贯


症状: 角色动作生硬、跳跃、不自然。


方案:

在提示词中强制加入连续帧描述(如快速三帧剪辑、慢镜头叠化)

控制每个镜头的时长,复杂动作给足时间(5-8秒),简单动作压缩(2-3秒)


坑3:手指/武器穿模


症状: 手指多一根少一根,武器插在身体里。


急救方案:

在负面约束中明确写入“无扭曲手指”、“无武器穿模”

与其死磕生成,不如接受差不多的结果,用后期工具局部修复


坑4:算力管理


错误做法: 一次性生成15秒长视频。


正确做法: 以3-5秒为单位分段生成,最后用剪辑软件拼接。这样即使某一段翻车了,重做的成本也低得多。


6.png

后期成片


剪辑

剪映:上手最快,适合快速卡点剪辑、添加字幕和BGM


卡点技巧: 动作镜头配合音乐节奏,快切对应鼓点,慢镜头对应旋律高潮。


为每个角色建立独立声线档案,后续作为参考声音。


发布参数


平台

推荐比例

时长建议

分辨率

抖音/TikTok

9:16竖屏

30-60秒

1080×1920

B站/YouTube Shorts

9:16竖屏

15-60秒

1080×1920

7.png

写在最后


2026年的AI漫剧工具链已经相当成熟,关键不是选哪个工具最好,而是熟悉一套适合自己的流程。


好故事、好创意更重要,要想爆火,工具不是门槛,情感价值、角色塑造与创新叙事才是关键。


AI帮你完成的是执行,而创意永远属于你。


以上内容不代表本平台立场,仅供读者参考