AI生成连续漫画人物一致性:连载分镜里保持角色不跑偏

连载漫画最怕什么?角色刚出场就“换人”
做连续漫画的人,最容易遇到的不是不会画,而是角色一致性失控:第一格是圆脸短发,第二格脸变尖了;上一话穿校服,下一话衣服细节全变;明明是同一个主角,连眉眼神态都像换了个人。单张图看着还行,一放进连载分镜,故事感立刻断掉。
AI 生图在漫画场景里很方便,快、能试风格、能批量出草图,但它天然更擅长“生成漂亮画面”,不天然擅长“长期记住同一个角色”。所以做连载分镜时,真正要管住的不是“让它画得更炫”,而是让它在几十张图里都认得出同一个人。
这件事不是靠运气。只要把角色设定、参考图、提示词、镜头控制这几层搭起来,AI 画连续漫画就能从“每张都像新角色”变成“基本稳定、局部可控”。如果你已经用过 机灵助手 之类的 AI 生图工具,会更容易理解:模板只是起点,真正决定连续性的是你怎么喂信息、怎么锁特征、怎么改图。

先别急着写剧情,先把角色钉死
很多人做漫画分镜时,一上来就写“他冲进教室”“她回头一笑”,结果 AI 画出来的人每格都不一样。原因很简单:你给的是动作,没有给足角色身份。对于连续漫画,角色设定要先于剧情,因为 AI 只有先知道“这个人长什么样”,才有可能在不同画面里保持一致。
建议先把主角拆成几个不会轻易变的部分:
- 脸部识别点:脸型、眉形、眼型、鼻梁、嘴角走势、是否有雀斑或痣
- 发型识别点:刘海分缝、长度、卷直、发色、是否扎发
- 体型识别点:身高感、肩宽、四肢比例、胖瘦
- 固定服饰:校服、外套、鞋子、配饰、包、手表、耳钉
- 气质标签:冷淡、莽撞、社恐、元气、成熟、嘴硬心软
这些信息最好写成一段稳定的“角色卡”,每次生成都重复出现,不要今天写“短发男生”,明天写“帅气少年”,后天又写“17 岁少年”。AI 对抽象词的理解很散,容易把人脸往“通用帅哥”方向带,最后连主角辨识度都没了。
更稳的做法是,把角色卡写成几条短句,像给漫画助手下达固定档案:黑色微卷短发,左侧刘海略长,单眼皮,鼻梁较直,右眼下有一颗小痣,身形偏瘦,常穿蓝白校服外套和白色运动鞋。这类描述比“清爽少年感”有效得多。
一张参考图不够,最好是“角色档案组”
连续漫画最容易翻车的地方,是你只给 AI 一张正脸照,然后让它完成整篇连载。正脸图只能告诉模型“这人长这样”,却不能稳定告诉它侧脸、半身、奔跑、低头、回头、夸张表情时应该怎么保持同一个人。
更实用的方式,是准备一组角色档案图,而不是单图:
- 正脸标准照:用于锁定五官和发型
- 侧脸或 3/4 角度:用于稳定轮廓和下颌线
- 全身站姿:用于控制身材比例和穿搭
- 表情图:用于强化情绪变化时的脸部不漂移
- 动作参考图:用于跑动、坐姿、挥手等动态镜头
如果你做的是连载分镜,最好把这组图当作“角色母版”。生成前先统一风格,再固定人物,再派生镜头。不要一边说“写实”,一边又把参考图换成手绘草图;也不要一会儿用真人照,一会儿用半身立绘。参考输入越混乱,输出越容易漂。
有些工具会支持上传多张参考图,这时不要把不同风格、不同年龄、不同服装的人混在一起。角色档案组里最好只有一个主角的不同角度,其余辅助图尽量同风格、同光线、同发型。这样模型更容易把“可变项”和“不可变项”分开。
提示词别写成作文,写成“角色锁定清单”
很多 AI 漫画提示词失败,不是词不够多,而是词太散。连续漫画需要的是可重复执行的描述逻辑,而不是一大段氛围感散文。你可以把提示词分成四层:角色、动作、场景、风格。前两层尽量固定,后两层按镜头变化。
一个比较稳的写法是:
角色锁定:17 岁男生,黑色微卷短发,左侧刘海略长,单眼皮,右眼下有一颗小痣,瘦高体型,蓝白校服外套,白色运动鞋。
动作镜头:冲进教室,身体前倾,手扶门框,表情惊讶。
场景:午后校园走廊,阳光从窗边斜照进来,背景简洁。
风格:日系漫画分镜,线条清晰,少量网点,黑白为主,画面干净,重点突出角色表情。
这类写法的好处是,AI 不会把重点全部压在“午后阳光”“热血氛围”上,而是知道谁是主角,谁必须稳定。做多格漫画时,角色锁定最好固定复用,只改动作和场景。不然每一格都重新定义角色,等于让模型每次都“重新认识主角”。
如果你想做更精细一点,可以加一个“禁止漂移”的描述,比如:不要改变发型长度,不要改变右眼下小痣位置,不要把瘦高体型画成肌肉型,不要更换校服款式。这种句子不一定百分之百生效,但能明显减少乱改。
三格漫画最好用,先把连贯感练出来
如果你还在试阶段,不要一上来就挑战 12 格长篇,先从三格漫画开始更稳。三格漫画的优势在于:角色出现次数有限,动作链短,AI 更容易保持同一个人,同时也方便你观察哪里最容易跑偏。
一个实用的三格结构是:
- 第一格:角色状态或问题出现
- 第二格:冲突升级或情绪变化
- 第三格:反转、结果或梗点落地
比如做校园题材,可以写成:第一格主角在走廊里发现迟到,第二格狂奔撞到同学,第三格头发乱掉、书包散开。每一格都保留同一个角色卡,只替换动作词和场景词。这样你不仅能检查角色一致性,也能顺便检查镜头衔接是否自然。
如果第一格是站姿,第二格是跑步,第三格是半跪捡东西,AI 很容易在不同姿势里把腿长、肩宽、脸型都改掉。解决方式不是放弃,而是先把动作难度降低:先做站、走、回头、坐下这类低难度镜头,再慢慢过渡到跑跳、打斗、夸张表情。
有时你会发现,不是角色没锁住,而是动作把角色“扯变形”了。这时候不要死磕一次出图,先在三格里筛掉最不稳定的动作组合,再去扩展成六格或九格。
脸能稳住,表情也要稳住
连续漫画里,角色一致性不只是“长得像”,还包括“情绪变化时仍像同一个人”。有些模型在笑、哭、怒、惊讶时,会把五官重组,变得像另一个角色。尤其是夸张表情,最容易把单眼皮画成双眼皮,把薄唇画成厚唇,把尖下巴画成圆脸。
稳定表情的一个办法,是先定基础表情,再做幅度变化。比如先生成三组:平静、轻微皱眉、微笑。确认这三组里角色没跑偏,再去尝试大笑、崩溃、愤怒。不要一开始就要求“夸张哭喊大表情”,那往往会把脸完全打散。
提示词里也可以加上表情强度控制,例如:克制的笑容,嘴角轻微上扬,眼神变化明显但五官不夸张。这类描述比“开心”“高兴”更可控。因为后者太宽泛,模型会自己脑补出夸张笑脸。
如果你在做连载角色的固定表情包,建议把常用情绪先整理成一套小样:正常、疑惑、惊讶、尴尬、愤怒、疲惫。之后漫画里需要情绪切换时,直接调用相近表情,不要每次重写。对 AI 来说,重复使用稳定样本,比临场发挥可靠得多。
分镜一变就跑偏,往往是镜头语言没锁住
同一个角色在远景、近景、俯视、仰视里看起来会不一样,这很正常。但如果你发现人物差异大到像两个设定,那通常是镜头语言没写清楚。AI 不是不懂分镜,而是你没告诉它“这个镜头该保留什么,允许变什么”。
做连续漫画时,镜头提示最好具体到画面功能,而不是只写“电影感”“动态感”。比如:
- 近景:突出眼神和表情,背景弱化
- 中景:展示上半身动作和对话关系
- 全景:交代空间位置和角色站位
- 俯视:强调压迫感,但保持头发和五官结构不变
- 仰视:强调角色存在感,但不要夸大下巴和鼻梁
如果你需要一组连续镜头,最好在每一格里重复类似的结构:主角位置、镜头距离、场景重心、动作变化。比如“中景,角色站在画面左侧,右手抬起,背景为教室窗边”,这样比“一个校园场景,氛围紧张”有效得多。
尤其在打斗或奔跑镜头里,AI 很容易把肢体写飞。可以先把人物固定在“头部清晰、身体中度动态”的范围内,别一上来就让四肢大幅度夸张甩动。连载漫画重的是可读性,不是每一格都做视觉奇观。
风格统一,不然角色稳定了也像穿越
有时角色其实没变,但每张图的画风差太大,读者仍然会觉得“不是一个系列”。所以连载分镜还要管住风格统一:线条粗细、阴影方式、背景复杂度、色彩饱和度、是否网点、是否赛璐璐上色,这些都要尽量固定。
如果你的目标是漫画连载草图,最稳的是先把风格设成可控的中性区间:日系漫画线稿、背景简化、黑白或低饱和配色、阴影层次清楚。风格越极端,角色越容易被吞掉。比如浓重油画感会吃掉脸部识别点,过强的涂鸦风会让五官结构松散。
很多人喜欢在每一话都试新风格,结果主角一会儿像校园番,一会儿像复古海报,一会儿又像写实插画。商业连载当然可以做风格变化,但前提是主角识别度已经稳住,且变化是有意为之。否则风格变动会放大角色漂移。
如果你打算把同一角色扩展到封面、海报、分镜、社媒九宫格,最好提前设定一个“主风格 + 允许变化范围”。比如主风格是黑白漫画线稿,允许在节日特辑里增加少量彩色装饰,但不改发型、不改脸型、不改服装标识。这样角色既能延展,又不会每次重建。
高频翻车点,基本都能提前躲开
连续漫画做久了,会发现翻车点其实很固定。提前知道它们,能少浪费很多时间。
第一类是身份词太泛。“少年”“少女”“白领”“学生”这些词太宽,AI 会自动补成模板脸。要写具体年龄、外形和穿着。
第二类是服装不固定。上一格穿校服,下一格变成连帽衫,读者会以为换人。主角服装最好设成固定制服或标志性搭配。
第三类是参考图不统一。不同风格的图混着喂,模型会把脸、发型、光线拼成新角色。
第四类是动作太难。翻滚、跳跃、扭身、遮挡脸部这些动作,最容易把五官比例打乱。
第五类是提示词太情绪化。堆“震撼、史诗、炸裂、极致美感”并不会帮你锁角色,反而容易让模型优先追求画面效果。
处理这些问题时,思路要反过来:先保证“像同一个人”,再追求“好看”。很多人一开始就把画面质感拉满,最后角色却没了;其实漫画连载更需要稳定而不是华丽。
把一话做顺,最实用的是“先主后次”
做连载分镜时,最有效的流程不是一次性生成整页,而是分层控制。你可以先让 AI 出主角单人图,确认角色没问题,再出双人互动,再出完整分镜。也就是先锁主角,再补配角,再加场景。
这套方式特别适合用在故事型内容:比如校园日常、悬疑短篇、品牌漫画、角色设定连载。先把主角的标准形象做稳定,再把不同情境里的动作库补齐,之后出每一话时就不是“重新画”,而是“从已有设定里调度”。
如果你习惯用工具辅助,像 机灵助手 这类平台就适合先用模板快速起稿,再人工修正角色卡和关键镜头。模板能帮你减少空写提示词的时间,但它不能替你决定“这是不是同一个角色”。这一步还是要靠你自己把控。
一个比较顺手的办法,是给角色建立一个小型档案页,包含:
- 正面参考图
- 侧面参考图
- 全身参考图
- 标准服装说明
- 常用表情说明
- 禁止修改项
每次出图都拿这份档案对照。看起来麻烦,实际上比反复返工更省时间。连载越长,这份档案越值钱,因为它会慢慢变成你的“角色标准答案”。
让 AI 持续认人,关键是把“变量”和“常量”分开
连续漫画不是不能变,而是要知道哪些能变、哪些不能变。常量是角色脸、发型、核心服装和气质;变量是姿势、表情、天气、背景、道具、镜头距离。只要你把两者分开管理,AI 的输出就会稳定很多。
实际操作时可以这么做:同一角色的连载里,固定一段角色描述,固定一套风格关键词,固定一组参考图;每一格只换动作和场景。这样你会发现,角色不一定每次都百分百一样,但会稳定在“同一个人”的可读范围内,这对漫画已经够用了。
如果作品需要更高的一致性,比如要做品牌 IP、长篇连载、社媒角色系列,最好再建立版本管理。简单说就是:A 版角色卡、B 版服装卡、C 版表情卡分开存,不要全塞进一段长提示词里。长提示词不是越长越好,容易互相打架。
做 AI 连续漫画,最终拼的不是一次出神图,而是你能不能把角色设定做成系统。角色一旦系统化,后面每次出新分镜、做封面、做宣传图,都会顺很多。对创作者来说,这比单张图惊艳更重要,因为漫画要的是“连续被认出来”。



