角色设定表提示词(character sheet prompt)是一类结构化指令,它要求 AI 在一张图或一组图里,把同一个角色的多个角度、多种表情系统性地画出来,并且让脸、发型、服装、身材比例和配色在所有画面里保持不变。
它的目标不是生成一张好看的角色插画,而是生成一份参考文档——一份你可以交给插画师、3D 建模师、动画师,或者交给接下来二十次生成去反复引用的视觉基准,让角色不再"漂移"。
别只看价格——花 0 元先试一张
新账号送 3 积分,够生成一张文生图。3 分钟上手,不绑卡。
先做个区分。 如果你找的是小说人物设定表(姓名、背景故事、人物动机)或者跑团角色卡(属性值、可打印 PDF),这篇不是。本文讲的是 AI 图像生成的提示词——三视图、表情表和角色一致性。
一张角色设定表包含什么
这个格式比 AI 早了几十年——动画行业叫 model sheet,游戏行业叫 character reference sheet,其中的多角度部分叫 turnaround(三视图 / 转面图)。一张完整的设定表通常包含:
- 全身正面:看清身材比例、服装正面、鞋子与饰品。
- 四分之三视角:最能体现脸部结构、发型层次和立体感的角度。
- 左 / 右侧面:明确鼻梁、发型轮廓、服装侧面剪裁。
- 背面:锁定背部服装、发型后侧、背包、披风等细节。
- 表情九宫格:中性、开心、愤怒、惊讶、悲伤、困惑等。
- 局部特写:眼睛、耳饰、武器、徽章、鞋子、材质纹理。
- 颜色规范:主色、辅助色、皮肤 / 头发 / 服装配色,必要时给出 HEX 色值。
- 尺度与备注:角色身高、比例线、材质和设计说明。
一张图里很少需要全部内容。单张输出里最稳的组合是四列——正面 / 侧面 / 背面 / 四分之三——每列下面配一张对应角度的头部特写。
为什么 AI 生成比传统绘画更需要它
传统插画师把角色记在脑子里,AI 模型不会——它每一次都要从你给的输入重新推导这个角色。经典症状:
- 换个角度脸就变了。 你要的是同一个人的侧面,拿到的是另一个人。
- 一次出不了干净的正 / 侧 / 背三视图。 模型给你三个长得有点像的角色并排站着。
- 表情表会漂。 十种情绪,九张脸。
这就是角色漂移,也是 AI 图像难以用于任何连续性内容的最大障碍——漫画分镜、故事板、游戏 NPC、品牌吉祥物、AI 社媒账号形象、教程插图,全都卡在这里。
先说清楚:症状 1 和 2 在当前模型上已经比一年前那批教程假设的好得多。我们实测了,结果在下面——而且和本文原本要讲的结论相反。没有消失的是更难的那一半:让同一个角色在多次彼此独立的生成之间(隔几天也算)保持稳定。角色设定表真正要解决的是这个。
角色设定表提示词是从根上解决它:把角色先定义清楚,清楚到足以成为一个可反复引用的视觉基准。收益是复利的:
- 提高后续一致性:之后的生成引用这份设定表,而不是重新发明角色。
- 让设计可生产化:单张美图只适合展示;设定表是设计师、建模师能直接开工的资产。
- 减少提示词反复试错:五官、服装、配色、材质一旦锁定,后面只需要改场景、动作、镜头和情绪。
- 适合做可复用 IP:对独立开发者来说,这是让一个吉祥物或故事角色活过第一条内容的方式。
实操上的铁律:具体程度胜过形容词。只说"一个科幻少女",等于把体型、服装材质、颜色和渲染媒介全交给模型去发挥——而它每次发挥得都不一样。任何你没写死的属性,都是将来会漂移的属性。
提示词的六个模块
一条高质量的角色设定表提示词有六个模块,不管作者有没有给它们起名字。
| 模块 | 要写什么 | 示例 |
|---|---|---|
| 角色身份 | 角色是谁、世界观、气质 | 独立太空快递员,乐观、机敏、实用主义 |
| 外观特征 | 年龄感、体型、肤色、五官、发型 | 25 岁左右,瘦高,雀斑,深棕卷发,琥珀色眼睛 |
| 固定服装 | 颜色、款式、材料、配件 | 深蓝短夹克、橙色反光条、灰色工装裤、磨损运动靴 |
| 风格媒介 | 二次元、3D、写实、像素等 | clean stylized 3D game character design |
| 页面布局 | 需要哪些视图、几格、怎么排 | 正面 / 四分之三 / 侧面 / 背面一排,下方表情条,底部色板 |
| 约束条件 | 什么不能出现 | 纯色背景、统一比例、无文字、无多余人物 |
最容易被跳过的是约束条件,而它恰恰干活最多——不过按下面的实测,它干的不是大多数人以为的那件活。它不负责把角色捏在一起,它负责把版面捏在一起:不写约束,模型会拿道具填满空白、自己加一条标签栏,或者把角色复制一份。
可直接复制的提示词
1. 短指令 —— 文字直接出设定表
生成全身三视图以及一张面部特写。
布局:最左边占满 1/3 的位置是超大的面部特写,右边 2/3 放正视图、侧视图、后视图。
二八身材比例,纯色背景,各视图比例统一,无文字。这条适合角色还没定型的阶段。多跑几次,挑一张脸满意的,然后带着那张图去用第 2 条。
2. 长指令 —— 图生设定表,锁死身份
以上传的照片作为唯一外观参考,生成四格角色设定表:
FRONT —— 全身,正对镜头
SIDE —— 真正的 90° 侧面,全身
BACK —— 真正的背面,全身
PORTRAIT —— 头肩部特写
四格必须是同一个人、同一套衣服、同一个发型。五官、身材比例、服装颜色、
头发长度在四格之间完全一致。灰色影棚背景,柔光箱均匀打光,分栏干净。
禁止美化、禁止换脸、禁止换装、禁止添加参考图中没有的配饰。
无文字,无多余人物,无重复肢体。当角色需要活过单张图时用这条。参考图锁的是你拿到的是哪个人,约束块锁的是这个人周围的版面长什么样。
3. 下游用法 —— 在 AI 视频里引用设定表
以提供的三视图作为唯一角色外观参考。参考图只用于统一正 / 侧 / 背造型,
不要把三视图的排版画进视频画面里。镜头之间保持体型、眼睛颜色和标志性
配饰完全一致。角色在镜头之间漂移,是大多数 AI 视频一做长就没法看的原因。把三视图作为外观锚点喂进去——并且明确指示不要把设定表本身画出来——是目前最好的解法。
4. 全套版 —— AI 视频制作用的八模块设定表
Create a professional AI Video Production — Character Reference Sheet for the provided character image. Create a polished 4:5 portrait continuity sheet focused exclusively on the character:
1. CHARACTER PROFILE — name, role, approximate age, height, body type, personality, distinctive traits, and signature colors.
2. FULL-BODY TURNAROUND — front, 3/4, side, and back views of the exact same character at matching scale, with identical facial features, hairstyle, body proportions, costume, colors, and accessories.
3. FACE AND IDENTITY DETAILS — front, profile, and 3/4 head-and-shoulder close-ups showing facial structure, eyes, eyebrows, nose, lips, hairstyle, skin tone, makeup, scars, tattoos, and other defining features.
4. EXPRESSION SHEET — neutral, happy, angry, sad, surprised, worried, confident, and determined expressions. Preserve the exact same facial structure and identity in every expression.
5. POSE AND BODY LANGUAGE — neutral standing, walking, sitting, relaxed, tense, and action-ready poses. Maintain consistent anatomy, proportions, posture, and silhouette.
6. COSTUME DETAILS — close-ups of clothing layers, fabrics, seams, fasteners, footwear, jewelry, eyewear, markings, logos, and other character-defining wardrobe elements.
7. COLOR AND MATERIAL PALETTE — include 4–6 key colors with HEX codes, plus references for skin, hair, fabric, leather, metal, plastic, armor, or other visible materials.
8. DO NOT CHANGE — lock the character's face, identity, skin tone, age, hair, eye color, body shape, proportions, costume, accessories, markings, colors, and defining features. Do not redesign, beautify, age, stylize, simplify, or create alternate versions.
Use a clean dark gray studio background, soft controlled lighting, realistic materials, sharp details, subtle shadows, clean typography, thin dividers, balanced spacing, and a sophisticated editorial production-design grid.
Every panel must depict the exact same character with absolute visual consistency. Focus only on the character. Do not include props, additional characters, environments, unrelated objects, or alternate outfits.这条保留英文原文,因为出图模型对英文段落标题的排版最稳。它要的不是一张三视图,而是一整份视频制作交接文档:档案、转面、脸部特写、表情、姿态、服装细节、色板,一张 4:5 全装下。必须配参考图用。出图效果见下面的「全套案例」。
上面的档位,等你试过一张再选
用 3 个免费积分先出一张,看效果再决定订哪档。
真跑一遍会发生什么
上面第 1、2 条提示词,外加第 2 条的一个精简版,这三种写法我们都在 GPT Image 2 上真跑了,medium 质量,每条各跑 3 次,没有挑图。其中两条的结果和本文原本要告诉你的相反,所以下面写的是模型实际干了什么。
| 各跑 3 次 | 纯文字 | 参考图 + 长约束 | 参考图 + 两个词 |
|---|---|---|---|
| 布局按要求出 | 3/3 | 3/3 | 3/3 |
| 各视图之间是同一人 | 3/3 | 3/3 | 3/3 |
| 大特写与小图是同一人 | 0/3 | 3/3 | 3/3 |
| 特写按「头肩」构图 | — | 0/3 (写了要求) | 3/3 (没提要求) |
| 图上没有多余文字 | 3/3 | 3/3 (写了要求) | 0/3 (没提要求) |
| 重跑一次还是同一个角色 | 0/3 | 3/3 | 3/3 |
基准图

一次文生图,全身、中性站姿、纯色背景。它是下面两次图生图的外观参考。
提示词 1 —— 纯文字,无参考图

流传的说法——也包括本文的初稿——是纯文字做三视图会得到"四个兄弟姐妹"而不是同一个角色。实际不是这样。 布局完全按要求落地,正面、侧面、背面三个视图明显是同一个人、同一套衣服:夹克剪裁、橙色条、工装口袋、靴子全部对得上。
漂移确实存在,但位置不同:左边那张超大特写,和右边几个小全身图不完全是同一张脸。 特写显得更成熟、脸更长、颧骨更高;右边的小人脸更年轻圆润。
这个现象三次全都出现,而且上面这张已经是三次里最好的一次。另外两次连衣服都漂了——条纹颜色、条纹位置,还有一条斜挎带在一个尺度上有、另一个尺度上没有:

所以这条规律诚实的版本不是"不同视角会漂",而是不同尺度会漂——900px 渲染的一张脸和 90px 渲染的同一张脸,对模型是两个不同的生成问题,它是分开解的。几个小图彼此之间是一致的,跑偏的是那张大特写。
跑三次才看明白的另一件事:每一次都是一个不同的女人。 同一条提示词,三个角色。只要一张设定表当然无所谓;想明天再要「她」一次,就是致命的。
提示词 2 —— 参考图 + 完整约束块

干净的四格设定表,四格身份一致,全图无文字——no text 这条约束生效了,三次全都生效。
它办砸的一件事,同样是三次全砸:提示词明确要求 PORTRAIT —— 头肩部特写,三次回来的都是到腰部的半身。不是偶然,是稳定地做不到。
提示词 3 —— 同一张参考图,只留一句约束
这次全部的一致性指令就两个词:Consistent character.

就是这张推翻了本文。 三次身份全都稳住,和严格版一样好——而且特写那格三次都是真正的头肩构图,正是严格版写明了却一次也没拿到的东西。
精简版没能控住的是版面:三次都自己加了一条 FRONT VIEW / SIDE VIEW / BACK VIEW / PORTRAIT 标签栏,不请自来。严格版三次都没有标签,因为它写了 no text。
真正的分工是下面这样,而且不是本文一开始以为的那样:
- 身份一致性 —— GPT Image 2 从一张参考图出发,基本自己就能搞定,不需要长篇提示。
- 约束块 —— 它值钱在控版面:文字、背景、多余人物、格数。不在于把脸摁住。
关于这些数字的限定:三次足够把「稳定行为」和「偶然」区分开——上表每一栏都是齐整的 3/3 或 0/3,没有一栏是分裂的。但三次不足以当成功率去引用。把 3/3 理解成「它就是这么干的」,而不是「它永远都行」。
全套案例:一张图装下八个模块
上面第 4 条提示词 + 一张角色参考图,在 GPT Image 2.5 Sunburst 上图生图的效果:


提示词:
Create a professional AI Video Production — Character Reference Sheet for the provided character image. Create a polished 4:5 portrait continuity sheet focused exclusively on the character:
1. CHARACTER PROFILE — name, role, approximate age, height, body type, personality, distinctive traits, and signature colors.
2. FULL-BODY TURNAROUND — front, 3/4, side, and back views of the exact same character at matching scale, with identical facial features, hairstyle, body proportions, costume, colors, and accessories.
3. FACE AND IDENTITY DETAILS — front, profile, and 3/4 head-and-shoulder close-ups showing facial structure, eyes, eyebrows, nose, lips, hairstyle, skin tone, makeup, scars, tattoos, and other defining features.
4. EXPRESSION SHEET — neutral, happy, angry, sad, surprised, worried, confident, and determined expressions. Preserve the exact same facial structure and identity in every expression.
5. POSE AND BODY LANGUAGE — neutral standing, walking, sitting, relaxed, tense, and action-ready poses. Maintain consistent anatomy, proportions, posture, and silhouette.
6. COSTUME DETAILS — close-ups of clothing layers, fabrics, seams, fasteners, footwear, jewelry, eyewear, markings, logos, and other character-defining wardrobe elements.
7. COLOR AND MATERIAL PALETTE — include 4–6 key colors with HEX codes, plus references for skin, hair, fabric, leather, metal, plastic, armor, or other visible materials.
8. DO NOT CHANGE — lock the character's face, identity, skin tone, age, hair, eye color, body shape, proportions, costume, accessories, markings, colors, and defining features. Do not redesign, beautify, age, stylize, simplify, or create alternate versions.
Use a clean dark gray studio background, soft controlled lighting, realistic materials, sharp details, subtle shadows, clean typography, thin dividers, balanced spacing, and a sophisticated editorial production-design grid.
Every panel must depict the exact same character with absolute visual consistency. Focus only on the character. Do not include props, additional characters, environments, unrelated objects, or alternate outfits.什么真的会坏,什么其实不会
尺度变化会破坏身份,视角变化基本不会。 纯文字三次里,大特写与小图保持一致的是 0/3,而几个小图彼此保持一致的是 3/3。设定表里既有大特写又有小全身的话,把特写单独跑一次。
"consistent character" 并不比枚举版弱——至少在这里不弱。 各跑三次,两个词的版本在每一项身份指标上都追平了那一长段枚举。枚举版(same face, same hairstyle, same outfit, same proportions, same color palette)在难啃的案例上仍是合理的默认写法,但别以为救你的是它的长度:它一次都没赢过。
约束管的是版面,不是角色。 设定表上凡是不属于角色本身的东西——标签、背景、格数、别长出多余的手——都得写下来。精简版三次里三次加了不请自来的标签栏;写了 no text 的严格版三次里三次干干净净。约束块的价值就在这儿,和脸没关系。
约束写过头会赔上构图。 这是本轮最锐利的一条。严格版白纸黑字写了 PORTRAIT —— 头肩部特写,三次拿回来的都是半身;精简版压根没提构图,三次都给了头肩。词更多不是单调变好——一长串指令似乎会稀释其中任何一条。
一条提示词包办一切,不如拆成三条。 三视图、表情表、服装细节各自需要不同的构图和格数。分开生成再自己排版。上面的全套案例说明,一张图全装下现在已经做得到;代价是每一格都很小,所以它适合当总览,不适合当参考素材。
没写到的属性就是待漂移的属性。 袖长、鞋型、夹克拉没拉——凡是你没钉死的,模型每次都会重新决定一遍。
设定表上的小字:能画清楚,但内容别信。 上面的全套案例里,标签和色号都画得很清楚;但档案里的名字、年龄、身高是模型自己编的,色号也要拿取色器核一遍。需要当规格用的文字,还是在 Figma 或 Photoshop 里自己补一层标注。
两步工作流 —— 以及它为什么依然重要
既然上面纯文字那次就跑通了,你完全可以问:那还要参考图干什么?
答案不是单张设定表内部的一致性,而是你之后所有生成之间的一致性。
纯文字那张设定表里的角色,是模型当场发明的。明天用同一条提示词再跑一次,你会得到另一个人——描述一样,脸不一样。你没有任何东西可以指着说"就是她"。基准图给的就是这个锚点。
- 先锁基准图。 反复生成单张全身图,直到有一张是对的。从这一刻起,角色是这张图,不是那段文字。
- 从基准图展开。 以它为参考,依次生成三视图、表情表、局部特写——每一项单独一次生成。
- 排版与标注。 把输出排好版,标签、HEX 值和尺寸作为真正的文字在模型之外补上。
所以:只要一张好看的设定表,在 GPT Image 2 上纯文字确实够了;要让这个角色在一部漫画、一款游戏或二十条社媒里始终是同一个角色,先锁基准图。
常见问题
角色设定表提示词和三视图提示词是一回事吗? 三视图(turnaround)是其中的多角度部分——正面、侧面、背面、四分之三。角色设定表是更大的文档,通常包含三视图加上表情、局部特写和色板。在搜索里这两个词经常混着用。
一次该要多少个表情? 一次六到十个。再多,格子会变小,脸的一致性会下降。需要更多就跑第二轮,不要把一个九宫格越撑越宽。
可以用真人照片做吗? 可以,这正是上面第 2 条的用法,也是最稳的路径。请使用你拥有使用权的照片。
换画风之后设定表还管用吗? 部分管用。你可以在保持身份的前提下切换媒介(漫画 → 半写实 → 卡通),但风格跨度大时会有漂移。每次换风格都用参考图重新锚定一次。
该用多大分辨率生成? 你的套餐允许的最大分辨率。设定表是多格图,每一格只分到总像素的一小部分——所以它比单张人像需要更高的分辨率才能用。
开始做你的角色
现在试一张,钱以后再说
注册即送 3 积分,无水印先看效果,满意了再回来选套餐。
有角色怎么都稳不住的情况?发邮件到 [email protected],我们每封都看。
