上周有个做独立游戏的朋友甩给我一张图,问:”这种角色设定稿,AI 能出吗?”
我一看——正面、侧面、背面三个视角,配色板、面部特写、服饰细节标注,右侧还带着身高比例尺。标准的角色三视图,CG 美术外包市场里一张至少四位数。
我说:”一条 Prompt 的事。”
他不信。我把下面这条 Prompt 扔进豆包 Seedream 5.0,不到 30 秒,一张带分区标注的角色设定稿就出来了。
效果预览


拆解:这条 Prompt 为什么能「一次出片」?
角色三视图是 AI 画图里最容易翻车的场景之一。因为通常的做法是”把三视图当一张图来写”——只描述”一个人、三个角度”,模型不知道哪些元素应该放在哪个区域、每个区域应该承载什么信息。
这条 Prompt 用了分区控制法,我把它提炼为 「五区结构法」——把一张三视图切成五个功能区,每个区给独立的语义指令,模型就不会把”面部特写”画成”背景装饰”。
区一:主视觉区——三视角骨架
主视觉区(上方)以”正面+侧面+背面”三个核心视角为主体,直观呈现角色的整体身形、服饰搭配和标志性特征。
为什么这样写有效?
模型读到这里获得了两个关键信号:
① 空间锚定:”上方”。Seedream 对空间位置词(上方/左侧/底部)的响应灵敏度很高,这里明确告诉模型「主视觉区」的物理位置,它会自动将三个视角的人物图排布在画面中上部,不会跑到边缘。
② 数量约束:”正面+侧面+背面”三个。不加数量词,模型可能生成 2 个或 4 个视角——它不是「数数」,而是根据 training data 里最常见的三视图排版习惯来猜测。明确写”三个”能降低随机性。
区二:补充信息区——填主视觉的坑
补充信息区(左侧)拆分出”面部特写”和”配色板”(明确毛发、服饰的色值),补充主视角没覆盖的细节与色彩标准。
为什么这样写有效?
三视图最大的坑:全景视角丢失细节。正面全身像里,脸只有画面的 1/20,模型很难在被压缩的信息里把”眼神””发丝走向””唇色”画准。
“面部特写”四个字给了模型一个二次聚焦通道——在左侧区域重新以更大比例渲染面部,细节密度翻倍。这是利用 Seedream 的 multi-region rendering 特性:不同区域可以有不同的细节密度,只要语义上不冲突。
“配色板”则是色彩一致性约束。如果没有这条,左侧的面部特写可能和正面图里的肤色不一样(模型每次渲染都会重新采样色彩分布)。加了”配色板”语义后,模型会倾向于把所有区域的色彩锁定在一个调色盘内。
区三:局部细节区——把模糊变精准
局部细节区(底部)用小模块单独展示关键部件的设计(配饰、点缀、关键身份识别元素),把主视角里的”模糊细节”拆分为精准的制作参考。
为什么这样写有效?
这是”从模糊到精准”的关键一跳。主视觉区里「高奢西服,丰富的花纹,金丝描边」只是文字级描述,模型画出来大概就是个”有金色线条的西装”。放到 10% 放大比例看,那些金丝到底是什么图案?龙纹?云纹?几何线条?
局部细节区的作用就是把这种模糊承诺变成精确交付。模型在这一区域获得了「这个部件需要单独渲染、放大展示」的指令,会分配更多 token 级注意力去刻画花纹形态。
实践经验:如果 Prompt 里有”丰富花纹””复杂刺绣”这类词,一定要配一个局部细节区,否则模型会把它们简化成万能的”金色线条”。
区四:比例参考区——可用性的最后防线
全身照比例照(右侧)使用黄金比例参考物和人物身高形成对比。
为什么这样写有效?
这是从”好看”到”能用”的桥。没有比例参考的三视图,美术拿到手只能临摹风格,没法直接开始建模。
“黄金比例参考物+身高对比”这个描述触发了模型对”技术图纸”语义的理解——它会生成近似标尺或比例参照物,而不是随便放个苹果香蕉在旁边。
但也要诚实地说:Seedream 画不出精确的比例尺刻度线。这里的”比例参考”更多是视觉示意级的——给制作人员一个直观的身高比例感,不是用来直接测量的工程图。
区五:风格控制区——定性所有视觉参数
背景为白色 + 真人写实、超写实国风、现代风格、质感光照、8K高清纹理、布料褶皱自然。
为什么这样写有效?
这里面有三层控制:
- 基础约束:白色背景。三视图铁律——任何非白色背景都会干扰角色视觉,降低可用性
- 风格锚定:”超写实国风+现代风格”。两个看似矛盾的词叠在一起,告诉模型「传统国风的神韵 + 现代写实的精度」,避免滑向两种极端——不是古风概念图的飘逸感,也不是 3D 渲染的塑料感
- 材质信任锚点:”布料褶皱自然””质感光泽”。没有自然褶皱的衣服、没有光影过渡的面部,一眼 AI。加了这些词后,材质的微观不规则性会显著提升
技术参数
| 项目 | 参数 |
|---|---|
| 模型 | 豆包 Seedream 5.0 (doubao-seedream-5-0-260128) |
| 生成分辨率 | 2048×3648 (9:16) |
| 生成耗时 | ~25 秒/张 |
| 后处理 | 无 |
| 风格参考 | 超写实国风、现代写实、质感光照 |
五区结构法速查
方法论总结,可直接当 Prompt 模板框架。
| 区域 | 定位 | 核心指令词 | 作用 |
|---|---|---|---|
| 主视觉区 | 中上部 | 正面+侧面+背面 | 空间锚定+数量约束 |
| 补充信息区 | 左侧 | 面部特写+配色板 | 细节密度翻倍+色彩一致 |
| 局部细节区 | 底部 | 关键部件单独展示 | 模糊→精准 |
| 比例参考区 | 右侧 | 黄金比例+身高对比 | 视觉示意级可用性 |
| 风格控制区 | 全局 | 白色背景+超写实+材质 | 铁律约束+风格锚定+信任锚点 |
FAQ
Q: 能不能只生成正面+侧面,去掉背面和细节区?
可以,但需同步精简 Prompt。去掉背面后,不要只删”背面”两个字——把”区一”的空间词从”三个”改成”两个”,同时删掉”区三”和”区四”的全部内容,只保留正面+侧面+面部特写+风格控制。否则模型会试图在少了元素的情况下”脑补”缺失区域,结果不可控。
Q: 这个 Prompt 能换别的模型跑吗?Midjourney / SD 呢?
分区指令是 Seedream 系模型长板——它对”上方/左侧/底部”空间词响应好。换到 Midjourney,建议把分区语改成 --sref 风格参考图 + 每张图单独生成后拼接;换成 SD,推荐 ControlNet Canny+OpenPose 双控 + Regional Prompter 插件实现分区。底层逻辑都一样——不让模型在同一张画布上”自由发挥”布局,只是实现路径不同。
Q: 人物换女角色需要改哪些地方?
核心改动三处:① 人称词(帅哥→美女)② 服饰词(西服→对应女装)③ 妆容词(把”疯批感/阴郁”改成目标气质如”清冷/飒爽”)。人物外观设定所有描述词要整体平移,不能只改性别不改气质——否则会出现”男相女身”的违和感。
结尾
写 Prompt 到一定阶段会有一个发现:好 Prompt 不是”写得多”,而是”给模型画好了不能越界的格子”。
五区结构法的本质就是这样——不是用更多词去堆画面质量,而是用空间分区去消除模型做选择题的机会。模型猜”面部特写放哪”可能猜错,但你告诉它”放左侧”,它就一定会放左侧。
下次写复杂场景的 Prompt 时,试着先用 30 秒画一张区域草图:需要哪几个功能区域?每个区承载什么信息?区与区之间有没有色彩冲突?
想清楚这些,写出来的 Prompt 自然就是一条能直接交付的角色设定稿。
Prompt 附录(完整原文)
人物形象提示词:(三视图)
1.主视觉区 (上方) 以 "正面 + 侧面 + 背面" 三个核心视角为主体,直观呈现角色的整体身形、服饰搭配和标志性特征,是制作人员对人物 "整体造型" 的参考基础。
2.补充信息区 (左侧) 拆分出 "面部特写" 和 "配色板"(明确毛发、服饰的色值),补充主视角没覆盖的细节与色彩标准。
3.局部细节区 (底部) 用小模块单独展示关键部件的设计 (配饰、点缀、关键身份识别元素),把主视角里的 "模糊细节" 拆分为精准的制作参考,方便导演确认。
4.全身照比例照 (右侧) 使用黄金比例参考物和人物身高形成对比。
5.背景为白色,最高品质细节丰富。
6【真人写实】超写实国风,现代风格,写实风格,质感光照,自然光线,质感十足,8K高清纹理,布料褶皱自然,艺术写实风格,营造出震撼的视觉效果。
人物外观设定:现代风帅哥,发丝细腻柔顺,狭长双眼,眼尾细长,高奢西服,丰富的花纹,金丝描边,极致妖孽的容貌,饱和度较高,高级构图,细节丰富,清晰精致,精致细腻,高清画质,利落的短发,凌乱发丝拂面,面部聚焦,面部阴影,绝美眼睛,线条清晰,高级感、朦胧感、面部清晰,正面,清透瓷白的肌肤,明暗对比,超高清、最高画质、高质量,丰富细节、细腻肌理,疯批感,有柔和感情的眼神,阴郁感,超细节,超丰富,写实逼真,潇洒

评论0