一张AI人像,放大看——冷白皮在漫射光下的反光、深棕色发丝的自然走向、鸭舌帽帽檐的弧度、远处涂鸦墙的色彩过渡、路边车流虚化的光斑。没有人能第一眼认出这是AI画的。
但整条Prompt里,一个「美」字都没写。
不是「一个漂亮的女孩走在街上」。这种Prompt AI画一千遍也画不出这种日常感。真正能出这张图的Prompt是这样的:
冷白皮,皮肤白净光滑,脸型精致鼻梁高挺,深棕色极长发,高颅顶,头包脸,戴黑色鸭舌帽,黑露肩拼接上衣+浅蓝宽松牛仔裤,挎棕色大包,休闲松弛穿搭;前景城市斜坡草坪公路,背景网红文创商业街区,多层彩色涂鸦复古小楼、室外楼梯,远处高层城市居民楼。
没一个形容词是虚的。每一个词都在锚定画面里的一个像素群。
皮肤不是「白」,是「冷白皮,白净光滑」——色温+质感双锁定。头发不是「长发」,是「深棕色极长发,高颅顶,头包脸,显得松弛」——发色+长度+颅型+体积+状态,五个参数压进一句话。背景不是「好看的街景」,是「斜坡草坪→涂鸦小楼→高层住宅」——三层纵深,每层有独立内容。
整条Prompt约260字,塞进去50多个具体锚点。平均每5个字就是一个像素级指令。
更反直觉的在后面——这条Prompt的末尾写的是「低饱和度,些微过曝,超低分辨率」。别人求8K,它主动降画质。
这篇文章拆的,就是这套「反直觉」Prompt逻辑:为什么把参数写死、把画质写烂,反而出图最像真人按的快门。
锚定一:你的脸不是「好看」,是一组头骨参数
Prompt写脸的方式,跟整容医生填病历差不多。
「冷白皮」——不是「白皮肤」。白皮分冷白和暖白,冷白带粉调、暖白带黄调。写「白皮肤」→AI随机选色温,冷调暖调各一半概率。写「冷白皮」→AI直接锁定冷色通道,出图肤色自带粉调基底。
「皮肤白净光滑」——「白净」管底色均匀度,「光滑」管表面粗糙度。两个词在AI渲染管线里激活的是不同的Shader参数。「白净」→均匀铺底色,不产生色斑和色块。「光滑」→低粗糙度漫反射,高光点小而集中。放在一起出图的皮肤:底色干净、表面反光均匀。
「脸型精致鼻梁高挺」——这是骨骼结构参数,不是颜值标签。「脸型精致」约束下颌线锐度和颧骨比例,「鼻梁高挺」约束鼻部投影长度和侧面轮廓。AI读到这两个词,激活面部几何约束系统——不是在「画美女」,是在「生成满足特定骨相参数的面部结构」。
「深棕色极长发,高颅顶,头包脸,头发显得松弛」——密度极高的一句头发Prompt。发色(深棕)+长度(极长)+颅型(高颅顶)+包裹关系(头包脸)+质感状态(松弛)。五层参数叠在一句话里。单独写「长发」→AI随机给长度,可能到肩、可能到腰。加上「极长」→长度锁定。加上「高颅顶」→头顶蓬松度锁定,不会贴头皮。加上「头包脸」→头发包裹脸型的空间关系明确——不是「头发披在脸旁边」,是「头发形成一个包裹脸的体量」。加上「松弛」→不是发胶定型、不是湿发贴面,是自然垂坠的松散感。
到这,AI拿到的不是「画一个美女」的模糊指令,是一份面部几何说明书。冷白底色→均匀铺→低粗糙度→高颅顶包裹→深棕极长垂坠。每条指令都可以独立渲染出对应的像素行为。
锚定二:穿什么不是「漂亮衣服」,是款式+颜色+版型三重参数
Prompt对穿搭的处理,像个时尚编辑在写搭配笔记——每件单品品类、颜色、版型、穿着方式全部写死。
「黑露肩拼接上衣」——颜色(黑)+款式(露肩)+结构特征(拼接),三个维度压缩在一个短语里。写「黑色上衣」→AI可能在圆领T恤、V领针织、连帽卫衣之间随机跳。加上「露肩拼接」→暴露的肩部结构+面料拼接缝线→视觉特征全部锁定。
「浅蓝宽松牛仔裤」——颜色(浅蓝)+单品类型(牛仔裤)+版型(宽松)。三重锚定。「浅蓝」锁死水洗程度——不是原色、不是深蓝、不是黑色,是浅色水洗。「宽松」锁死裤管体积——不是紧身勾勒腿型、不是直筒、不是阔腿,是适度宽松的休闲版型。和上半身露肩拼接的「收紧」形成松紧对比——上半身贴合、下半身宽松。
「挎棕色大包」——颜色(棕)+尺寸(大)+动作(挎)。「挎」这个词的力量被严重低估了——它不是「背着」「拎着」「拿着」,是手臂弯曲穿过包带、包身靠在髋部。一个动词锁定了手臂角度和身体重心。
「戴黑色鸭舌帽」——帽型(鸭舌)+颜色(黑)+动作(戴)。鸭舌帽的帽檐弧度、帽顶弧度、帽舌长度——都是确定的视觉特征。换成「渔夫帽」→帽檐一圈、帽顶圆钝。换成「贝雷帽」→无帽檐、斜戴。一个品类词锁定了整个头部区域的轮廓线。
这组穿搭指令的逻辑:不给AI任何「这部分看着办」的空间。AI不需要知道什么叫「穿得好看」——它只需要渲染你指定的露肩上衣+浅蓝牛仔裤+棕色大包+黑色鸭舌帽。每件单品都已经精确到「拍照能搜同款」的颗粒度。

锚定三:背景不是「城市街景」,是三层纵深坐标系
这段环境Prompt,像电影分镜表上的场景标注——近景、中景、远景,每层有独立的视觉内容。
「前景城市斜坡草坪公路」——位置(近景)+环境类型(城市)+地形(斜坡)+地表材质(草坪)+基础设施(公路)。六个维度一层包圆。「斜坡」这个词是隐藏王牌——它不是平地,是一个有坡度的城市路面。加了这个词,画面的地势有了起伏——不是平面布景,是有地形变化的真实室外空间。
「背景网红文创商业街区,多层彩色涂鸦复古小楼、室外楼梯」——位置(中景)+街区类型(文创商业)+建筑特征(多层、复古小楼)+外观(彩色涂鸦)+结构亮点(室外楼梯)。「室外楼梯」是点睛之笔——它是一条斜线,打破了建筑立面的竖向矩形阵列。画面上多了一条斜线,构图立刻从「整齐但无聊」变成「有张力」。
「楼下热闹街道车流人群」——位置(楼下)+状态(热闹)+内容(车流+人群)。三个词让中景活了——不是空荡荡的商业街,是有车有人、有生活气息的真实街区。车流提供动态模糊的运动元素,人群提供随机分布的人类尺度参照物(让建筑的体量感成立)。
「远处高层城市居民楼」——位置(远景)+类型(居民楼)+特征(高层、城市)。远景锚定——画面的空间深度锁死三层:斜坡草地→彩色涂鸦小楼→高层住宅。AI渲染时按纵深次序叠加:先铺近景地表,再立中景建筑,最后填充远景天际线。三层空间递进,画面纵深自然成立。
到这里,AI拿到的不再是「城市背景」的模糊概念。是一个精确的三层空间布局图。一层一层往上摞。

锚定四:「摆烂参数」——故意写低分辨率、过曝、松弛,反而更像真的
这是全篇最反直觉的部分。
绝大多数AI绘画用户的Prompt收尾是这样的:「8K分辨率,超高清,极致细节,HDR,完美光影,电影级画质。」追求的是比现实更清晰、更鲜艳、更完美。
这条Prompt收尾:「低饱和度,些微过曝,超低分辨率。」
三个参数,每一个都在和AI的「完美主义本能」对着干。
「超低分辨率」——等于告诉AI:别跑全精度渲染,降低像素密度,允许细节丢失。AI执行的结果不是画面变模糊——是画面丢掉了「超高清」那种锐利到不真实的边缘增强。这个丢失恰好模拟了手机摄像头在普通光线下的成像特征:不是每一根发丝都纤毫毕现,而是有一定程度的柔和过渡。锐利到每一根睫毛→是CG渲染。边缘有自然柔化→是手机拍的。
「些微过曝」——等于告诉AI:高光区域允许溢出,天空可以发白,亮面可以没细节。手机拍照最常见的「缺陷」就是过曝——天空一片白、人脸高光区没层次。写出这个参数,等于主动制造手机拍照的「缺陷特征」。完美曝光→影棚布光。轻微过曝→户外自然光随手拍。
「低饱和度」——等于告诉AI:颜色往灰里收,别鲜艳。手机原片的饱和度天然偏低,尤其是阴天和多云天气。鲜艳的颜色是后期拉过饱和度的,低饱和的颜色是直出的。加上这条Prompt本身就有「柔和自然光,漫射明亮光线」——漫射光天然就是低饱和的。没有强烈的直射光→没有高饱和的色彩反差。
「松弛感」——这个词在Prompt里多次出现(「头发显得松弛」「休闲松弛穿搭」「眼神慵懒且松弛」「姿势率性随意」)。它约束的不是某一个视觉元素,而是整个画面的姿态——不要紧绷的摆拍感,要有「正好经过、随手抓拍」的自然度。「得意」的表情配上「松弛」的姿态——自信但不刻意,看镜头但不摆拍,像一个在街头被喊了一声、回头笑的人。
这组「摆烂参数」的底层逻辑:AI的默认渲染倾向是「越清晰越好」「越鲜艳越好」「越完美越好」——因为训练数据里的人类审美反馈就是这样的。你写「8K超高清」,AI在走它最熟悉的高速公路。你写「超低分辨率」「些微过曝」,等于给AI指了一条它不常走但更接近「真实快照」的小路。
从四层锚定到一套Prompt方法
回头把这四个锚定区——主体参数、穿搭参数、环境分层、摆烂参数——放在一起看,它们共享同一个底层逻辑:
不依赖AI的「理解力」去脑补任何东西。所有像素对应的现实参照物都写死。
这个逻辑和传统Prompt写作是两条路——比材质级Prompt写作更进一步:不光把材质写成光学参数,而是把画面里的每一个元素都写成摄影参数。
传统写法:「画一个好看的韩国街头女孩」——给AI一个模糊目标,让它自己脑补。脑补出来的东西质量随机——皮肤可能冷白也可能暖黄,衣服可能是任何款式,背景可能是一堵白墙也可能是一座城市。
全要素锚定写法:「冷白皮+高颅顶+鸭舌帽+露肩拼接上衣+浅蓝宽松牛仔裤+棕色大包+斜坡草坪+彩色涂鸦小楼+室外楼梯+高层住宅+些微过曝+超低分辨率」——AI没有任何脑补空间。所有变量都已被显式赋值。
这个方法可迁移到任何写实类Prompt,三个核心原则:
1. 锚定的颗粒度决定出图的可控性。 写得越「碎」,AI的发挥空间越小,出图越接近你的预期。颜色、款式、姿态、空间位置——每一个维度都有对应的参数词汇。能写死的,坚决不给AI发挥空间。
2. 「缺陷参数」比「完美参数」更像真的。 过曝、低分辨率、低饱和度、轻微模糊——这些「技术缺陷」恰恰是真实摄影的视觉签名。AI擅长完美,你要让它「不完美」,就得在Prompt里明确写出不完美的参数。
3. 空间分层写清楚近、中、远景。 不是「城市背景」→是「斜坡草坪(近)+涂鸦小楼(中)+高层住宅(远)」。三层空间按纵深次序写,AI自然会生成有景深的画面。
下次写写实人像Prompt,先别想「画面要好看」。先想「画面里每个元素,能不能用一句话写死」。写得越死,出图越活。
技术参数
| 项目 | 内容 |
| 模型 | doubao-seedream-5-0-260128 |
| 画质 | 2K |
| Prompt 类型 | 日常快照 / 网红人像 / 写实摄影 |
| 风格标签 | 韩系少女 / 松弛街拍 / 低饱和过曝 |
| 主体锚定 | 冷白皮、高颅顶、深棕极长发、狭长眼 |
| 穿搭锚定 | 鸭舌帽 / 露肩拼接上衣 / 宽松牛仔裤 / 棕色大包 |
| 环境锚定 | 斜坡草坪(近)→涂鸦小楼(中)→高层住宅(远) |
| 关键参数 | 低饱和度、些微过曝、超低分辨率、松弛感 |
Prompt 附录
中文原版(可直接复制使用):
日常快照高质量网红人像,半身照,冷白皮,皮肤白净光滑,脸型精致鼻梁高挺,发丝清晰可见,浓颜系美女,轻甜御姐,深色瞳孔,表情灵动,得意,看着镜头,idol感,韩系风格少女,高颜值少女,深棕色极长发,高颅顶,头包脸,头发显得松弛,戴黑色鸭舌帽,黑露肩拼接上衣+浅蓝宽松牛仔裤,挎棕色大包,休闲松弛穿搭;前景城市斜坡草坪公路,背景网红文创商业街区,多层彩色涂鸦复古小楼、室外楼梯、楼下热闹街道车流人群,远处高层城市居民楼,柔和自然光,漫射明亮光线,绝美双眼,眼神慵懒且松弛却不失妩媚感,有着清晰下颌线,狭长眼,清新脱俗,极具女性魅力,低饱和度,些微过曝,超低分辨率,网红构图且姿势率性随意。独树一帜的绝美外貌。构图有张力。感性夸张大胆的妩媚动作,眼睛绝美,淡妆,真人感,真实摄影,真人写实风格,真人感,细节丰富,超高清,超细节,高质量。
FAQ
Q:为什么写「超低分辨率」反而更像真人拍的?
AI默认追求高精度渲染——边缘锐利、细节满格。但手机在普通光线下天然有柔和过渡和细节丢失。写「超低分辨率」等于关掉AI的「完美模式」,让画面带上手机直出的质感。不是真的模糊——是没有那种「修过的图」的锐化感。
Q:Prompt里有不少重复词(「真人感」两次,「眼睛绝美」两次),要不要删?
不用。在AI的语义权重系统里,重复关键词等于在那个渲染通道上加权重——「真人感」写两次,AI在写实通道上比写一次更偏向真实风格。但Seedream对语义理解强,重复的边际增益比Stable Diffusion小——写两次够了,不用写三次。
Q:全要素锚定这套方法,哪些场景不适用?
抽象风格、概念插画、极简构图——这三类不需要密集锚定。写太多具体参数反而框死AI的创作空间。

评论0