• a***n 登录了本站
  • a***n 登录了本站
  • a***n 登录了本站
  • a***n 登录了本站
  • a***n 登录了本站
  • a***n 登录了本站
  • a***n 登录了本站
  • a***n 登录了本站
  • a***n 登录了本站
  • a***n 登录了本站
所有分类
  • 所有分类
  • AIGC文本写作
  • AIGC图像生成
  • AIGC视频创作
  • AIGC智慧办公
  • AIGC商业设计
  • AIGC语音创作
  • AIGC热点追踪

校服配小香风,怼脸拍出高级感——人像 Prompt 的分层摄影逻辑

穿校服的姑娘站在漫画展里,手上提着一个小香风包。莫兰迪冷色调的光从侧面打过来,皮肤透出一种陶瓷才有的细腻冷白。她对着镜头害羞地笑了一下——然后 Prompt 结束了。

回头看这条 Prompt,会发现一个反直觉的事实:它没有写”故事”,写的是一个六人摄制组的全部工作

摄影师、化妆师、造型师、动作指导、置景师——每个人要干什么,全写在一段 Prompt 里了。它不是在描述一个人,在还原一个完整的商业摄影流程。

原创框架:「分层摄影结构」

这条 Prompt 的结构像一份拍摄通告单。六个层,每个层对应摄影流程中的一个专业岗位:

摄影层 → 五官层 → 肤质层 → 造型层 → 姿态层 → 场景层

每一层都是独立的、可替换的。换掉摄影层,整张图的调性跟着变。换掉造型层,校服变礼服,故事全换了。六层解耦——这才是这条 Prompt 真正聪明的地方。

摄影层:相机参数就是模型的光学引擎

Prompt 第一句话:8K超高清,杰作级,大师级布光,侧光营造通透质感,景深效果,莫兰迪冷色调,INS网红风,画面干净明亮

这不是形容词堆砌。每一条都是一个光学决策。

“侧光”决定了光源位置——不是正面平光,是从侧面 45° 左右打过来。侧光会让颧骨产生一个自然的高光区,鼻梁的阴影恰到好处,下颌线被光勾勒出来。模型接到”侧光”这个词,整个光照引擎的入射角就锁定了。

“莫兰迪冷色调”做了两件事:把整体色温往 5500K 以上推——偏蓝偏紫——同时把饱和度压到 30%-40%。莫兰迪色盘是低饱和灰色系,映射到图像上就是:皮肤不是暖白是冷白、背景不是鲜亮是柔和的灰粉灰蓝、阴影不是纯黑是带紫调的深灰。一个词把整张图的色彩曲线扭了。

摄影层的逻辑是:在描述主体之前,先把”怎么看”锁死。镜头语言定了,后面六层都在这个光学框架里运行。

五官层:面部几何就是模型的构图锚点

瓜子脸,尖下巴,三庭五眼比例标准,柳叶细眉,桃花眼,眼尾狭长,高挺悬胆鼻,樱桃小嘴,大眼睛双眼皮,长睫毛,眼眸深邃温柔

13 个面部特征,每一个都是几何约束。不是”好看的脸”——”瓜子脸”规定了面部轮廓从颧骨往下收的速率,”三庭五眼”锁死了发际线到眉毛、眉毛到鼻底、鼻底到下巴的三等分比例,”桃花眼+眼尾狭长”指定了内外眼角的相对位置和弧度。

模型不需要”理解”什么叫桃花眼。它只需要在这些几何约束的交叉点上找到一个最优解——一个同时满足 13 个空间坐标的面孔。约束越多,随机性越低,结果越接近你心里的那张脸。

人像写真分层构建-五官层+肤质层效果展示
五官层+肤质层协同——13个面部几何约束 × 陶瓷质感皮肤,模型在每个坐标点寻找最优解

肤质层:一个词让渲染引擎换算法

冷白皮,陶瓷般细腻水嫩透亮肌肤,幼态甜妹妆容

“陶瓷般”这三个字是整条 Prompt 最被低估的词。它不是颜色描述——是说”这个物体的表面应该像陶瓷一样反射光线”。

人类皮肤的次表面散射很复杂——光进入表皮后会在真皮层散射然后从另一个地方出来,导致皮肤看起来”透亮”而非”反光”。陶瓷的反射模式完全不同:漫反射极低、高光区域集中且亮度高、没有次表面散射。说”陶瓷般肌肤”,模型会把皮肤材质从 SSS(次表面散射)模式往硬表面反射模式转——出来的效果就是冷白、光滑、有一层浓缩的高光而非均匀的透光。

这就是为什么有时候”一个词”比”一段话”更精准。材质关键词直接映射到渲染管线,不需要模型做语义推理

造型层:校服 + 小香风,冲突才是视觉张力

身着深圳校服,搭配小香风精美配饰与手提包,整体穿搭精致有大小姐气质

这条 Prompt 最精彩的一个决策:把两套完全不同社会阶层的视觉符号配在一起。

深圳校服是蓝白运动服——青春、朴素、集体感。小香风是粗花呢、链条、金色双C——成熟、精致、阶级感。这两套符号在同一个画面里碰撞,产生了一个微妙的叙事张力:她穿着学生的制服,但配饰说她不只是一个学生

模型不需要理解”阶层””符号学”。它只需要在训练数据里找到”校服少女”和”小香风配饰”的视觉交集——这个交集本身就自带冲突色彩,因为这两类图片在训练数据里几乎不重叠。结果就是画面呈现一种恰到好处的不协调感,像时尚杂志的策划页。

姿态层:矛盾的才是活的

神态慵懒俏皮,温柔羞怯又自信大方,表情甜美可爱,动作自然随性,随机角度抓拍

注意这串形容词不是”好词大集合”——是三组矛盾:慵懒 vs 俏皮、温柔 vs 羞怯 vs 自信、甜美 vs 自然随性

单写”自信”→ 模型给一个昂首挺胸的标准姿势。单写”羞怯”→ 低着头、肩膀内收。但你写”羞怯又自信”——模型被迫找一个中间态:身体是自信的(腰背挺直、重心稳定),微表情是羞怯的(眼神闪烁、嘴角肌肉不完全放松、下巴微收)。

“随机角度抓拍”是最后一个聪明词。它告诉模型:这不是摆拍,这个姿势不是被安排好的。模型会把构图从”模特看镜头”的完美正脸往”刚好被抓到的一个瞬间”偏移——镜头可能不在正前方、发丝可能遮挡一只眼、笑容不对称。活人感从这里来。

全身远景超广角-校服小香风漫画展场景-分层摄影效果图
场景层+姿态层——漫画展背景锚定空间,慵懒羞怯又自信的矛盾表情制造活人感

场景层:背景不是背景,是滤镜

身处治愈系漫画展背景,远景全身照,超广角镜头,氛围感拉满

“治愈系漫画展”——几个字把整个背景从”一块画布”变成了”一个有色彩指向的情绪空间”。治愈系漫画通常对应柔和的粉色、浅蓝色、奶油色、Q版线条、软乎乎的视觉语言。模型会调用这些色彩和形状,填充背景。

但这不是为了画背景——是为了让背景变成主体的天然柔光罩。粉色和浅蓝色的漫反射打在冷白皮上,变成一种不刻意但微妙的肤色偏移。黑色背景配冷白皮是硬朗的,漫画展背景配冷白皮是柔和甜美的。场景不是装饰,是主体的第二层光线。

从一条 Prompt 到「分层摄影」方法论

把 Prompt 当成一份摄制组通告来写,每一层对应一个岗位。任何一层没写好,其他层再怎么精修都会穿帮。

  • 摄影层——定光学基调。侧光/顺光/逆光、冷调/暖调、低饱和/高饱和。在描述主体之前先把光线环境锁死。
  • 五官层——定面部几何。不是”好看”,是瓜子脸/鹅蛋脸、桃花眼/丹凤眼。每加一个特征就是给模型加一个空间约束。
  • 肤质层——定渲染方向。”陶瓷般”和”婴儿般”和”牛奶般”在渲染管线上是三条不同的路径。选对材质关键词比堆一百个形容皮肤的词都管用。
  • 造型层——定冲突。单一风格的穿搭是单调的,两种冲突风格的叠穿才产生叙事。
  • 姿态层——定矛盾。矛盾的表情和动作是活人感的来源。完美对称的微笑是证件照,不对称的、被”抓拍”到的瞬间才是好看的。
  • 场景层——定第二光源。背景不只是装饰,它的颜色会反射到主体上,变成一层额外的色彩偏移。

下次写人像 Prompt,别从”一个女孩”开始。从”侧光、f/1.4、莫兰迪色调”开始。你的模特还没出场,但灯光已经打好了。

技术参数

项目 详情
生成模型 豆包 Seedream 5.0 Pro
分辨率 默认(无指定 size)
图片比例 特色图 3:2 / 效果图 9:16
核心框架 分层摄影结构(摄影→五官→肤质→造型→姿态→场景六层)

Prompt 完整附录

8K超高清,杰作级真人写真,顶级画质,摄影大师级布光,侧光营造通透质感,景深效果突出氛围感,真实场景拍摄,莫兰迪冷色调,INS网红风,画面干净明亮。18岁东方江南美女,瓜子脸,尖下巴,三庭五眼比例标准,柳叶细眉,桃花眼,眼尾狭长,高挺悬胆鼻,樱桃小嘴,大眼睛双眼皮,长睫毛,眼眸深邃温柔;冷白皮,陶瓷般细腻水嫩透亮肌肤,幼态甜妹妆容,妆造精致可爱。长发及腰,身形娇小纤瘦,S形完美曲线,身材比例协调;身着深圳校服,搭配小香风精美配饰与手提包,整体穿搭精致有大小姐气质。身处治愈系漫画展背景,神态慵懒俏皮,温柔羞怯又自信大方,表情甜美可爱,动作自然随性,随机角度抓拍,兼具清冷与纯欲甜美元气。远景全身照,超广角镜头,氛围感拉满,细节丰富细腻,容颜绝美,气质端庄灵动。

FAQ

六层一定要全部写满吗?少几层行不行?

行。分的层越多,模型的总约束越强,输出越可控——但 Prompt 也越长。对于简单人像,”摄影层+五官层+肤质层”三层就够。复杂场景上六层。关键不是层数,是每一层有没有独立的信息增量。如果造型层只有”穿白色裙子”而非”校服配小香风”,那它在摄影结构上等于没做事。

“陶瓷般肌肤”比”光滑细腻的皮肤”好在哪?

“光滑细腻”是形容词,留给模型的解释空间很大。模型可以选择任何一种”看起来不错”的肤质渲染方式——可能是游戏角色的塑料感,也可能是柔光滤镜下的人像。”陶瓷般”是材质锚——直接把皮肤锁定到一种特定的物理光学属性。模型不需要猜你要哪种”光滑”,它知道陶瓷的反光曲线长什么样。

为什么”羞怯又自信”这种矛盾词比单写一个效果好?

单写一个情绪,模型输出的是那个情绪的”标准照”——姿势、表情、肢体语言都是训练数据里的统计平均。当你把两个矛盾的情绪绑在一起,统计平均失效了。模型被迫在两者之间插值,插值的结果往往是训练数据里更有个性的、更少见的组合——这些样本往往来自高质量的艺术摄影而非流水线人像。矛盾词本质上是把模型从”平均脸”推向了”更有辨识度的脸”

原文链接:https://aigc.oneyer.cc/3170/,转载请注明出处。
0

评论0

请先
请拖动滑块到最右边
没有账号?注册  忘记密码?