朋友是做概念美术的,前两天给我看了一组《沙丘》的幕后设定稿,问我:”这种’站在地面上、头顶伸进云层里’的神明巨构,AI 能画出来吗?”
我扫了一眼那条 Prompt——200 字不到,超远景、极繁纹理、NASA 镜头、UE5 渲染。丢进豆包 Seedream 5.0,等 30 秒,一张遮天蔽日的史诗画面就出来了。
为什么这么短的字能驱动这么宏大的场面?我把它的底层逻辑拆出来,提炼成一套可复用的框架——「四极渲染法」。
效果预览

拆解:200 字的 Prompt 为什么能「撑起」一副神明的体量?
画”巨大的东西”是 AI 的一个隐性短板。你可以写”一座 300 米高的雕像”,但模型画出来往往只是一个放大了的普通雕像——它缺的不是高度数字,是让”大”这件事被感知到的参照系统。
这条 Prompt 用了四组彼此配合的指令来解决这个问题。我把它提炼为 「四极渲染法」——尺度/细节/光影/风格四个维度,每个维度单独承担一个”说服观众相信这是真的大”的任务。
极一:尺度构建——让”大”被眼睛测量
超远景拍摄,从平原最远处直立起一个神明本体,由于其巨大的体量,一端站在平原上,剩余的部分悬空,最高处进入云层。
模型为什么能画出这种尺度?
这里有一个容易被忽略但非常高效的技巧:“一端站在平原上”+”最高处进入云层”构成了一个视觉参照系。
模型不是靠”巨大”这个词理解尺度的——它靠的是画面元素之间的相对比例关系。”平原”提供了一个地面基准线,”进入云层”提供了高度上限——两者之间就是”神明的身高”。而”超远景”告诉模型镜头要拉得足够远,远到能同时装下地面和云层。
这三者组合在一起,在训练数据中触发的是那些超广角航拍、卫星摄影、NASA 地球照片的构图分布——天生自带”从极远处观看”的尺度感。
另外,”剩余的部分悬空”这四个字极其精确:它不是”站在地上”也不是”飘在空中”,是一种只有一部分有支撑的状态。这种不完整的物理接触进一步强化了”这个东西根本不是人类尺度能理解的”的视觉冲击。
极二:细节密度——用”看不清但知道有”来制造敬畏
上面是非常微小且密密麻麻金色咒语和衣服纹理结构,极繁美学,层层叠叠,错落有致,能量花纹,零星的点状灯光点缀。
模型为什么能画出这种细节?
这是全 Prompt 最重要的一个段落。它的精妙在于:不是在”画”细节,而是在”暗示”细节的存在。
“非常微小且密密麻麻”给了两个关键指令:① 图案极其小(在画面中可能只有几个像素大);② 但非常多(覆盖整个表面)。模型读到这个,不会真的去渲染每个咒语的内容——它做不到——但会在神明体表生成一种密集纹理化的视觉信号,让观众”觉得”上面有字。
这就是”极繁美学”在 AI 绘图中真正起作用的原理:不是画出一万个单独的元素,而是激活一种”有极高信息密度表面”的视觉特征。训练数据中寺庙壁画、哥特教堂、印度神庙的密集装饰纹样,它们的像素级特征就是”有东西但看不清具体是什么”——模型复制的就是这个感觉。
“零星的点状灯光点缀”则是另一个巧妙的尺度标尺:在一具能伸入云层的神明身体上,灯光意味着什么?意味着这具身体上有建筑物级别的结构——那些不是”装饰”,是”人居空间”。一个点状灯光 = 一座城市那么大。
极三:光影对比——用黑暗来定义光明
厚重灰黑云层半包裹地貌,明暗强烈对比。
模型为什么能画出这种氛围?
“厚重灰黑云层半包裹地貌”给了两件事:① 一个笼罩性的暗黑环境;② “半包裹”意味着不是全黑——有光从缝隙漏进来。
在像素级别,”半包裹的厚重云层”触发的是 volumetric lighting(体积光)和 god rays(圣光效应)的渲染模式——光线穿过半透明云层形成的层次感。这恰好是史诗概念艺术最核心的视觉语言。
“明暗强烈对比”进一步强化——告诉模型这里不是阴天,是有选择的光。黑暗越深,那些”零星点状灯光”和”金色咒语”就越亮。这个对比本身就是”神明”这个概念的视觉翻译——在压倒性的黑暗中,微小的光芒定义了神圣。
极四:风格滤镜——把 CG 变成”好像 NASA 拍到的”
NASA 镜头风格(带一层暗淡滤镜),电影级渲染,UE5 渲染。
模型为什么能画出这种质感?
三个词,三个不同层面的效果叠加:
① “NASA 镜头风格”:不是让模型”画一张 NASA 的照片”,而是激活了深空摄影的图像特征——低饱和度、略微偏灰的色调、极高景深、一种”在极远距离拍摄”的成像质感。这种风格天然适配”超远景”的构图。
② “暗淡滤镜”:给画面加了一层统一的色彩倾向。Seedream 在处理这类风格关键词时,会在颜色采样阶段整体降低饱和度、添加灰色偏置——恰好跟”厚重灰黑云层”形成氛围闭环。
③ “电影级渲染 + UE5 渲染”:触发的是训练数据中那些高端 3A 游戏概念图、电影预可视化渲染的视觉特征——高精度的材质反射、准确的全局光照、PBR 材质的金属/粗糙度表现。注意这里 UE5 不是真的用引擎渲染,而是告诉模型”去匹配那些标注了 Unreal Engine 5 概念图标签的训练样本”。
技术参数
| 项目 | 参数 |
|---|---|
| 模型 | 豆包 Seedream 5.0 (doubao-seedream-5-0-260128) |
| 生成分辨率 | 2048×3648 (9:16) |
| 风格参考 | NASA 镜头 + UE5 渲染 + 电影级 |
| 构图 | 超远景,仰视/平视混合,完整神明体量 |
| 后处理 | 无 |
四极渲染法速查
史诗巨构场景 Prompt 通用框架。填完即用。
| 维度 | 解决的问题 | 指令要点 | 示例关键词 |
|---|---|---|---|
| 尺度极 | 观众”看不到”大 | 建立地面基线+高度上限+镜头距离 | 超远景、进入云层、一端站在平原 |
| 细节极 | 大=空洞=不真实 | 密集纹理暗示+灯光=尺度标尺 | 密密麻麻、极繁美学、点状灯光 |
| 光影极 | 没有黑暗就没有宏大 | 半包裹环境+强烈对比 | 厚重云层半包裹、明暗强烈对比 |
| 风格极 | 这是 CG 还是照片? | 叠加摄影+引擎+滤镜风格 | NASA 镜头、暗淡滤镜、UE5 渲染 |
FAQ
Q: 如果神明换成科技巨构(太空站/巨型机甲)要改哪些?
核心改两处:① 把”金色咒语”换成科技文本(蓝色全息光纹/电路纹理/编码符号);② 把”NASA 镜头+暗淡滤镜”保留——这个风格组合对任何”从太空往下看”的巨构都适用。细节极保持”密密麻麻+极繁”,只是纹理从咒语变电路。”点状灯光”天然适配科技巨构——灯光=舷窗/能量节点。
Q: 能不能不用 NASA 镜头风格,换一个更”神话史诗”的?
可以。把”NASA 镜头风格(带暗淡滤镜)”替换为”文艺复兴油画风格,金色与深棕色调,神圣光线”——这会触发古典宗教画的参考分布,神明会更像米开朗基罗壁画里的感觉。但注意:油画风格会降低”巨构感”——因为古典油画没有超广角的概念,空间纵深感会被削弱。
Q: 为什么云层要”半包裹”而不是”全包裹”?
全包裹=什么都看不见=画面失效。”半包裹”给模型留了让神明体表纹理透出来的空间。如果全包了,模型会把它理解成”画一张满是云的图,后面大概有个东西”——结果就是云占了 90% 画面,神明只剩一个模糊轮廓。对这个 Prompt 来说,神明的存在感与云的遮挡程度成反比。
结尾
写”很大”的 Prompt,最容易犯的错误是堆形容词——”巨大””恢弘””磅礴””无与伦比”。这些词对 AI 来说就像对着一个外国人说”这个东西非常非常非常非常大”——你说几遍他都听不懂,因为他缺的不是情绪强度,是一个可量化的参照系。
四极渲染法做的事很简单:不让”大”作为一个形容词出现。用地面到云层定义”大”的坐标,用看不见但知道有的细节证明”大”的真实性,用半包裹的黑暗反衬”大”的压迫感,用 NASA 的冰冷镜头拍下”大”的距离感。四个维度各司其职,”大”就自己长出来了。
下次写巨构 Prompt,先问四个问题:观众从多远看?有什么参照物证明体量?表面细节够密吗?光和影让谁更有力量?
答案写进 Prompt 里,比一百个”巨大”都有用。
Prompt 附录(完整原文)
超远景拍摄,从平原最远处直立起一个神明本体,由于其巨大的体量,一端站在平原上,剩余的部分悬空,最高处进入云层,上面是非常微小且密密麻麻金色咒语和衣服纹理结构(极繁美学,层层叠叠,错落有致,能量花纹),零星的点状灯光点缀;厚重灰黑云层半包裹地貌;明暗强烈对比,超写实史诗概念艺术,宏大叙事,写实风格,nasa镜头风格(带一层暗淡滤镜),电影级渲染, UE5渲染。

评论0