本页目录
跑了上千张写真图片后,我总结了一套方法论
从上千张 AI 写真测试中提炼场景、成像、妆容、动作与随机变量的五层 Prompt 方法。
这段时间,我围绕 ChatGPT 的 image-2 / gpt-image-2 跑了上千张 AI 写真。花田、果园、旧阁、黑板、棚拍、直闪、柔雾、CCD;同一个主题反复换动作、镜头和光线,好的是真好,翻车的也是真离谱。

翻着这些结果,我发现真正稳定出片的 Prompt 既不是最长的,也不是词最华丽的。最容易出效果的写法,更像一份“拍摄小抄”:摄影师要知道机位,化妆师要知道妆面,造型师要知道衣服,场务要知道现场有什么,后期要知道画面最终是胶片、直闪、柔雾,还是手机抓拍。
核心结论: 写真 Prompt 不要从“人”开始写,要从“这张照片为什么成立”开始写。
先找到照片的成立点
刚开始玩 AI 写真时,我也会拼命写“清透、氛围感、高级、电影感、精致、真实、细腻”。这些词不是完全没用,但它们太空了。就像只对摄影师说“帮我拍得高级一点”,对方还是会追问:在哪里拍、什么光、什么服装、什么情绪、半身还是全身、镜头离人多远。
AI 也是一样。它不是不懂美,而是不知道你要哪一种美。所以我现在会先问自己:**这张图的成立点是什么?**有些图成立在场景,有些成立在光、妆面、镜头角度或一个动作。先抓住这个东西,后面的词才有地方落。


旧阁这张的关键词不是“古风美女”,而是旧木案、鸟笼、小鸟、手抄纸、卷轴、竹帘、窗棂、风吹纱帘和窗外白雾逆光。人物只是画面的一部分,真正把图撑起来的是这个房间。
夏日雏菊这张也不是简单写“夏日少女”。它有雏菊、草帽、白色大花前景、树荫斑驳光、蓝天、积云、草地和野餐布,还有低机位与近处花朵虚化。画面的成立点被说清楚以后,人物才真正进入了现场。
五层写真 Prompt 写法
第一层:先给它一个能站住的场景
我现在基本不会只写“室内”“户外”“棚拍”这种大词,而会写成一个具体空间。比如旧阁书案,不是“古风房间”,而是旧木案、鸟笼、黄绿色小鸟、散落谷粒、古书、手抄纸、卷轴、砚台、旧瓷果盘、桃子、竹帘、窗棂和旧床榻。
这一串东西不是为了让每个道具都出现,而是在给 AI 一个空间密度:这个房间不是空的,这里有人生活过,有旧木头的潮气、纸张、纱帘、鸟笼和一点灰尘。画面立住了,人再进去就自然了。

夏日果园也是同样的逻辑。除了树叶、枝条、青色果实、藤蔓、竹篮、草帽、果汁和自然小路,我还会写一句:“镜头像藏在果树枝叶之间。”它会逼着画面出现前景遮挡;有前景,画面就不平,有遮挡,图才像真的被抓拍到。
判断一个场景够不够具体,可以检查三层:
- 前景有什么;
- 人物在哪里;
- 背景有什么。
三层都空,大概率会生成一张很平的图。
第二层:别只写风格,要写成像方式
“胶片感、CCD、电影感、杂志感、氛围感”可以写,但只写这些不够。我更喜欢写“它像什么设备拍出来的”:富士相机摄影、尼康相机摄影、手机抓拍、直闪 CCD,或高调奶油柔雾棚拍光。不同设备背后,是不同的成像逻辑。
富士户外容易带出高饱和、蓝天与胶片颗粒;直闪 CCD 会有硬阴影、皮肤反光和现场感;柔雾棚拍会有低对比、边缘化开、奶油一样的高光。与其写“高级感”,不如写“大面积柔光从正前方和侧前方包裹人物,整体曝光偏高、低对比,像隔着 Pro-Mist 柔雾滤镜拍摄”。

这张图我最满意的不是脸,而是手、花、白色桌面和背景全被光揉开了。真正起作用的是“高调、柔雾、低对比、前景虚化、亮部轻微溢出但不要死白”。光线不要只写美,要写它从哪里来、落在哪里、最终造成什么效果。
第三层:妆容写成锚点,不要写成化妆教程
妆容很容易越写越长:眼影、睫毛、卧蚕、唇釉、鼻梁高光、面中腮红、皮肤纹理全往里塞,结果有时会变成美妆广告,脸也开始发假。
更稳的方法是只抓“最小可识别锚点”,也就是这张脸最重要的几个识别点。

水蜜桃氧气写真的锚点是:桃粉甜美妆、奶油肌、粉桃眼下腮红、水润桃粉唇、果实发串和飘带发饰。重点不是“五官完美”,而是整张脸像一颗桃子;腮红、唇色、发饰、道具和光线都在服务同一个感觉。
我会先用一句话收住妆容,再补两三个细节。例如:
- 白兰柔雾:清透奶油裸妆;
- 黑板职感:冷白皮直闪职感妆;
- 夏溪花冠:花园精灵感桃粉妆。
不要一边写冷感厌世,一边写甜妹元气;也不要一边写欧美浓颜,一边写日杂透明感。
第四层:动作不要写死,要写动作骨架
AI 写真最容易翻车的地方就是姿势:手指多一根,脖子拧坏,腿脚接不上,身体朝左,头偏偏回头看镜头。我默认会避开“回头看镜头、扭头回望、身体背过去但头转回来”这类姿态,不是它们一定不能出好图,而是脖子与肩膀的翻车概率太高。
我更喜欢写动作骨架:
- 低头垂眼,手指轻触桌面花瓣;
- 坐在草地上晒太阳,不强求看向镜头;
- 从果树枝叶之间跑过,笑着侧身但头肩方向一致;
- 手拿桃子靠近脸部,俏皮近景抓拍;
- 站在白板旁,手扶桌面,直闪镜头,视线看向镜头。
它们不是死姿势,而是在给模型一个身体逻辑。

黑板职感这张成立在白板、公式、证件挂绳、黑框眼镜、夜间办公室与直闪。动作只是手撑桌面、身体微侧、看向镜头。越是直闪,动作越不能复杂,因为它会把身体结构暴露得很清楚。AI 不是不会拍人,但动作如果像一张人体结构考试卷,它就会开始乱答。
第五层:给它一点随机,但别把方向也随机掉
写真最怕所有图长得一样:同一张脸、同一个距离、同一个表情和构图,跑十张像复制粘贴。所以我会故意留下一些变量:
- 道具不需要全部出现,只根据构图需求选取;
- 每张图的镜头距离可以不同;
- 动作与表情随机,不强求看向镜头;
- 前景可以由草叶、野花、发丝或裙纱虚化遮挡。
这个随机不是让 AI 随便发挥,而是在一个框里动。场景、光线和妆造不变,动作、距离、前景遮挡与是否看镜头可以变化。

夏溪花冠的方向很明确:夏日、强光、花冠、绿色头发、花园精灵感;但它没有规定人物一定要正脸看镜头,于是画面反而更自然。最稳的结构不是全部锁死,而是锁住风格骨架,放开画面呼吸。
一套可以复用的检查顺序
写完 Prompt 后,我会按这个顺序检查:
- 画面主题与成像方式;
- 人物基础、妆容锚点与真实皮肤质感;
- 服装造型及其与主题的关系;
- 前景、人物位置、背景和可选道具;
- 镜头距离、机位、裁切和景深;
- 清楚但不过度锁死的动作骨架;
- 光从哪里来、照到哪里、产生什么效果;
- 负面护栏。
下面是白兰柔雾写真的完整示例:
可复制 Prompt
image-23:43:4 竖图,真实摄影,高调奶油柔雾棚拍肖像 一位明确成年的东亚女性,小鹅蛋脸,深棕黑发低盘发,耳后别一朵柔粉色兰花 清透奶油裸妆,桃粉眼下腮红,自然卧蚕,水润浅粉唇,保留轻微真实皮肤质感 白色挂脖褶皱上衣,珍珠耳钉,细手链,整体干净真实可穿 浅暖灰色棚拍背景,白色桌面,粉色兰花在前景 中近距离半身人像,人物低头垂眼,指尖轻触兰花花瓣,不看镜头 大面积柔光从正前方和侧前方包裹人物,低对比,亮部轻微溢出,像隔着柔雾滤镜拍摄 不要真实品牌 logo,不要硬光,不要 HDR,不要塑料皮肤,不要手指畸形,不要大幅扭头
可替换:高调奶油柔雾棚拍肖像、低盘发、低头垂眼,指尖轻触兰花花瓣,不看镜头
这段 Prompt 没有什么神秘词,它只是把一个拍摄现场讲清楚。
真正的重点:让所有元素互相认识
好图里的元素是互相认识的:桃子和腮红认识,草帽和树荫认识,白板和证件挂绳认识,兰花和柔雾光认识,鸟笼和旧书案认识,果树枝叶和抓拍视角认识。
差图经常不是丑,而是元素之间不认识:人物站在背景前,服装来自另一个世界,光线来自另一个世界,道具只是贴上去,妆容也和场景没关系。这种图就会有明显的 AI 味。
所以不要把 Prompt 写成购物清单,要把它写成一场拍摄。购物清单是“这个也要、那个也要”,拍摄则是所有东西都为同一个画面服务。
四个常见误区
1. 迷信长 Prompt
长不是问题,没主线才是问题。如果一段 Prompt 既要清纯、暗黑、复古、未来感、胶片和赛博,它不是丰富,而是吵。
2. 把负面词当救命药
“不要手崩、不要脸崩、不要多余肢体”只是护栏。真正减少崩坏的,是动作别太拧巴、构图别太难、身体逻辑别太反人类。
3. 让人物永远看镜头
写真不是证件照。低头、垂眼、伸手拨开枝叶、坐在草地晒太阳、跑过果园、摸花瓣或拿桃子靠近脸,都能让画面更有生活感。
4. 把所有道具强塞进去
“不需要全部出现,只根据构图需求选取”这句话很朴素,但能救很多图。道具是氛围库,不是考试题。
写 Prompt,也是在训练审美
跑过这么多写真后,我不再觉得 Prompt 是咒语。它更像一个倒逼审美的工具:你写不清楚,往往是因为脑子里的画面也还没清楚;你只写“好看”,是因为还没想明白它为什么好看。
一旦开始写前景、光线、镜头、动作、妆容与道具关系,看图的方式也会改变:机位是不是够低,前景有没有挡住一点镜头,光是不是从侧后方来,腮红和道具是否属于同一色系,人物到底在场景里,还是被贴了上去。
AI 没有让审美变得不重要,反而让审美变得更具体。以前说不出来的感觉,现在要变成“镜头像藏在果树枝叶之间”“亮部轻微溢出但不要死白”“桃子和腮红是同一个世界”。
最短版
写真 Prompt 的顺序可以是:
画面主题 → 成像方式 → 人物妆造 → 场景关系 → 镜头构图 → 动作骨架 → 光线质感 → 负面护栏
不要从“美女”开始,从“照片为什么成立”开始。这个起点一换,很多图会立刻不一样。
