指南
如何做出照片级写实的 AI 图片:9 个 prompt 技巧

AI 图片最初为什么会显得假?
在解决问题之前,先认清 AI 的“露馅点”。讽刺的是,AI 图片往往因为“过于完美”而显假:皮肤毫无瑕疵,光线均匀到不现实,颜色过度饱和,还有一种真实相机不会产生的亮面喷绘感。
这件事并非无关痛痒。根据 Conjointly(2025 年 9 月,301 名美国成年人)的研究,人们如今分辨真实与 AI 图像的准确率大致与猜硬币相当,约 50%,且只有 9% 的受访者能至少正确识别 70% 的图片(2023 年 6 月为 25%)。换句话说,一旦 AI 图像做得足够好,多数人是真的分辨不出来。你要做的,就是去掉那几处仍在“出卖”它的线索。
常见的“露馅点”就几条:塑料般、无纹理的皮肤;没有明确来源与方向的光线;糖果般的高饱和色;不可能的完美对称面孔;被揉成一团的手、牙齿与文字;以及“干净得离谱”的背景。下面九个技巧逐一对症,逼近真实照片的观感。
实现照片级写实的 9 个技巧
这是完整工具箱。不是每张图都需要九条全用,但用得越有意识,写实度越高。每条都写成了可直接粘贴进 prompt 的句子。
- 描述一台真实相机与镜头。摄影语言能把模型锚定在现实里。写“Shot on a 50mm lens, f/1.8”或“85mm portrait lens”,就是在要求它重现真实照片的光学特征,包括自然的透视与景深。
- 点名具体光源与方向。布光是写实的最大杠杆。把“good lighting”换成“soft window light from the left”、“golden-hour backlight”或“overcast diffused daylight”。真实的光有来源、有方向、有明暗衰减。
- 加入可信的不完美。完美会显得假。要求“visible skin texture and pores”、“slight natural asymmetry”、“a few flyaway hairs”或“subtle film grain”。这些微小瑕疵正是相机会捕捉、而 AI 倾向抹平的细节。
- 把主体说具体、说人味。笼统的主体会被平均成诡异的结果。明确年龄、表情、服饰与自然姿态:“a woman in her 40s, relaxed half-smile, mid-conversation”,而不是“a beautiful woman”。
- 用负面 prompt 直接狙击 AI 伪迹。把会露馅的点排除掉:“plastic skin, airbrushed, oversaturated, extra fingers, deformed hands, text, watermark, CGI render, 3D”。这是清走复发性问题最快的路。
- 设置真实的景深。真实镜头不会让一切都锐利。“Shallow depth of field, background softly blurred”或“deep focus, sharp throughout”能告诉模型真实光圈会怎样表现。
- 把颜色拉回现实,而非糖果。要求“natural skin tones”、“muted realistic colors”或“neutral white balance”,抵消模型对过饱和的偏好。真实照片很少像默认 AI 输出那样艳。
- 调节指导强度,别让模型“过烹”。过高的指导(CFG)会逼出亮面、过度渲染的观感。若工具暴露该参数,中等值通常更自然、不塑料。
- 用局部精修,别重摇。当 90% 都写实、只有手或背景出戏时,先遮罩并只重生那一块,或直接编辑它,而不是重摇一遍把已正确的部分全丢掉。
把这些当作可调配方,而非绝对法则。相机镜头语言与布光几乎对任何场景都最有效,先把它们定住,再叠加“不完美”和负面 prompt,最后再微调颜色、景深与指导强度。
为什么布光是最重要的因素?
如果你的 prompt 只改一处,那就改“光”。摄影字面上记录的就是光,而我们对“不像真实光那样行为”的光极其敏感。一张没有明确光源,或光从不可能方向照来的图,即便其他细节都对,也会被判定为假。
具体的布光描述还能一举两得:既定情绪,又迫使模型渲染物理一致的明暗关系。“Soft window light from the left”意味着脸上会有横向明暗渐变、眼里有眼神光、右侧出现阴影衰减。“Golden-hour backlight”意味着暖色轮廓光与轻微雾化、偏低对比的场景。只要你明确提出,模型通常能可信地还原;反之则很难。
精确措辞之所以有效,原因在研究里。Google 的 Imagen 团队发现,相比扩大图像生成器本身,提升文本到图像模型的语言理解力,更能改善写实度与文图一致性。现代模型确实“懂”摄影与布光词汇,所以把字斟句酌用在“真实的光”上,会直接转化成写实。
弱 vs 写实:升级到底长什么样?
最快内化这些技巧的方法,就是看泛泛而谈的 prompt 如何被改写成写实版本。每一行都展示了移除的“露馅点”与取而代之的摄影语言。
| 泛用 prompt | 为什么显得假 | 照片级写实改写 |
|---|---|---|
| 一位美女,高质量 | 主观形容+无光源与相机信息;默认塑料皮肤 | 40 多岁女性,放松半笑,可见皮肤质感,左侧窗光,85mm f/1.8 拍摄,浅景深,自然肤色 |
| 震撼的风景,4k | 没有光向、时间、镜头;默认过饱和 | 薄雾晨光的高山山谷,低位金色光穿雾,广角 24mm 镜头,深景深,低饱和真实色彩,轻雾 |
| 产品照片,专业 | 无材质、无光、无光学;读起来像平铺的 3D 渲染 | 湿水泥上的琥珀玻璃瓶,单一柔和顶光棚拍,100mm 微距镜头,真实反射,自然色彩,精细表面细节 |
| 快乐的家庭,完美 | 对称与无瑕最像 AI;无写实线索 | 四口之家沙发上抓拍大笑,略不对称,柔和阴天窗光,35mm 镜头,自然皮肤质感,胶片颗粒 |
| 绝佳的美食照片,鲜艳 | 过度饱和是经典 AI 露馅点;无光源 | 木桌上的一碗拉面,近窗暖侧光,50mm 镜头,浅景深,自然低饱和色彩,轻柔蒸汽 |
模式很清晰:每一次改写,都是用相机、用光、用材质、用“刻意不完美”去替换那些空洞的溢美之词(“beautiful”“stunning”“amazing”)。重复做这件事,就是照片级写实的大部分功夫。
负面 prompt 如何让图片更真实?
负面 prompt 就是你要模型回避的清单。对写实来说,它是最有力的工具之一。与其“祈祷”模型不要出塑料皮肤与过饱和,不如直呼其名,把图像往反方向推。
一个强力的写实向负面 prompt 通常覆盖四类:塑料观感("airbrushed, plastic skin, smooth, CGI, 3D render")、解剖错误("extra fingers, deformed hands, fused limbs, mangled teeth")、色彩问题("oversaturated, HDR, neon")与覆盖层("text, watermark, signature, logo")。按图像需要组合使用,而不是整块无脑粘贴。
负面 prompt 天然适合迭代:某个伪迹反复出现,就把它加进负面项,而不是推倒重写整个正向 prompt。想了解 prompt 结构(正负面结合)的完整指南,请查看我们的 AI 照片 prompt 写作指南;或在“文字转照片”里先用一句朴素的话,再逐步加上写实要素。
你选择的 AI 图像生成器重要吗?
重要,而且超出很多人的预期。好的 prompt 技巧能走很远,但底层模型决定了上限。不同生成器的训练不同,默认观感也不同;有些在写实上明显更强,尤其体现在皮肤、手部与自然光。
评估“最适合写实”的 AI 图像生成器时,请用难题而非送分题。生成特写人像,检查皮肤纹理与手。生成仅有单一明确光源的场景,检查阴影是否一致。生成含文字或细密重复纹理的内容,检查是否糊成一团。能挺过这些检查的工具,才经得起放大审看。
LaFoto 正按这个标准在做:默认追求写实输出,并用 prompt 支架与编辑流程直指常见 AI 露馅点,而不是表面遮盖。作为预发布产品,这是一种设计取向的声明,不是跑分承诺。所以无论任何 AI 照片生成器(包括我们的),等真正上手时,都请用上面的“硬测项”来评判。
照片级写实的快速核对清单
在把一张图判为“写实”之前,过一遍这份短清单。它几乎能抓住所有残留的露馅点。
- 光:是否有明确光源与方向?阴影是否一致?眼睛里有眼神光吗?
- 皮肤与纹理:有毛孔、细纹与自然不完美,而不是喷绘光洁?
- 手、牙、耳:数量与形状正确?没有融合或多余的手指?
- 颜色:自然且略收敛,而不是霓虹或 HDR 式的高亮?
- 光学:与你声明的镜头相匹配的景深与透视是否可信?
- 背景:是否带着恰当的不完美,而不是干净得不现实或重复纹?
- 文字与图案:画内文字或细密重复是否清晰渲染,而非抹糊?
若某一项未通过,就只针对那一项做定向编辑,或仅改变一个变量的 prompt,而不是整图重摇。这种纪律,加上上面的九个技巧,能稳定地把“普通 AI 图”转成“照片级写实”。最后 10% 请在 AI 修图器里精修,而非押注重新生成。
来源
- 01Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding — Saharia et al., arXiv (访问于 2026-06-01)
- 02Imagen: Text-to-Image Diffusion Models — Google Research (访问于 2026-06-01)
- 03Can people still tell real photos from AI images in 2025? — Conjointly (访问于 2026-06-01)
- 04Prompt engineering — Wikipedia (访问于 2026-06-01)
- 05Diffusion model — Wikipedia (访问于 2026-06-01)
常见问题
- 怎样让 AI 图片看起来更照片级写实?
- 描述一张真实照片,而不是抽象概念:指明相机与镜头,明确光源与方向,并加入可信的不完美如皮肤纹理。再用负面 prompt 去掉塑料皮肤与过饱和等露馅点,最后用局部精修替代重摇。
- 写实度最高的单一关键因素是什么?
- 布光。真实摄影记录的是光,而当光没有来源或来自不可能的方向时,人眼会立刻察觉。明确光源、方向与光质,模型就会渲染出物理一致的高光与阴影。
- 为什么我的 AI 图片看起来很塑料或很假?
- 通常是因为“过于完美”:无瑕皮肤、均匀布光、过饱和色彩。添加可见皮肤纹理与轻微不对称,明确方向性光源,要求自然、偏克制的颜色,并用负面 prompt 排除喷绘、塑料与 CGI 感。
- 为提升写实度,负面 prompt 该写些什么?
- 瞄准四类:塑料观感(airbrushed, plastic skin, CGI, 3D render),解剖错误(extra fingers, deformed hands, mangled teeth),色彩问题(oversaturated, HDR, neon),覆盖层(text, watermark, logo)。按需取用。
- 指名相机与镜头真的有用吗?
- 有用。像“shot on 85mm, f/1.8”这样的摄影语言,会把模型锚定在真实照片的光学签名上,包括自然的透视与景深。这是最有效的写实线索之一。
- 为什么加入“不完美”能更写实?
- 因为真实相机会捕捉那些 AI 倾向抹掉的细节。毛孔、轻微不对称、飞散的碎发、细腻的颗粒,正是“无瑕 AI 输出”所缺的;把它们点名要到,能把画面拉回真实照片。
- 2026 年人们还能分辨 AI 图与真实照片吗?
- 往往不行。Conjointly(2025 年 9 月,301 名美国成年人)的数据表明,人们分辨真实与 AI 图片的准确率约 50%,且仅 9% 的人能至少正确识别 70% 的图片(2023 年 6 月为 25%)。做得好,AI 图不易被识破。
- 什么是 CFG 或指导强度?它如何影响写实?
- Guidance(CFG scale)控制模型对 prompt 的服从强度。数值过高会强行堆砌细节、产生亮面塑料感;若工具提供该参数,中等设置通常更自然、更写实。
- 哪款 AI 图像生成器最适合做写实?
- 因模型而异。默认观感、皮肤与手部、自然光的表现各不相同。请用难题测试:特写人像、单一明确光源、画内文字。能把这些都处理到位的,才是写实工作的最佳选择。
- 当画面已接近写实时,该重摇还是编辑?
- 编辑。如果 90% 都已写实、只有手或背景不对,遮罩并只重生那一块,或直接修它。重摇会丢掉你已经得到的真实部分,换来一次未知的赌局。
撰稿
LaFoto 编辑团队撰写 AI 照片生成的指南与对比,所有论断均有来源支撑,不编造。




