跳到正文
LaFoto

指南

如何做出照片级写实的 AI 图片:9 个 prompt 技巧

要得到照片级写实的 AI 图片,描述的是一张真实照片,而不是抽象概念。最稳妥的做法包括:指定真实相机与镜头("shot on 85mm, f/1.8"),点名具体光源与方向("soft window light from the left"),加入可信的不完美(皮肤纹理、轻微不对称、自然颗粒),把主体说清说准,借助负面 prompt 去掉典型 AI 伪迹("plastic skin, extra fingers, oversaturated, watermark"),设置真实的景深,选择合适的长宽比,调低指导强度以免模型“过火”,并用局部精修替代反复重摇。影响力最大的因素是布光,其次是“刻意的不完美”,因为无瑕、均匀、过饱和的画面最容易暴露是 AI。包括 Google 的 Imagen 在内的研究发现,提升语言理解力比单纯做更大的图像模型更能提高写实度,这就是为什么精确、摄影化的表述如此关键。模型会按你的描述去渲染:你要的是“真实照片的视觉签名”,就更容易得到写实结果;你只说“a beautiful high quality image”,多半只会得到通用而塑料感的画面。下面的九个技巧都是可以直接粘贴进 prompt 的实操语句。
作者 LaFoto 编辑团队

10 分钟读完
一幅体现“照片级写实 AI 图像”的示意性肖像构图

AI 图片最初为什么会显得假?

在解决问题之前,先认清 AI 的“露馅点”。讽刺的是,AI 图片往往因为“过于完美”而显假:皮肤毫无瑕疵,光线均匀到不现实,颜色过度饱和,还有一种真实相机不会产生的亮面喷绘感。

这件事并非无关痛痒。根据 Conjointly(2025 年 9 月,301 名美国成年人)的研究,人们如今分辨真实与 AI 图像的准确率大致与猜硬币相当,约 50%,且只有 9% 的受访者能至少正确识别 70% 的图片(2023 年 6 月为 25%)。换句话说,一旦 AI 图像做得足够好,多数人是真的分辨不出来。你要做的,就是去掉那几处仍在“出卖”它的线索。

常见的“露馅点”就几条:塑料般、无纹理的皮肤;没有明确来源与方向的光线;糖果般的高饱和色;不可能的完美对称面孔;被揉成一团的手、牙齿与文字;以及“干净得离谱”的背景。下面九个技巧逐一对症,逼近真实照片的观感。

实现照片级写实的 9 个技巧

这是完整工具箱。不是每张图都需要九条全用,但用得越有意识,写实度越高。每条都写成了可直接粘贴进 prompt 的句子。

  1. 描述一台真实相机与镜头。摄影语言能把模型锚定在现实里。写“Shot on a 50mm lens, f/1.8”或“85mm portrait lens”,就是在要求它重现真实照片的光学特征,包括自然的透视与景深。
  2. 点名具体光源与方向。布光是写实的最大杠杆。把“good lighting”换成“soft window light from the left”、“golden-hour backlight”或“overcast diffused daylight”。真实的光有来源、有方向、有明暗衰减。
  3. 加入可信的不完美。完美会显得假。要求“visible skin texture and pores”、“slight natural asymmetry”、“a few flyaway hairs”或“subtle film grain”。这些微小瑕疵正是相机会捕捉、而 AI 倾向抹平的细节。
  4. 把主体说具体、说人味。笼统的主体会被平均成诡异的结果。明确年龄、表情、服饰与自然姿态:“a woman in her 40s, relaxed half-smile, mid-conversation”,而不是“a beautiful woman”。
  5. 用负面 prompt 直接狙击 AI 伪迹。把会露馅的点排除掉:“plastic skin, airbrushed, oversaturated, extra fingers, deformed hands, text, watermark, CGI render, 3D”。这是清走复发性问题最快的路。
  6. 设置真实的景深。真实镜头不会让一切都锐利。“Shallow depth of field, background softly blurred”或“deep focus, sharp throughout”能告诉模型真实光圈会怎样表现。
  7. 把颜色拉回现实,而非糖果。要求“natural skin tones”、“muted realistic colors”或“neutral white balance”,抵消模型对过饱和的偏好。真实照片很少像默认 AI 输出那样艳。
  8. 调节指导强度,别让模型“过烹”。过高的指导(CFG)会逼出亮面、过度渲染的观感。若工具暴露该参数,中等值通常更自然、不塑料。
  9. 用局部精修,别重摇。当 90% 都写实、只有手或背景出戏时,先遮罩并只重生那一块,或直接编辑它,而不是重摇一遍把已正确的部分全丢掉。

把这些当作可调配方,而非绝对法则。相机镜头语言与布光几乎对任何场景都最有效,先把它们定住,再叠加“不完美”和负面 prompt,最后再微调颜色、景深与指导强度。

为什么布光是最重要的因素?

如果你的 prompt 只改一处,那就改“光”。摄影字面上记录的就是光,而我们对“不像真实光那样行为”的光极其敏感。一张没有明确光源,或光从不可能方向照来的图,即便其他细节都对,也会被判定为假。

具体的布光描述还能一举两得:既定情绪,又迫使模型渲染物理一致的明暗关系。“Soft window light from the left”意味着脸上会有横向明暗渐变、眼里有眼神光、右侧出现阴影衰减。“Golden-hour backlight”意味着暖色轮廓光与轻微雾化、偏低对比的场景。只要你明确提出,模型通常能可信地还原;反之则很难。

精确措辞之所以有效,原因在研究里。Google 的 Imagen 团队发现,相比扩大图像生成器本身,提升文本到图像模型的语言理解力,更能改善写实度与文图一致性。现代模型确实“懂”摄影与布光词汇,所以把字斟句酌用在“真实的光”上,会直接转化成写实。

弱 vs 写实:升级到底长什么样?

最快内化这些技巧的方法,就是看泛泛而谈的 prompt 如何被改写成写实版本。每一行都展示了移除的“露馅点”与取而代之的摄影语言。

泛用 prompt为什么显得假照片级写实改写
一位美女,高质量主观形容+无光源与相机信息;默认塑料皮肤40 多岁女性,放松半笑,可见皮肤质感,左侧窗光,85mm f/1.8 拍摄,浅景深,自然肤色
震撼的风景,4k没有光向、时间、镜头;默认过饱和薄雾晨光的高山山谷,低位金色光穿雾,广角 24mm 镜头,深景深,低饱和真实色彩,轻雾
产品照片,专业无材质、无光、无光学;读起来像平铺的 3D 渲染湿水泥上的琥珀玻璃瓶,单一柔和顶光棚拍,100mm 微距镜头,真实反射,自然色彩,精细表面细节
快乐的家庭,完美对称与无瑕最像 AI;无写实线索四口之家沙发上抓拍大笑,略不对称,柔和阴天窗光,35mm 镜头,自然皮肤质感,胶片颗粒
绝佳的美食照片,鲜艳过度饱和是经典 AI 露馅点;无光源木桌上的一碗拉面,近窗暖侧光,50mm 镜头,浅景深,自然低饱和色彩,轻柔蒸汽

模式很清晰:每一次改写,都是用相机、用光、用材质、用“刻意不完美”去替换那些空洞的溢美之词(“beautiful”“stunning”“amazing”)。重复做这件事,就是照片级写实的大部分功夫。

负面 prompt 如何让图片更真实?

负面 prompt 就是你要模型回避的清单。对写实来说,它是最有力的工具之一。与其“祈祷”模型不要出塑料皮肤与过饱和,不如直呼其名,把图像往反方向推。

一个强力的写实向负面 prompt 通常覆盖四类:塑料观感("airbrushed, plastic skin, smooth, CGI, 3D render")、解剖错误("extra fingers, deformed hands, fused limbs, mangled teeth")、色彩问题("oversaturated, HDR, neon")与覆盖层("text, watermark, signature, logo")。按图像需要组合使用,而不是整块无脑粘贴。

负面 prompt 天然适合迭代:某个伪迹反复出现,就把它加进负面项,而不是推倒重写整个正向 prompt。想了解 prompt 结构(正负面结合)的完整指南,请查看我们的 AI 照片 prompt 写作指南;或在“文字转照片”里先用一句朴素的话,再逐步加上写实要素。

你选择的 AI 图像生成器重要吗?

重要,而且超出很多人的预期。好的 prompt 技巧能走很远,但底层模型决定了上限。不同生成器的训练不同,默认观感也不同;有些在写实上明显更强,尤其体现在皮肤、手部与自然光。

评估“最适合写实”的 AI 图像生成器时,请用难题而非送分题。生成特写人像,检查皮肤纹理与手。生成仅有单一明确光源的场景,检查阴影是否一致。生成含文字或细密重复纹理的内容,检查是否糊成一团。能挺过这些检查的工具,才经得起放大审看。

LaFoto 正按这个标准在做:默认追求写实输出,并用 prompt 支架与编辑流程直指常见 AI 露馅点,而不是表面遮盖。作为预发布产品,这是一种设计取向的声明,不是跑分承诺。所以无论任何 AI 照片生成器(包括我们的),等真正上手时,都请用上面的“硬测项”来评判。

照片级写实的快速核对清单

在把一张图判为“写实”之前,过一遍这份短清单。它几乎能抓住所有残留的露馅点。

  • 光:是否有明确光源与方向?阴影是否一致?眼睛里有眼神光吗?
  • 皮肤与纹理:有毛孔、细纹与自然不完美,而不是喷绘光洁?
  • 手、牙、耳:数量与形状正确?没有融合或多余的手指?
  • 颜色:自然且略收敛,而不是霓虹或 HDR 式的高亮?
  • 光学:与你声明的镜头相匹配的景深与透视是否可信?
  • 背景:是否带着恰当的不完美,而不是干净得不现实或重复纹?
  • 文字与图案:画内文字或细密重复是否清晰渲染,而非抹糊?

若某一项未通过,就只针对那一项做定向编辑,或仅改变一个变量的 prompt,而不是整图重摇。这种纪律,加上上面的九个技巧,能稳定地把“普通 AI 图”转成“照片级写实”。最后 10% 请在 AI 修图器里精修,而非押注重新生成。

来源

  1. 01Photorealistic Text-to-Image Diffusion Models with Deep Language UnderstandingSaharia et al., arXiv (访问于 2026-06-01)
  2. 02Imagen: Text-to-Image Diffusion ModelsGoogle Research (访问于 2026-06-01)
  3. 03Can people still tell real photos from AI images in 2025?Conjointly (访问于 2026-06-01)
  4. 04Prompt engineeringWikipedia (访问于 2026-06-01)
  5. 05Diffusion modelWikipedia (访问于 2026-06-01)

常见问题

怎样让 AI 图片看起来更照片级写实?
描述一张真实照片,而不是抽象概念:指明相机与镜头,明确光源与方向,并加入可信的不完美如皮肤纹理。再用负面 prompt 去掉塑料皮肤与过饱和等露馅点,最后用局部精修替代重摇。
写实度最高的单一关键因素是什么?
布光。真实摄影记录的是光,而当光没有来源或来自不可能的方向时,人眼会立刻察觉。明确光源、方向与光质,模型就会渲染出物理一致的高光与阴影。
为什么我的 AI 图片看起来很塑料或很假?
通常是因为“过于完美”:无瑕皮肤、均匀布光、过饱和色彩。添加可见皮肤纹理与轻微不对称,明确方向性光源,要求自然、偏克制的颜色,并用负面 prompt 排除喷绘、塑料与 CGI 感。
为提升写实度,负面 prompt 该写些什么?
瞄准四类:塑料观感(airbrushed, plastic skin, CGI, 3D render),解剖错误(extra fingers, deformed hands, mangled teeth),色彩问题(oversaturated, HDR, neon),覆盖层(text, watermark, logo)。按需取用。
指名相机与镜头真的有用吗?
有用。像“shot on 85mm, f/1.8”这样的摄影语言,会把模型锚定在真实照片的光学签名上,包括自然的透视与景深。这是最有效的写实线索之一。
为什么加入“不完美”能更写实?
因为真实相机会捕捉那些 AI 倾向抹掉的细节。毛孔、轻微不对称、飞散的碎发、细腻的颗粒,正是“无瑕 AI 输出”所缺的;把它们点名要到,能把画面拉回真实照片。
2026 年人们还能分辨 AI 图与真实照片吗?
往往不行。Conjointly(2025 年 9 月,301 名美国成年人)的数据表明,人们分辨真实与 AI 图片的准确率约 50%,且仅 9% 的人能至少正确识别 70% 的图片(2023 年 6 月为 25%)。做得好,AI 图不易被识破。
什么是 CFG 或指导强度?它如何影响写实?
Guidance(CFG scale)控制模型对 prompt 的服从强度。数值过高会强行堆砌细节、产生亮面塑料感;若工具提供该参数,中等设置通常更自然、更写实。
哪款 AI 图像生成器最适合做写实?
因模型而异。默认观感、皮肤与手部、自然光的表现各不相同。请用难题测试:特写人像、单一明确光源、画内文字。能把这些都处理到位的,才是写实工作的最佳选择。
当画面已接近写实时,该重摇还是编辑?
编辑。如果 90% 都已写实、只有手或背景不对,遮罩并只重生那一块,或直接修它。重摇会丢掉你已经得到的真实部分,换来一次未知的赌局。

撰稿

LaFoto 编辑团队

LaFoto 编辑团队撰写 AI 照片生成的指南与对比,所有论断均有来源支撑,不编造。

继续阅读

今天就开始创作

用最佳 AI 图像生成器生成你的第一张图。

用一句话在数秒内生成成片、逼真的图像——随后精修每个细节。无需配置、无需 Discord、无需 GPU。

加入 4,200+ 位创作者正在使用 LaFoto

关于本指南

撰写
LaFoto 编辑团队
依据
基于我们自己的测试,不是转述文章
模型建议
会过时,因为行为会变
赞助
否 — 无付费植入
勘误
直接在页面更正
复核
模型变更时重新检查

实操要点

写实感首先是用光问题,不是细节问题

很多人本能地加细节词——8k、超高细节、超写实——但几乎没用。看着假的通常不是分辨率,而是违背物理的光。

真实的光会随距离衰减、包裹形体,阴影的硬度与光源尺寸匹配。明确光的方向、光源大小和色温,比再多“高质量”形容词更能提升真实感。

照片打印表面的超微距,在放大镜下可见纸纹与网点结构

三条切入

提升真实感的三根杠杆

从哪儿来、多大

光源大小决定阴影硬度:窗户=柔,裸灯泡=硬。方向决定体积与轮廓。色温决定情绪,而不改变饱和度。

  • 指明方向、尺寸、色温。
  • 一个主光往往比三盏灯更真实。
  • 说明阴影侧用什么补光。
AI 生成的自然光室内照片

细节

本指南涵盖什么

能提升真实感的具体校正。

为什么“写实、8k”没用

这些词只描述结果,不给出原因。模型需要能执行的物理指令。

为什么脸像蜡

模型被调得更“美肤”。在 prompt 里明确反向要求,它就会收敛。

为什么背景总不对

通常是对所写光圈来说过于锐利。景深必须在整幅画面内一致。

多跑几步有没有用

前期略有帮助,之后几乎无益。比起算力,描述用光更有效。

如何自查成片

看手指、牙齿、首饰扣、以及两种纹理的交界。高频细节最先露馅。

AI 生成的风景照片,于黄金时刻

相关

把这些技巧用起来

继续探索

这些真实感技巧能用在哪

站内所有偏摄影的功能页。