跳到正文
LaFoto

指南

如何写出真正有效的 AI 照片 prompt

一个强力的 AI 照片 prompt 按重要性依次交代四件事:主体、场景、光线、风格。先说清楚画面关于谁或什么,再描述它所处的环境、光线如何打、以及视觉处理(相机、镜头、氛围、色彩)。技术限定如分辨率或长宽比放在最后;不要的元素用负面 prompt 单独排除。公式是:[subject] + [key attributes] + [setting/environment] + [lighting] + [camera/lens/style] + [mood] + [technical qualifiers],负面 prompt 独立书写。具体性胜过长度:10 个精确词语通常优于 50 个含糊词,因为每个具体细节都在把 AI 图片生成器引向你的意图、远离它的平均猜测。结果接近但不对时,一次只改一个变量,这样你能看清每次编辑的作用。也别忘了,很多时候无需重骰(re-roll),可以直接在成片上只修那一个问题。这就是全部要义;后文用可直接复制的示例演示全流程。
作者 LaFoto 编辑团队

10 分钟读完
一幅用于说明 AI 照片 prompt 的人像构图

强力 AI 照片 prompt 的结构是什么?

每个有效的 prompt 都由相同部件构成,按重要性从高到低分层。把它当作在给第一次合作的摄影师写 brief:先讲主体,再把世界搭起来。

  1. 主体:最重要的元素。“一只金毛幼犬”“一只陶瓷咖啡杯”“一位 60 多岁的女性”。
  2. 关键属性:让主体具象的限定。年龄、表情、服装、材质、颜色、姿态。
  3. 场景 / 环境:事情发生在哪里。“在被雨水打湿的城市街道上”“在大理石厨房台面上”“在雾气缭绕的松林里”。
  4. 光线:几乎是影响氛围与真实感的第一杠杆。“柔和窗光”“黄金时段的逆光”“戏剧性的棚拍轮廓光”。
  5. 相机、镜头与风格:“50mm 镜头拍摄”“浅景深”“社论时尚摄影”“胶片颗粒”。
  6. 氛围:情绪基调。“恬静安宁”“有活力、爱玩”“情绪化、电影感”。
  7. 技术限定:分辨率、细节与格式。“高细节”“锐利对焦”“4k”。

还有两项与主 prompt 并列的控制。负面 prompt 用来列出要避免的元素,例如“模糊、畸形手指、文字、水印、过饱和”。长宽比决定取景框:1:1 适合方形社媒贴文,4:5 适合竖版信息流,16:9 适合风景与横幅,9:16 适合故事与短视频。

你不必每次都写全所有层,但按这个顺序组织,AI 图片生成器就会按你的优先级理解意图。如果想省去手动结构化,AI Prompt 生成器能把一句短想法搭成完整 prompt。

为什么具体性胜过长度?

长 prompt 看起来周全,但长度不等于可控。一堵形容词墙常常自相矛盾,模型会把冲突取平均,结果变得混沌。具体的名词加少量果断修饰词,指向性更强。

对比“a beautiful amazing stunning gorgeous high quality professional photo of a nice dog”和“a wet black labrador shaking off water, mid-motion, backlit by low afternoon sun.”第二句更短,却给了 AI 图片生成器一幕清晰可建的场景。“beautiful”“high quality”这类空泛的溢美,描述的是你的期望,不是画面。

一个实用法则:每个词都该改变图像预期。删掉某个词如果不会改动你想看到的画面,那它大概率是填充。把“a nice background”换成“a blurred green park background”,你就把“愿望”换成了“指令”。

怎样迭代而不失控?

最常见的“擦肩而过”之后的错误,是重写整个 prompt。接着下一个结果在五个方面都变了,你也说不清哪一处起了作用。把写 prompt 当成对照实验:一次只改一个变量。

构图对了但光线寡淡,只改光线那句。氛围对了但主体服装不对,只改那条属性。其他全部保持一致,包括你的 seed(如果工具提供),这样你看到的差异才是你造成的差异。

  • 第 1 轮:先把主体与构图定稳;暂时别抠润色。
  • 第 2 轮:调整光线与时间。
  • 第 3 轮:细化相机、镜头与风格。
  • 第 4 轮:调氛围与色彩,然后锁定长宽比。

这种分段法能把像拉老虎机一样的挫败感,变成任何人都能复现的流程。

按使用场景,强力示例 prompt 长什么样?

这些是模板与脚手架,不是保证书。每个示例都展示了如何把结构套进具体任务。复制一条,把中括号里的细节换成你的,再继续迭代。不同工具与模型的输出会有差异,把它们当强力起点,不要当死方子。

人像:

  • "Headshot of a woman in her 30s, natural makeup, soft confident smile, wearing a charcoal blazer, seated against a neutral grey backdrop, soft diffused window light from the left, shot on 85mm lens, shallow depth of field, professional corporate portrait, warm and approachable mood, sharp focus. Negative: harsh shadows, blemishes, text, watermark. Aspect ratio 4:5."
  • "Environmental portrait of a male chef in a white jacket, mid-40s, arms crossed, standing in a busy stainless-steel kitchen with bokeh background, warm tungsten lighting with steam in the air, 35mm lens, documentary editorial style, candid and proud mood, high detail. Negative: blur, distorted hands. Aspect ratio 3:2."

产品摄影:

  • "Amber glass skincare bottle with a matte black pump, centered on a wet polished concrete surface, single soft top-down studio light with a subtle gradient background, 100mm macro lens, clean minimalist e-commerce style, premium and calm mood, crisp reflections, high detail. Negative: clutter, text, fingerprints, harsh glare. Aspect ratio 1:1."
  • "Stack of three artisan chocolate bars in kraft paper wrapping on a rustic wooden board, scattered cocoa nibs around, warm side lighting from the right with soft shadows, 50mm lens, shallow depth of field, lifestyle food photography, cozy and indulgent mood. Negative: plastic look, oversaturation, watermark. Aspect ratio 4:5."

风景与场所:

  • "Misty alpine lake at sunrise, snow-capped peaks reflected in still water, lone wooden rowboat near the shore, soft golden-hour light breaking through low fog, wide-angle 24mm lens, deep focus, serene and expansive mood, fine detail. Negative: people, buildings, blur, oversaturation. Aspect ratio 16:9."
  • "Narrow cobblestone alley in an old European town at dusk, warm glowing shop windows, wet stones reflecting amber streetlights, light rain, 35mm lens, cinematic moody atmosphere, nostalgic mood, high detail. Negative: modern cars, text signage, distorted perspective. Aspect ratio 16:9."

社论与生活方式:

  • "Young couple laughing while cooking together in a sunlit modern kitchen, casual linen clothing, fresh vegetables on the counter, soft natural daylight from large windows, 35mm lens, candid lifestyle editorial style, warm and joyful mood, natural skin tones, high detail. Negative: stiff posing, blur, text. Aspect ratio 3:2."
  • "Fashion editorial of a model in a flowing red dress on a windswept rooftop at golden hour, dramatic city skyline behind, hair caught in motion, low backlit sun creating a rim glow, 70mm lens, high-fashion magazine style, bold and confident mood. Negative: extra limbs, watermark, dull lighting. Aspect ratio 4:5."

社交媒体:

  • "Flat-lay of an iced matcha latte, a notebook, and sunglasses on a pastel pink surface, bright even overhead lighting, top-down 50mm view, vibrant trendy Instagram aesthetic, fresh and playful mood, crisp detail. Negative: shadows, clutter, text. Aspect ratio 1:1."
  • "Vertical full-body shot of a streetwear influencer leaning on a graffiti wall, oversized hoodie and chunky sneakers, soft overcast daylight, 35mm lens, urban editorial style, cool and effortless mood, high detail. Negative: blur, distorted shoes, watermark. Aspect ratio 9:16."

如果你更习惯一句自然语言而非结构化串,Text to Photo 能把朴素描述直接渲染出来,这是在加润色之前,验证“主体+场景”是否清楚的快捷方法。

弱 vs 强:一次有效的升级到底长什么样?

学习写 prompt 的最快方法,是把弱 prompt 与强化版本并排看。下面每一行都解释了原句为何不给力,以及如何修复。

弱 prompt问题出在哪强 prompt
一只狗没有属性、没有场景、没有光线;模型会凭空乱猜海滩上湿黑色拉布拉多中途抖水,低下午阳逆光,70mm 镜头,浅景深,动感氛围
美女肖像“Beautiful” 是主观填充;没有年龄、光线或取景指引30 多岁女性半身头像,柔和自信微笑,中性灰背景,左侧窗光,85mm 镜头,专业商务人像,4:5
白底产品照过于泛;没交代材质、光线或镜头,因此像扁平素材剪贴画琥珀玻璃护肤瓶配哑黑泵,置于湿润抛光水泥中央,柔和顶光棚拍,100mm 微距镜头,高端极简电商风,1:1
漂亮的风景无地点、无时间、无构图;输出就是可被遗忘的平均值薄雾晨曦的高山湖面,雪峰倒影静水中,金色时刻光穿过低雾,广角 24mm 镜头,宁静氛围,16:9
高质量美食照片,细节丰富,专业把“质量”词叠满,却没给出具体主体或场景手工巧克力棒叠放在牛皮纸与质朴木板上,撒可可豆碎,暖侧光,50mm 镜头,温馨生活方式美食摄影,4:5
酷炫的夜晚城市模糊的氛围词且没细节;光线与地点交给运气黄昏窄石板巷,橱窗泛光,湿石反射琥珀路灯,细雨,35mm 镜头,电影感氛围,16:9

最常见的 prompt 失误有哪些?

  • 堆“质量”词。“best、amazing、ultra high quality、professional”只会添噪,不给方向。用场景描述替代它们。
  • 自相矛盾。“minimalist but highly detailed maximalist”会逼模型在相反目标间取平均。
  • 跳过光线。光线对真实感与氛围的影响几乎最大;缺光线的 prompt 往往发闷、发平。
  • 忽视负面 prompt。总遇到文字覆盖、额外手指或过饱和,就把它们显式排除。
  • 忘了长宽比。风景硬塞成方图会浪费最佳构图;有意识地设定取景框。
  • 一条 prompt 塞太满。二十个互相打架的细节只会制造混乱。先写要点,再通过迭代加精度。
  • 主体太虚。“a person”让模型无处着力;指明年龄、服装、表情与姿态。

不用重骰,如何把结果修到位?

当生成已经达成 90% 时,克制住“推倒重来”的冲动。重骰会把你喜欢的部分一并丢掉。取而代之,要有意识地精修。

  • 先定位问题。准确命名哪里不对:“手部变形”“色温太冷”“背景太杂”。
  • 只改一句。仅编辑与问题相关的那一段 prompt 再生成;与上一版并排比对。
  • 用负面 prompt 做减法。把不想要的元素加进负面里,而不是重写整段。
  • 直接修成片。很多工具支持只修一个元素,比如换背景、去物体或重打光,这样你能保留已经满意的构图,而不是押注重新开一把。

当问题是“局部”的,而其余画面都不错时,编辑胜过重骰。只有在“核心概念”错了的时候才重写主 prompt。想看从首条 prompt 到最终修片的完整流程,请参考 AI 图片生成器指南。

串起来,这个循环很简单:写结构化 prompt → 生成 → 定位一个问题 → 用编辑或单变量修改修复 → 重复。这个纪律,是把偶然走运变成稳定高质出图的分水岭。

来源

  1. 01Text-to-image model (overview)Wikipedia (访问于 2026-06-01)
  2. 02Prompt engineeringWikipedia (访问于 2026-06-01)
  3. 03Diffusion modelWikipedia (访问于 2026-06-01)

常见问题

AI 照片 prompt 的基础公式是什么?
主体,然后是关键属性、场景、光线、相机/镜头/风格、氛围与技术限定,按重要性递减。另写一条负面 prompt 用于排除,并设置长宽比作为取景框。
更长的 prompt 一定更好吗?
不。具体性胜过长度。由具体名词与果断修饰词组成的短 prompt,通常优于堆满空泛溢美之词的长 prompt。力求每个词都能改变画面。
什么是负面 prompt?
让 AI 图片生成器避开的元素清单,例如模糊、额外手指、文字、水印或过饱和。它是去除反复出现问题的最快方式,而不必重写主 prompt。
我该用什么长宽比?
与投放场景匹配:1:1 用于方形贴文,4:5 用于竖版信息流与人像,16:9 用于风景与横幅,9:16 用于故事与短视频。有意识地设定,避免尴尬裁切。
为什么我的 AI 照片看起来平或普通?
通常是光线描述缺失或薄弱,加上主体过于模糊。添加具体光线,比如柔和窗光或黄金时段逆光;并描述主体属性、场景,以及一种相机或镜头风格。
如何高效迭代一个 prompt?
一次只改一个变量。其他全部锁定,包括 seed(如果工具提供),这样你能准确看到每次编辑的作用。按阶段细化:先构图,再光线,然后风格,最后氛围。
该重骰还是编辑成片?
当问题是局部、其余良好时,用编辑:比如修背景、去物体或重打光。只有当核心概念错了才重骰。编辑能保住你已经喜欢的构图。
这些示例 prompt 能保证特定结果吗?
不能。它们是指向目标外观的模板与脚手架。输出会随工具、模型与设置而变,所以把它们当强力起点,然后继续细化。
有工具能帮我写 prompt 吗?
有。AI Prompt 生成器能把一句短想法搭成完整的结构化 prompt;Text to Photo 允许你直接从朴素句子开始。两者都是在加润色前,验证主体与场景是否清晰的好方法。
影响画质最大的单一杠杆是什么?
光线,其次是具体的主体。指明光源、方向与时间,对真实感与氛围的提升几乎胜过 prompt 里的任何其他片段。

撰稿

LaFoto 编辑团队

LaFoto 编辑团队撰写 AI 照片生成的指南与对比,所有论断均有来源支撑,不编造。

继续阅读

今天就开始创作

用最佳 AI 图像生成器生成你的第一张图。

用一句话在数秒内生成成片、逼真的图像——随后精修每个细节。无需配置、无需 Discord、无需 GPU。

加入 4,200+ 位创作者正在使用 LaFoto

关于本指南

作者
LaFoto 编辑团队
基于
我们自己的测试,不抄二手文章
模型建议
有时效性,因为行为会变
赞助
否 — 无付费植入
勘误
直接在页面更新
复核
模型变更时重新检查

实操

在你写的每条 prompt 里,顺序永远比长度更重要

模型会更重视前面的词。用三句心情铺垫、第四句才点到主体,生成的图就会围着“心情”打转。主体、场景、光线、镜头——按这个顺序,能修好的失败 prompt 比任何单一改动都多。

超过大约五十词就开始递减。多出来的形容词会相互打架,模型会把它们取平均,所以超长 prompt 通常比中等长度更寡淡。

温暖纸上的手写清单,旁边三张仅光线不同的小幅打印

三种切入

练习这套方法

先把顺序摆正

先把主体、场景、光线、镜头写成四个独立分句,再去推敲措辞。多数 prompt 是输在编排,不是输在词汇。

  • 主体永远在最前。
  • 一个场景、一种光、一个镜头。
  • 删掉一切描述感受的词。
AI 生成的产品场景,带道具与可控阴影

细节

本指南解决的 prompt 难题

反复出现的失败,以及它们的成因。

图片无视了半个 prompt

分句互相抢戏太多。收敛到一个主体、一个场景、一个光源。

每张都一个样

全是氛围,没有物料。把情绪词换成物理词。

文字生成成了乱码

大多数模型把文字学成了纹理而非符号。排字要用能处理文本的模型。

脸看起来像塑料

明确要求可见的皮肤纹理与毛孔;模型默认会把皮肤修得很体面。

复现不了某个结果

没有 seed 就不行。把它和 prompt 一起记录。

AI 生成的棚拍人像,配以柔和包裹光

相关

把这套方法用起来

继续探索

在哪练这套方法

这里所有功能面都能用同一套 prompt 结构。