指南
如何写出真正有效的 AI 照片 prompt

强力 AI 照片 prompt 的结构是什么?
每个有效的 prompt 都由相同部件构成,按重要性从高到低分层。把它当作在给第一次合作的摄影师写 brief:先讲主体,再把世界搭起来。
- 主体:最重要的元素。“一只金毛幼犬”“一只陶瓷咖啡杯”“一位 60 多岁的女性”。
- 关键属性:让主体具象的限定。年龄、表情、服装、材质、颜色、姿态。
- 场景 / 环境:事情发生在哪里。“在被雨水打湿的城市街道上”“在大理石厨房台面上”“在雾气缭绕的松林里”。
- 光线:几乎是影响氛围与真实感的第一杠杆。“柔和窗光”“黄金时段的逆光”“戏剧性的棚拍轮廓光”。
- 相机、镜头与风格:“50mm 镜头拍摄”“浅景深”“社论时尚摄影”“胶片颗粒”。
- 氛围:情绪基调。“恬静安宁”“有活力、爱玩”“情绪化、电影感”。
- 技术限定:分辨率、细节与格式。“高细节”“锐利对焦”“4k”。
还有两项与主 prompt 并列的控制。负面 prompt 用来列出要避免的元素,例如“模糊、畸形手指、文字、水印、过饱和”。长宽比决定取景框:1:1 适合方形社媒贴文,4:5 适合竖版信息流,16:9 适合风景与横幅,9:16 适合故事与短视频。
你不必每次都写全所有层,但按这个顺序组织,AI 图片生成器就会按你的优先级理解意图。如果想省去手动结构化,AI Prompt 生成器能把一句短想法搭成完整 prompt。
为什么具体性胜过长度?
长 prompt 看起来周全,但长度不等于可控。一堵形容词墙常常自相矛盾,模型会把冲突取平均,结果变得混沌。具体的名词加少量果断修饰词,指向性更强。
对比“a beautiful amazing stunning gorgeous high quality professional photo of a nice dog”和“a wet black labrador shaking off water, mid-motion, backlit by low afternoon sun.”第二句更短,却给了 AI 图片生成器一幕清晰可建的场景。“beautiful”“high quality”这类空泛的溢美,描述的是你的期望,不是画面。
一个实用法则:每个词都该改变图像预期。删掉某个词如果不会改动你想看到的画面,那它大概率是填充。把“a nice background”换成“a blurred green park background”,你就把“愿望”换成了“指令”。
怎样迭代而不失控?
最常见的“擦肩而过”之后的错误,是重写整个 prompt。接着下一个结果在五个方面都变了,你也说不清哪一处起了作用。把写 prompt 当成对照实验:一次只改一个变量。
构图对了但光线寡淡,只改光线那句。氛围对了但主体服装不对,只改那条属性。其他全部保持一致,包括你的 seed(如果工具提供),这样你看到的差异才是你造成的差异。
- 第 1 轮:先把主体与构图定稳;暂时别抠润色。
- 第 2 轮:调整光线与时间。
- 第 3 轮:细化相机、镜头与风格。
- 第 4 轮:调氛围与色彩,然后锁定长宽比。
这种分段法能把像拉老虎机一样的挫败感,变成任何人都能复现的流程。
按使用场景,强力示例 prompt 长什么样?
这些是模板与脚手架,不是保证书。每个示例都展示了如何把结构套进具体任务。复制一条,把中括号里的细节换成你的,再继续迭代。不同工具与模型的输出会有差异,把它们当强力起点,不要当死方子。
人像:
- "Headshot of a woman in her 30s, natural makeup, soft confident smile, wearing a charcoal blazer, seated against a neutral grey backdrop, soft diffused window light from the left, shot on 85mm lens, shallow depth of field, professional corporate portrait, warm and approachable mood, sharp focus. Negative: harsh shadows, blemishes, text, watermark. Aspect ratio 4:5."
- "Environmental portrait of a male chef in a white jacket, mid-40s, arms crossed, standing in a busy stainless-steel kitchen with bokeh background, warm tungsten lighting with steam in the air, 35mm lens, documentary editorial style, candid and proud mood, high detail. Negative: blur, distorted hands. Aspect ratio 3:2."
产品摄影:
- "Amber glass skincare bottle with a matte black pump, centered on a wet polished concrete surface, single soft top-down studio light with a subtle gradient background, 100mm macro lens, clean minimalist e-commerce style, premium and calm mood, crisp reflections, high detail. Negative: clutter, text, fingerprints, harsh glare. Aspect ratio 1:1."
- "Stack of three artisan chocolate bars in kraft paper wrapping on a rustic wooden board, scattered cocoa nibs around, warm side lighting from the right with soft shadows, 50mm lens, shallow depth of field, lifestyle food photography, cozy and indulgent mood. Negative: plastic look, oversaturation, watermark. Aspect ratio 4:5."
风景与场所:
- "Misty alpine lake at sunrise, snow-capped peaks reflected in still water, lone wooden rowboat near the shore, soft golden-hour light breaking through low fog, wide-angle 24mm lens, deep focus, serene and expansive mood, fine detail. Negative: people, buildings, blur, oversaturation. Aspect ratio 16:9."
- "Narrow cobblestone alley in an old European town at dusk, warm glowing shop windows, wet stones reflecting amber streetlights, light rain, 35mm lens, cinematic moody atmosphere, nostalgic mood, high detail. Negative: modern cars, text signage, distorted perspective. Aspect ratio 16:9."
社论与生活方式:
- "Young couple laughing while cooking together in a sunlit modern kitchen, casual linen clothing, fresh vegetables on the counter, soft natural daylight from large windows, 35mm lens, candid lifestyle editorial style, warm and joyful mood, natural skin tones, high detail. Negative: stiff posing, blur, text. Aspect ratio 3:2."
- "Fashion editorial of a model in a flowing red dress on a windswept rooftop at golden hour, dramatic city skyline behind, hair caught in motion, low backlit sun creating a rim glow, 70mm lens, high-fashion magazine style, bold and confident mood. Negative: extra limbs, watermark, dull lighting. Aspect ratio 4:5."
社交媒体:
- "Flat-lay of an iced matcha latte, a notebook, and sunglasses on a pastel pink surface, bright even overhead lighting, top-down 50mm view, vibrant trendy Instagram aesthetic, fresh and playful mood, crisp detail. Negative: shadows, clutter, text. Aspect ratio 1:1."
- "Vertical full-body shot of a streetwear influencer leaning on a graffiti wall, oversized hoodie and chunky sneakers, soft overcast daylight, 35mm lens, urban editorial style, cool and effortless mood, high detail. Negative: blur, distorted shoes, watermark. Aspect ratio 9:16."
如果你更习惯一句自然语言而非结构化串,Text to Photo 能把朴素描述直接渲染出来,这是在加润色之前,验证“主体+场景”是否清楚的快捷方法。
弱 vs 强:一次有效的升级到底长什么样?
学习写 prompt 的最快方法,是把弱 prompt 与强化版本并排看。下面每一行都解释了原句为何不给力,以及如何修复。
| 弱 prompt | 问题出在哪 | 强 prompt |
|---|---|---|
| 一只狗 | 没有属性、没有场景、没有光线;模型会凭空乱猜 | 海滩上湿黑色拉布拉多中途抖水,低下午阳逆光,70mm 镜头,浅景深,动感氛围 |
| 美女肖像 | “Beautiful” 是主观填充;没有年龄、光线或取景指引 | 30 多岁女性半身头像,柔和自信微笑,中性灰背景,左侧窗光,85mm 镜头,专业商务人像,4:5 |
| 白底产品照 | 过于泛;没交代材质、光线或镜头,因此像扁平素材剪贴画 | 琥珀玻璃护肤瓶配哑黑泵,置于湿润抛光水泥中央,柔和顶光棚拍,100mm 微距镜头,高端极简电商风,1:1 |
| 漂亮的风景 | 无地点、无时间、无构图;输出就是可被遗忘的平均值 | 薄雾晨曦的高山湖面,雪峰倒影静水中,金色时刻光穿过低雾,广角 24mm 镜头,宁静氛围,16:9 |
| 高质量美食照片,细节丰富,专业 | 把“质量”词叠满,却没给出具体主体或场景 | 手工巧克力棒叠放在牛皮纸与质朴木板上,撒可可豆碎,暖侧光,50mm 镜头,温馨生活方式美食摄影,4:5 |
| 酷炫的夜晚城市 | 模糊的氛围词且没细节;光线与地点交给运气 | 黄昏窄石板巷,橱窗泛光,湿石反射琥珀路灯,细雨,35mm 镜头,电影感氛围,16:9 |
最常见的 prompt 失误有哪些?
- 堆“质量”词。“best、amazing、ultra high quality、professional”只会添噪,不给方向。用场景描述替代它们。
- 自相矛盾。“minimalist but highly detailed maximalist”会逼模型在相反目标间取平均。
- 跳过光线。光线对真实感与氛围的影响几乎最大;缺光线的 prompt 往往发闷、发平。
- 忽视负面 prompt。总遇到文字覆盖、额外手指或过饱和,就把它们显式排除。
- 忘了长宽比。风景硬塞成方图会浪费最佳构图;有意识地设定取景框。
- 一条 prompt 塞太满。二十个互相打架的细节只会制造混乱。先写要点,再通过迭代加精度。
- 主体太虚。“a person”让模型无处着力;指明年龄、服装、表情与姿态。
不用重骰,如何把结果修到位?
当生成已经达成 90% 时,克制住“推倒重来”的冲动。重骰会把你喜欢的部分一并丢掉。取而代之,要有意识地精修。
- 先定位问题。准确命名哪里不对:“手部变形”“色温太冷”“背景太杂”。
- 只改一句。仅编辑与问题相关的那一段 prompt 再生成;与上一版并排比对。
- 用负面 prompt 做减法。把不想要的元素加进负面里,而不是重写整段。
- 直接修成片。很多工具支持只修一个元素,比如换背景、去物体或重打光,这样你能保留已经满意的构图,而不是押注重新开一把。
当问题是“局部”的,而其余画面都不错时,编辑胜过重骰。只有在“核心概念”错了的时候才重写主 prompt。想看从首条 prompt 到最终修片的完整流程,请参考 AI 图片生成器指南。
串起来,这个循环很简单:写结构化 prompt → 生成 → 定位一个问题 → 用编辑或单变量修改修复 → 重复。这个纪律,是把偶然走运变成稳定高质出图的分水岭。
来源
- 01Text-to-image model (overview) — Wikipedia (访问于 2026-06-01)
- 02Prompt engineering — Wikipedia (访问于 2026-06-01)
- 03Diffusion model — Wikipedia (访问于 2026-06-01)
常见问题
- AI 照片 prompt 的基础公式是什么?
- 主体,然后是关键属性、场景、光线、相机/镜头/风格、氛围与技术限定,按重要性递减。另写一条负面 prompt 用于排除,并设置长宽比作为取景框。
- 更长的 prompt 一定更好吗?
- 不。具体性胜过长度。由具体名词与果断修饰词组成的短 prompt,通常优于堆满空泛溢美之词的长 prompt。力求每个词都能改变画面。
- 什么是负面 prompt?
- 让 AI 图片生成器避开的元素清单,例如模糊、额外手指、文字、水印或过饱和。它是去除反复出现问题的最快方式,而不必重写主 prompt。
- 我该用什么长宽比?
- 与投放场景匹配:1:1 用于方形贴文,4:5 用于竖版信息流与人像,16:9 用于风景与横幅,9:16 用于故事与短视频。有意识地设定,避免尴尬裁切。
- 为什么我的 AI 照片看起来平或普通?
- 通常是光线描述缺失或薄弱,加上主体过于模糊。添加具体光线,比如柔和窗光或黄金时段逆光;并描述主体属性、场景,以及一种相机或镜头风格。
- 如何高效迭代一个 prompt?
- 一次只改一个变量。其他全部锁定,包括 seed(如果工具提供),这样你能准确看到每次编辑的作用。按阶段细化:先构图,再光线,然后风格,最后氛围。
- 该重骰还是编辑成片?
- 当问题是局部、其余良好时,用编辑:比如修背景、去物体或重打光。只有当核心概念错了才重骰。编辑能保住你已经喜欢的构图。
- 这些示例 prompt 能保证特定结果吗?
- 不能。它们是指向目标外观的模板与脚手架。输出会随工具、模型与设置而变,所以把它们当强力起点,然后继续细化。
- 有工具能帮我写 prompt 吗?
- 有。AI Prompt 生成器能把一句短想法搭成完整的结构化 prompt;Text to Photo 允许你直接从朴素句子开始。两者都是在加润色前,验证主体与场景是否清晰的好方法。
- 影响画质最大的单一杠杆是什么?
- 光线,其次是具体的主体。指明光源、方向与时间,对真实感与氛围的提升几乎胜过 prompt 里的任何其他片段。
撰稿
LaFoto 编辑团队撰写 AI 照片生成的指南与对比,所有论断均有来源支撑,不编造。



