作者: 南鸢 nuyoah @nanyuan0412

写 Midjourney 摄影类提示词时,很多人会本能地往里面塞一大堆看似专业的参数:
Canon EOS R5, 85mm, f/1.4, ISO 100, 1/4000s, anamorphic lens, cinematic lighting……其实这些参数看起来很专业,但是生成的结果却不一定是能符合我们心中的想法的。
其实我认为这是和 Midjourney 的训练机制有关系的。
🎯 这篇文章只解决一个核心问题:
怎么把一条 MJ V8 摄影类 Prompt 写得清清楚楚、所见即所得。
其实官方对 Prompt 的核心建议仍然很直接:描述你想看到的内容,尽量具体、简洁,不要把提示词写成冗长的指令清单。
所以,比“把摄影参数填完整”更重要的是:先把最终想看见的画面说清楚。
MJ V8 摄影 Prompt 黄金六步法
这 6 个模块不是意味着每次都必须硬填满,而是意味着你可以从这几个维度开始构思与排查。
主体也不一定非要是人。如果你在一幅画面中想以场景为主体,那么你就应该要把场景前置,不要用大量的描述词去详细描绘人。
因为你描述词过多地描写人之后,就会导致人的权重变高,模型就会去详细地刻画人脸和衣服,从而你就达不到原本想要的大远景效果。
这个主体不一定是人,也可以是一辆车、一栋建筑、一艘船,甚至是整个远景。
写的时候可以先进行判断:
💡 先确定人物,再补充服装、动作和环境,画面自然会紧紧围绕这个女人展开。
💡 最先出现的是火车站、薄雾和站台。女人只是场景中的一个视觉落点,而不是占满画面的主角。
如果明明想要一个大远景,却花大量篇幅描述人物的五官、发型和表情,Midjourney 更可能把人物当成重点,进一步刻画人物,最后得到的就可能是人物近景,而不是你原本想要的大环境画面。
💡 黄金法则:
你最想让观众看到什么,就先写什么。 主体确定以后,再把属于它的信息放在旁边。人物的服装表情跟着人物写;场景的天气空间跟着场景写。不要把所有词拆散乱堆,否则模型无法建立从属关系。
主体确定以后,下一步不是选相机型号,而是决定人物在画面里有多大、摄影机处于什么观察机位。
| 英文术语 | 中文景别 | 画面倾向与适用场景 |
|---|---|---|
| close-up | 特写 | 人脸或局部占据大部分画面,强调表情、眼眸与极近细节。 |
| medium shot | 中景 | 半身或大半身,兼顾人物动作、服装质感与环境氛围。 |
| wide shot | 宽景 / 远景 | 展示完整全身人物与周围环境,强调人与空间的宏大关系。 |
| 英文机位 | 中文角度 | 画面倾向与视觉心理 |
|---|---|---|
| low angle | 低机位仰拍 | 视角向上仰望,人物显得高大威严、更有力量感与体量。 |
| eye-level | 平视视角 | 自然、中性,最接近日常人眼观察,亲和力高。 |
| over-the-shoulder shot | 过肩镜头 | 越过一个人的肩膀拍另一人,电影中最常用于对话与对峙关系。 |
⚠️ 新手最容易混淆的两个概念:wide shot vs wide-angle lens
wide shot 说的是画面拍到了多少内容(景别);而 wide-angle lens 说的是镜头带来的透视变形与空间拉伸感(光学镜头)。一张图完全可以用长焦拍远景(比如远处的群山小船),也可以用广角拍人物近景(比如夸张大头贴)。它们控制的是两个完全不同的维度。
人像摄影黄金焦段。浅景深柔美虚化,背景被温和压缩拉近,面部五官比例极度端正自然,人物立体脱离背景。
在 Midjourney 里,更实用的理解方式不是把镜头词当成严格执行的光学参数,而是先问:它通常会让画面看起来怎样?
画面范围更开阔,近处显得更大,远处显得更小,空间纵深更明显。适合建筑、室内、大环境中的人物与夸张透视。
画面范围更窄,前后景看起来更接近,背景更容易形成层叠和压缩感。适合人像、特写与让人物从背景中剥离的画面。
极端广角、弯曲直线和强烈球面感。常见于极限滑板运动、街头监控视角与故意追求怪诞视觉冲击的画面。
横向拉长的耀斑、椭圆光斑散景与宽银幕电影质感。它能强化已经成立的画面,却救不了一条主体混乱的 Prompt。
假设你想要一张柔和、背景虚化的人像。只写 f/1.4,模型往往不能很好地理解。不如直接把你想看到的光学效果写出来:
soft window light, shallow depth of field, softly blurred background想冻结高速动作,也不要只依赖 1/4000s,可以直接把真正想看到的结果写出来:
frozen action, crisp moving fabric, suspended raindropsmotion blur;想让前后景都清楚写 deep focus, clearly visible background details。优先写可见结果,摄影数字只做辅助。当主体、机位、镜头和光线都确定以后,再在尾部补充胶片、颗粒、色彩和成像质感。这比只写一个空泛的 cinematic 更具体:
subtle film grain, muted cinematic colors, soft highlight roll-off如果使用具体的经典老镜头名称,也建议把名称和可见效果写在一起:
Helios 44-2 look, swirling bokeh around the subject(八羽怪老镜头:主体四周独特的旋转散景)
Cooke look, warm skin tones, soft contrast, delicate highlights(库克电影镜头:温暖肤色与柔和反差高光)
中文负责把画面关系说准确,英文摄影词负责补充景别、机位和镜头倾向。 为了全英文而写出一条自己都无法检查的 Prompt,没有任何意义。
cinematic, masterpiece, Canon EOS R5, Sony A7R, ISO 100, 1/4000s, f/1.4, 85mm, beautiful woman, red coat, train station, rain, walking, dramatic, realistic, high detail
雨后的旧火车站台上,一名穿深红色风衣的年轻女性快步走向镜头,风衣下摆被风吹起,潮湿地面映出她的倒影。medium shot, eye-level perspective, telephoto lens, compressed background, shallow depth of field. 站台尽头透出柔和逆光,空气中漂浮着细小雨雾。muted cinematic colors, subtle film grain, soft highlight roll-off, realistic photography --ar 3:4 --raw --v 8.2
基于六步结构法,自由组合你的专属相机参数与画面视觉控制词
如果某个重要细节反复没有出现,不要立刻把整条 Prompt 加长,也不要把同一个词复制十遍。先依次尝试:
MJ 越靠前的词元享有越高的注意力权重。
不要把它当作句尾的定语,直接提升为主语核心。
用句号断开,给它独占的语义边界,避免被前后修饰词稀释。
例如写“雨滴停留在睫毛上”,而不是抽象的“雨天氛围”。
若依然遗漏,在尾部质感段落进行二次轻度呼应。
比如你想要的不是一个弹琴的人物特写,而是“远景、小船、抚琴”,就应该先把整个环境、完整船只和人物比例写清楚。人物的脸和服装细节写得越多,反而越容易把镜头拉近。
结构化 Prompt 的真正价值,不是保证每次都出神图,而是当生成结果不对时,你知道该改哪里:
人物太小,先检查景别;环境太抢,减少背景信息或把主体提前;空间没有纵深,再调整镜头感觉;光线不对,就修改光线段;质感太重,删掉多余的胶片词。