“一个水晶吊灯掉下来,老板很震惊”这类口语描述虽然意思清楚,但缺少主体位置、动作瞬间、环境、镜头和光线。使用“描述精炼器”提示词,可以让 AI 保留原意,把简短中文或英文想法改写成更适合 Midjourney 的专业画面描述。
与结构化公式的区别:结构化公式适合检查五类画面要素;描述精炼器更适合快速处理一句口语想法,重点是具体化和视觉化。
一、可直接复制的对话提示词
你是一名 Midjourney 描述精炼器。请把用户提供的口语描述,改写成具体、清晰、可视觉化的英文提示词。
处理原则:
1. 严格保留原始主体、动作、情节和关系,不擅自改故事;
2. 把抽象词转化为可见信息,例如表情、姿势、材质、颜色、光线和环境反应;
3. 按“主体+动作+环境+关键细节+镜头构图+光线色彩+媒介或风格”的顺序组织;
4. 使用准确的英文名词和形容词,删除“请生成、帮我画、超高质量、最好看”等无效表达;
5. 不模仿在世艺术家,不直接复制受保护的影视、动漫或游戏角色;改用可观察的视觉特征描述;
6. 未经用户要求,不添加文字、水印、Logo、品牌和无关人物;
7. 参数放在末尾,只添加用户明确要求且当前兼容的参数。
如果信息不足,请先询问最多 3 个问题:
- 主体是什么、正在做什么?
- 希望什么媒介或画面风格?
- 需要什么画幅比例或镜头?
输出格式:
一、原描述中的有效信息
二、需要补充或转换的视觉信息
三、精简英文提示词
四、增强英文提示词
五、参数说明
首次回复请说:
“请发给我一句中文或英文画面描述,并告诉我画幅比例和想要的媒介;我会保留原意,把它精炼成两条 Midjourney 提示词。”
二、实际优化示例
原始描述包含水晶吊灯、坠落动作、七位数价值、公司 CEO、震惊表情和戏剧光线。AI 将这些信息重新组织为主体、动作、象征意义、人物反应、场景与构图:

优化后的提示词比原始关键词更完整,但仍需注意:静态画面无法直接表现“价值七位数”,除非通过环境、材质、展示牌或上下文建立含义;不要让 AI 把抽象价值自动写成画面文字。
三、输入示例
原始描述:一盏昂贵的水晶吊灯突然从会议室天花板坠落,客户公司的 CEO 震惊地后退。
媒介:电影剧照式写实摄影
镜头:中远景,低机位
环境:高端企业会议室
画幅:16:9
要求:定格在吊灯即将落地的瞬间,不出现文字和受伤画面。
四、一个更准确的英文结果
A massive crystal chandelier frozen mid-fall inside an elegant corporate conference room, individual crystal strands scattering light as the client company's CEO steps backward with a startled expression, tense body language, polished stone table and floor-to-ceiling windows, dramatic side lighting, low-angle medium-wide shot, cinematic realism, crisp material detail, no injuries, no text --ar 16:9 --raw
五、常见错误
- 只加形容词:“华丽、震撼、史诗、杰作”并不能替代明确的动作和场景。
- 改变原意:原描述是“即将掉落”,不要自动改成“已经砸毁房间”。
- 写不可见信息:声音、价格和心理活动需要转换为姿势、表情或环境线索。
- 参数写在中间:参数应统一放到提示词末尾。
- 套用旧模板:不要固定附加旧版本号或已经不适用的参数写法。
六、继续优化的追问
请保留原始情节,分别输出 3 个镜头版本:
1. 低机位中远景,突出吊灯坠落的空间关系;
2. 人物近景,突出 CEO 的震惊表情和反光;
3. 俯拍全景,突出会议室布局和人物站位。
每条都使用同一场景、同一人物与同一时刻,只改变机位和构图。
Midjourney 官方提示指南强调具体主体、环境、光线、颜色、情绪和构图。描述精炼的重点不是无限扩写,而是把真正影响画面的信息写清楚。参考:Midjourney Prompt Basics。
THE END













![[录制]-项目视频均由(钱钱)本人亲自整理/测试/编辑
互联...-一尺涵知](https://www.yhanzhi.com/wp-content/uploads/2026/01/哆啦a梦主题_分类封面图.jpg)


