Midjourney不理解自然语言语法,只识别逗号分隔的具象名词短语并按位置加权;主体须前置,避免连接词,--no仅过滤高频具象词根,参数须置末尾且删所有非必要标点。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

Midjourney 不按你写的提示词出图,根本原因不是你“不会写”,而是你默认用了自然语言思维去喂它——它根本不解析句子结构,只认关键词权重和位置顺序。
Midjourney不理解语法,只吃逗号分隔的短语
它没有 NLP 解析器,不会识别主谓宾、从句或修饰关系。写 “a woman who is holding a glowing sword under moonlight” 和拆成 “woman, glowing sword, moonlight, holding” 效果天差地别:前者多数词被弱化或忽略,后者每个短语都被平等加权扫描。
- 所有有效信息必须是独立名词性短语,比如
woman in red trench coat可以,但woman that looks tired and angry失效 - 形容词要绑定在名词前,
cracked porcelain doll有效,doll, cracked, porcelain, angry会把angry错配到其他元素上 - 避免连接词(and / but / with / who / which),它们不触发任何逻辑,纯属噪音
位置决定权重:越靠前,越主导画面
官方权重分配不是虚的——主体部分占约 40%,环境 30%,风格 20%,参数 10%。这意味着把 cyberpunk city 放最前面,哪怕后面跟十个“soft lighting, watercolor, gentle mood”,生成结果仍是赛博朋克底色。
- 想锁定主体?必须放在整个 prompt 最开头,且用具象名词短语,如
old Tibetan monk, deep wrinkles, turquoise prayer beads - 想压住风格漂移?别把
oil painting写在中间,挪到倒数第二位,紧挨参数,例如... --v 6.2 --s 700 - 如果同时写多个主体(如
cat, dog, robot),AI 会平均分配视觉注意力,大概率出三者混合怪体;真要多主体,得用--no排除干扰项
--no 不是否定句,而是黑名单过滤器
--no 后面接的不是描述,是「禁止出现的词根」。写 --no text, logo, watermark 有效;写 --no ugly, bad anatomy 基本无效——因为 “ugly” 不是 Midjourney 训练中可识别的视觉 token,“bad anatomy” 是复合判断,模型无法反向推导。
- 只对高频、具象、训练集中强关联的词起作用,例如
--no hands, fingers, signature, frame - 大小写敏感,
--no Human不等于--no human(小写才生效) - 不能否定抽象概念(
--no boring)、情绪(--no sad)或质量评价(--no low quality),这些无对应 latent 表征
参数必须放末尾,且不能混在文本里
像 --ar 4:5 或 --s 1000 这类指令,如果插在中间(如 woman --ar 4:5 in garden),Midjourney 会把 --ar 当作普通单词尝试渲染,结果可能冒出一个叫 “Ar” 的人或符号。
- 所有参数必须堆在 prompt 字符串最右端,且用空格分隔,例如
ancient library, floating books, dust motes, cinematic lighting --ar 16:9 --q 2 --s 800 -
--v模型版本必须显式指定,尤其跨版本时风格差异极大;--v 6.2对中文提示兼容性明显优于--v 5 -
--iw只在垫图(image prompt)场景下生效,纯文本 prompt 中写--iw 2完全无意义
最容易被忽略的是:Midjourney 对标点极度敏感——句号、问号、引号、括号都会干扰 token 切分,导致权重错乱。写完 prompt,务必删掉所有非逗号/空格的标点。这不是细节,是生效前提。


















