可灵AI生成图片需遵循“主体+场景+控制项”三要素结构:主体要明确视觉特征,场景需具体空间关系,控制项须含画幅、风格或负向提示,缺一则结果易失控。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想让可灵AI生成一张符合预期的图片,但输入“一只猫在窗台晒太阳”后出来的却是橘猫蹲在水泥地上、窗外是阴天——这说明提示词缺了关键结构层,模型无法锁定主体细节、环境质感和视觉风格。
核心三要素:主体+场景+控制项
第一步:写清主体及其关键视觉特征。不能只说“猫”,要写“一只蓝眼银渐层英短,坐姿端正,胡须清晰,鼻头粉润”。五官、毛色、姿态、质感都得点到,否则AI会随机补全。
第二步:绑定具体场景与空间关系。“窗台”太模糊,必须明确为“老式木框飘窗,窗台铺靛蓝粗麻布垫,左侧有半开的蕾丝窗帘,窗外可见梧桐枝影投在墙面”。背景不是可有可无的陪衬,而是构图锚点。
第三步:加入至少一项控制项。比如画幅选“9:16竖版”,风格写“胶片质感+富士C200扫描效果”,或加负向提示“no text, no logo, no deformed paws”。这一步不加,AI大概率按默认参数自由发挥,结果失控。
进阶结构:五段式提示词公式
方法一:基础扩展式(适合新手)
主体描述 + 场景描述 + 镜头语言 + 光影氛围 + 风格限定
例:“青衫女子执团扇立于曲桥栏杆旁,桥下流水泛光;中景平视拍摄;柔光漫射,柳絮微浮;宋代工笔重彩风格,矿物颜料晕染感”
方法二:权重锚定式(适合调优)
用括号标注重点项权重,如“(银发:1.3)、(琉璃耳坠:1.5)、(背景虚化:1.2)”,数值越高,AI越优先还原该特征。注意【权重总和不要超过5.0,否则模型会过载失焦】。
方法三:负向拦截式(防翻车必备)
在提示词末尾用英文逗号分隔,追加“no modern clothing, no digital noise, no extra limbs, no watermark”。这能直接屏蔽掉高频出错项,比正向描述更高效。
必须校验的四个字段对
① 服装材质 ↔ 背景材质(如“丝绸长裙”需匹配“檀木案几”或“素纱帷帐”,不能配不锈钢台面)
② 光源方向 ↔ 投影逻辑(若写“侧逆光”,人物右肩亮则左脸必有阴影,AI生成时若左右反了,说明提示词没锁死光源)
③ 身体部位编号 ↔ 动作指向(“左手轻抚右腕”比“手放在手腕上”更可控,编号能防止AI混淆左右)
④ 色系关键词 ↔ 传统色名(写“中国红”不如写“朱砂+钛白调和”,前者AI可能转成RGB#FF0000荧光红)


















