Midjourney生成角色设定图的关键是明确叙事功能、植入唯一视觉钩子、用解剖级术语描述特征,并显式声明比例与材质逻辑,避免模糊形容词和中英文混杂。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

用Midjourney生成符合剧情需要的人物角色设定图,关键不是堆砌形容词,而是让AI理解角色在故事中的功能、视觉锚点与可信细节。
先锁定角色核心身份与叙事功能
第一步:用「职业/身份 + 关键行为动词 + 所处场景」结构写基础提示。例如:「cyberpunk street medic → kneeling beside a wounded drone operator in rain-slicked neon alley」。这比「cyberpunk woman doctor」更易触发具象画面,因为AI对动作和环境的响应远强于抽象头衔。
第二步:剔除模糊修饰词。删掉「beautiful」「cool」「epic」这类无指向性词汇——它们不提供构图线索,反而稀释权重。Midjourney会把算力浪费在猜测你所谓的“cool”到底指皮衣剪裁还是眼神锐度。
第三步:插入1个不可替代的视觉钩子。比如「wearing cracked AR glasses reflecting emergency HUD」或「left hand replaced with salvaged clockwork prosthetic」。这个细节必须同时承载角色背景(为何有义肢)、世界观线索(技术水准)、情绪暗示(是否自愿改装)。【没有这个钩子,角色图极易沦为模板化人像】
控制外貌特征的精准表达方法
方法一:用解剖级名词替代风格化描述。不说「sharp facial features」,而说「high zygomatic arches + deep-set eyes + pronounced mandibular angle」;不说「messy hair」,而说「asymmetrical undercut with 3cm regrowth at temples」。AI训练数据里存在大量医学绘图和发型数据库,这类术语触发精度更高。
方法二:绑定特征与状态。避免单独写「scar on cheek」,改写为「old knife scar pulling at right嘴角 when speaking」——动态牵拉关系让疤痕成为活体的一部分,而非贴图。同理,「tattoo of wilted rose」不如「tattoo of wilted rose, ink slightly blurred where skin folds at elbow」。
方法三:用材质对比制造记忆点。例如「worn leather duster → frayed hem stitching exposed → inner lining patched with mismatched denim」。三层材质叠加既交代使用痕迹,又暗示角色经济状况与性格(不扔旧衣但会动手修)。
规避常见失效陷阱
不要用「in the style of」强行指定画风。Midjourney v6 对风格指令敏感度下降,反而容易导致角色变形。正确做法是用「film grain + Kodak Portra 400」这类真实胶片参数替代「anime style」,用「oil painting texture → visible brushstroke direction following muscle contours」替代「painterly」。
拒绝中英文混杂关键词。像「cyberpunk girl → wearing hanfu + neon lights」会因文化符号冲突导致构图撕裂。若需融合元素,必须建立逻辑链条:「Neo-Shanghai street vendor → modified Ming dynasty collar jacket → circuitry embroidery tracing meridian lines」。
人物比例必须显式声明。默认情况下AI倾向生成9头身超模比例,但写实向角色常需「8.5 head height + slight scoliosis posture」或「7.2 head height + exaggerated hands for artisan work」。缺少这句,再精细的服装纹理也救不回失真的肢体结构。


















