必须严格设置输出尺寸、宽高比、启用面部修复、选用DPM++ 2M Karras或Euler a采样器(20~30步)、CFG scale设为7~10,并在提示词中嵌入专业摄影参数锚点及镜头描述,否则易致人脸畸变、肢体拉伸或细节糊化。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要让Stable Diffusion生成符合人像摄影标准的图像,必须严格控制输出格式参数,否则即使提示词精准,也会因分辨率错配、宽高比失真或采样器不匹配导致人脸畸变、肢体拉伸或细节糊化。
设置基础输出尺寸与宽高比
打开WebUI界面,在“文生图”标签页右上角找到“Width”和“Height”输入框。人像摄影常用比例为4:5(手机竖屏肖像)、2:3(单反标准)、1:1(Instagram正方)或16:9(电影感横幅)。直接输入对应数值:4:5 → Width=832, Height=1040;2:3 → Width=832, Height=1248;1:1 → Width=1024, Height=1024。
【Width和Height必须同时手动输入,不能只改一个】。若仅调高Width而Height保持默认512,AI会强行拉伸人物躯干,造成“长腿矮头”现象。
点击“Generate”旁的“Restore faces”勾选框——这一步不是可选项,而是人像生成的硬性前提。它启用GFPGAN模型,在去噪末期专门修复面部结构,避免五官错位或眼睛大小不一。
选择适配人像的采样器与步数
在“Sampling method”下拉菜单中,优先选择DPM++ 2M Karras或Euler a。前者收敛稳定,对皮肤纹理和发丝过渡更柔和;后者响应快,适合快速试稿。避开DDIM和PLMS——它们在人像生成中易出现色块断裂与边缘锯齿。
将“Sampling steps”设为20~30。低于15步时,AI来不及充分解构面部骨骼结构,大概率生成模糊眼睑或粘连手指;高于40步则边际收益递减,且可能引入过度锐化噪声。
注意:“CFG scale”值建议固定在7~10之间。设为12以上时,AI会过度服从提示词字面意思,导致表情僵硬、嘴角不自然上扬;低于5则主体形变风险陡增,比如双耳不对称或单侧锁骨消失。
用提示词锁定摄影级输出格式
在正向提示词开头插入格式锚点:masterpiece, best quality, 8k, RAW photo, studio lighting, shallow depth of field, f/1.4, ISO 100, Canon EOS R5 —— 这串词强制模型进入“专业相机直出”语义空间,而非插画或CG渲染模式。
镜头描述必须紧随其后:medium shot(半身构图)或close-up(胸像),二者选其一。不要混用long shot和close-up,否则AI会在同一张图里同时压缩远景与放大面部,造成透视逻辑崩塌。
最后补一句物理设备约束:shot on Canon EOS R5, 85mm lens。这并非装饰性词汇,而是向文本编码器注入真实光学参数——焦距85mm是人像黄金焦段,能自然压缩背景、柔化过渡,模型会据此调整景深衰减曲线和散景形状。
负面提示词务必包含:deformed fingers, extra limbs, disfigured, bad anatomy, blurry, jpeg artifacts, lowres, text, error, cropped, worst quality, low quality, normal quality, jpeg artifacts。

















