必须走对入口、写对提示词、调准参数才能生成可商用写实图:App或网页端进入AI创作→用五层结构法或一句话模板写提示词→CFG设5.5–6.5、步数选25或50→本地部署Z-Image可直出无水印图。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想用千问AI生成一张能当证件照用的写实人像,或者一张可直接印刷的街景照片,但输入“高清写实”后出图还是带明显AI味——不是模型不行,而是没用对入口、提示词结构和参数组合。
确认走对入口:别在聊天框里喊“画一张”
千问AI的文生图能力只在特定路径下激活,普通对话框默认调用文本模型,输入再详细的描述也只会返回文字解释,不会出图。
App端:打开最新版「千问」App(图标是蓝色渐变圆环,版本≥6.2.0)→点右上角「+」→「AI创作」→选「图片生成」
网页端:访问 https://wanxiang.aliyun.com →用阿里云账号登录 →点击左侧导航栏「文本生成图像」
【必须跳过普通聊天界面,否则所有提示词都无效】
写对提示词:动词开头 + 主体具象 + 光影材质三要素缺一不可
方法一:五层结构法(适合要精准控制的场景)
第一步:以明确动词开头,如“请生成”“帮我绘制”“生成一幅”
第二步:锁定主体,不说“美女”,说“30岁亚洲女性,齐肩黑发,穿米白色高领针织衫”
第三步:加一项物理级特征,例如“侧光打在左脸颊,皮肤呈现自然皮脂反光”或“衬衫袖口有细微毛边与纤维褶皱”
第四步:指定风格词,用“胶片摄影”“85mm定焦虚化”“富士Velvia胶片色调”等真实存在术语,不用“高级感”“氛围感”
第五步:补画质参数,“8K超清”“1024×1536像素”“无压缩PNG输出”
方法二:一句话快写法(适合试稿或日常快速出图)
直接套用这个模板:“请生成一张[主体]在[场景]中,[光线+材质+镜头]效果,[风格],[分辨率]”
例:“请生成一张戴银丝眼镜的程序员坐在落地窗前敲代码,午后斜阳透过百叶窗在键盘上投下条纹光影,哑光西装面料质感,佳能EOS R5直出风格,1024×768像素”
这一步操作起来很简单,直接把这句话复制粘贴进提示词框就行。
调准关键参数:CFG值和步数决定写实成败
尺寸比例:头像用1:1,海报用9:16,印刷用A4竖版(210×297mm对应1754×2480像素)
CFG Scale(提示词相关性):写实类必须设为5.5–6.5。低于5.5容易跑偏成卡通,高于6.8会导致边缘生硬、皮肤纹理塑料化
推理步数:Turbo(9步)仅用于构图测试;Standard(25步)满足日常写实需求;Quality(50步)专用于人脸毛孔、布料经纬线、玻璃折射等细节强化
风格强度滑块:写实类建议保持默认值(60–70),拉太高反而会叠加非物理光影;古风/手绘类才需提到85–95
注意:生成第一张图后,如果发现皮肤发灰,立刻回退调整——把CFG从6.5降到6.0,同时把步数从25升到35,比重新写提示词更有效。
本地部署Z-Image:RTX 4090用户绕过云端直出写实图
如果你有RTX 4090显卡,且对千问网页端出图速度或隐私有顾虑,可跳过所有在线流程:
下载造相-Z-Image镜像包 → 解压到任意文件夹 → 双击运行start.bat(Windows)或./start.sh(Linux)
等待控制台显示“✅ 模型加载成功 (Local Path)” → 浏览器自动打开 http://localhost:8501
在左侧提示词框输入中文描述,例如:“一位穿靛蓝工装裤的快递员站在雨中的老式居民楼下,头发微湿,手里拎着保温餐箱,背景有模糊的梧桐树和褪色红砖墙,iPhone 15 Pro主摄直出风格”
点击“生成”按钮,4–20秒后右侧预览区即显示结果,支持一键下载无水印PNG

















