讲师中心 微信公众号
AI工具推荐 视频效率加速

腾讯混元文生图生成的主体被裁切怎么办

风雪酱_8572

风雪酱_8572

发布时间:2026-10-05 07:29:30

|

994人浏览过

|

来源于php中文网

原创

腾讯混元文生图主体被裁切主因是提示词未明确构图约束,解决方法包括:一、Prompt末尾添加“全身入镜”等中文构图指令;二、复杂主体叠加空间锚点如“头顶与上边缘留白≥10%”;三、用局部重绘或对象替换补全;四、API中显式设置AspectRatio与ImageSize参数。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

腾讯混元文生图生成的主体被裁切怎么办

腾讯混元文生图生成的主体被裁切,通常不是模型“故意切掉”,而是提示词未明确约束构图边界、或未声明主体在画面中的完整呈现需求,导致模型按默认比例和焦点逻辑生成——它可能把人物腰部以上当“主体”,也可能把建筑顶部当“视觉重心”,结果你想要全身像,输出只有半截腿。

用Prompt强制指定主体完整性

第一步:在原始描述末尾追加构图类指令,例如“全身入镜”“完整显示”“人物完整站立,双脚可见”“无裁切”“完整构图”等短语。

第二步:优先使用中文原生表达,避免直译英文术语。实测“全身入镜”比“full body shot”触发率高,“双脚踩在地面”比“feet on ground”更稳定——混元3.0对这类具象动词+方位词组合的理解经过专项中文语料强化。

第三步:若主体是多人或复杂结构(如带底座的雕塑、带飘带的旗子),需叠加空间锚点。例如:“三个人并排站立,全部脚踩地面,头顶与画面上边缘留白≥10%”——这个留白比例不是精确数值,而是向模型传递“别顶天立地”的信号,【不写留白要求,模型常默认填满画布】。

用参考图+局部重绘补全被切部分

方法一:上传原图→点击“局部重绘”→用画笔圈出被裁区域(如缺失的腿部、飘出画外的衣袖)→输入指令“补全下半身,穿同款牛仔裤,双脚站立在地面”。

腾讯混元
腾讯混元

腾讯混元是由腾讯公司推出的通用大语言模型与AI助手产品,基于自研的混元大模型体系打造,提供智能问答、内容生成、代码辅助、办公写作、知识检索等能力。用户可以通过网页端、移动端等方式使用,用于学习、工作和内容创作等多种场景。

下载

方法二:若原图无可用,直接用混元图生图功能重建缺失部分。上传一张仅含该主体上半身的图→选择“对象替换”模式→指令写“保持上半身不变,生成完整下半身,姿态一致,服装连贯”——这一步依赖混元3.0的跨区域一致性建模能力,【必须关闭Prompt自动扩写(Revise=0),否则模型可能擅自修改上半身】。

调整API参数规避默认裁切逻辑

提交任务时,在请求体中显式设置 AspectRatio 参数为“1:1”“4:3”或“16:9”等具体值,而非留空或传“auto”。混元生图3.0默认采用动态长宽比推断,容易因提示词中“仰拍”“特写”等词倾向窄高构图,从而切掉底部。

若需严格控制主体位置,启用 ControlNet 的 Pose 控制(需传入人体关键点图)或 Depth Map(需预生成深度图)。但这需要本地预处理,适合批量生产场景,单次修图不推荐。

最后检查 ImageSize 参数是否与预期输出尺寸匹配。例如设为1024×1024却要求“远景全景”,模型会优先保细节而压缩主体范围——此时应改用1024×768并强调“水平构图,完整展现”。

热门AI工具

更多
WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

LibLibAI
LibLibAI Hot

一款AI视频创作工具,主要用于国内领先的AI创意平台,以海量模型、低门槛操作与“创作-分享-商业化”生态,让小白与专业创作者都能高效实现图文乃至视频创意表达,适合需要提升相关任务效率的用户。

UpDream
UpDream Hot

一款AI视频创作工具,主要用于哔哩哔哩推出的自研AI视频创作工具,适合需要提升相关任务效率的用户。

墨刀AI
墨刀AI Hot

一款AI图像与设计工具,主要用于产品经理的专属智能体,适合需要提升相关任务效率的用户。

讯飞绘文

讯飞绘文是一款由科大讯飞推出的一站式 AIGC 内容运营平台。

火山引擎

火山引擎是一款面向企业的云计算与AI服务平台。

Seko
Seko Hot

一款AI视频创作工具,主要用于商汤科技推出的创编一体的AI短视频创作Agent,适合需要提升相关任务效率的用户。

相关专题

更多
Figma AI图像处理全指南:抠图、扩图与矢量化实操
Figma AI图像处理全指南:抠图、扩图与矢量化实操

无需PS插件,掌握 Figma AI 原生图像工具,支持一键移除背景、智能填充丢失区域以及将位图快速转为高精度矢量路径。

232

2026.05.13

腾讯混元使用教程大全
腾讯混元使用教程大全

从零开始学习腾讯混元,涵盖AI问答、内容创作、资料整理、办公辅助、代码生成、学习应用等场景,通过实战教程帮助用户快速掌握腾讯混元。

402

2026.06.11

腾讯混元Prompt大全
腾讯混元Prompt大全

收录腾讯混元热门Prompt模板,涵盖AI写作、办公文档、自媒体运营、电商推广、代码开发、学习教育等场景,帮助用户获得更高质量AI输出结果。

425

2026.06.11

腾讯混元开发平台教程
腾讯混元开发平台教程

面向开发者提供腾讯混元开放平台、API调用、SDK接入、智能体开发、Agent构建及企业级AI应用开发教程,帮助快速完成腾讯混元能力集成。

441

2026.06.11

LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

60

2026.09.30

LLVM RISC-V参数配置教程
LLVM RISC-V参数配置教程

本专题介绍LLVM对RISC-V基础ISA和扩展的支持方式,涵盖RV32、RV64、标准扩展、实验性扩展、厂商扩展、-menable-experimental-extensions和版本差异。

40

2026.09.30

LLVM IR中间表示入门指南
LLVM IR中间表示入门指南

本专题整理LLVM IR的核心概念,包括中间表示作用、模块结构、函数、基本块、SSA形式、类型系统和常见语法,帮助新手理解LLVM编译流程中的关键层。

40

2026.09.30

PDF转图片方法
PDF转图片方法

需要把 PDF 页面用于上传、预览、分享或图片归档时,PDF 转图片方法专题整理 JPG/PNG 格式选择、逐页导出、清晰度设置、批量下载和结果检查等流程,帮助用户稳定完成 PDF 图片化处理。

40

2026.09.30

PixTV AI视频生成与无限画布创作
PixTV AI视频生成与无限画布创作

PixTV专题整理AI视频与视觉内容创作相关功能使用教程,涵盖AI生图、视频生成、无限画布、多模型创作、素材管理、声音音乐及视频剪辑等功能,帮助用户快速掌握PixTV从创意到成片的完整制作方法。

40

2026.09.29

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn