BF16-AIO20GB版本在1024×1024下需≥12GB显存,开启Upscale或batch_size>1时超16GB;FP8-AIO10GB仅需6–8GB,但要求CUDA 12.1+驱动。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

LiblibAI上下载的Checkpoint模型在本地ComfyUI中运行时,显存占用取决于模型精度版本与生成分辨率,不是所有模型都统一要求16GB以上显存。
BF16-AIO20GB版本的实际显存需求
该版本采用BFloat16精度,画质极致,但对显存压力较大。在1024×1024分辨率下生成单图,【必须确保GPU显存≥12GB】;若开启高分辨率修复(如Upscale 2×)或批量生成(batch_size>1),显存会瞬时突破16GB,RTX 4080(16GB)可勉强运行,RTX 4070 Ti(12GB)需关闭VAE Tiling并限制采样步数≤8。
这一步操作起来很简单,直接把文件拖进去就行。
FP8-AIO10GB版本的显存表现
FP8是当前最轻量的推理精度格式,官方实测在1080P输出下仅需【6–8GB显存】,RTX 4060(8GB)可稳定运行,甚至部分优化良好的RTX 3060(12GB)在关闭后台程序后能压至5.2GB占用。
注意:FP8模型不兼容老旧驱动(低于CUDA 12.1),若加载报错“invalid tensor layout”,请先升级NVIDIA驱动至v535.129或更高版本。
影响显存占用的关键变量
第一步:确认生成分辨率——1024×1024比512×512多消耗约40%显存,768×768是多数8GB卡的甜点分辨率。
第二步:检查是否启用VAE Tiling——开启后可将大图分块解码,8GB显存也能跑1280×720,但画质边缘可能出现轻微色带。
第三步:关闭不必要的节点——比如移除未使用的ControlNet Apply节点或冗余的Image Scale节点,每个闲置的大型ControlNet权重会常驻占用1–2GB显存。


















