Stable Diffusion XL (SDXL) 是 Stability AI 于 2023 年 7 月发布的开源高分辨率文生图扩散模型,基于其前代 SD 1.5 和 SD 2.1 迭代升级。模型核心采用 UNet 架构,其主干网络规模约为前代 3 倍,并引入 OpenCLIP-ViT/G 与 CLIP-ViT/L 双文本编码器以提升对复杂提示词的理解能力。SDXL 支持原生 1024×1024 分辨率输出,并可通过级联式 Refiner 模型对生成结果进行二次细节增强,实现更精细的纹理与色彩优化。
该模型凭借更强的图像质量、更优的文本理解以及对短提示词的友好性,广泛适用于数字艺术创作、设计概念图生成及视觉内容原型开发等场景。其基于 CreativeML Open RAIL++-M 许可证发布,支持商业应用。部署方面,基础模型 FP16 格式约需 8GB 显存,建议通过 diffusers 框架集成,并可借助 torch.compile 与 xformers 优化推理速度。