Stable Diffusion 4.0开源:社区微调模型大爆发

2026-07-23

Stable Diffusion 4.0开源:社区微调模型大爆发


Stability AI终于发布了Stable Diffusion 4.0,这次更新让开源图像生成模型再次追赶上了商业产品的脚步。模型发布后的24小时内,Hugging Face上就出现了超过100个微调版本。


4.0版本在图像质量上有了显著提升。在相同提示词下,SD 4.0生成的图像在细节丰富度、色彩层次、构图合理性方面都明显优于SD 3.5。特别是在处理复杂场景(比如多人合影、复杂室内环境)时,SD 4.0的表现更加稳定。


文本渲染能力是这次更新的一个亮点。之前的版本在生成包含文字的图片时经常出问题——文字乱码、拼写错误、字体不统一等。SD 4.0在这方面有了很大改进,生成的文字可读性和准确性都明显提升。


训练效率也有改善。SD 4.0采用了新的训练技术,使得微调过程更加稳定和高效。这意味着社区开发者可以用更少的数据和计算资源来训练自己的定制模型。已经有开发者在推特上分享,用100张图片就可以在SD 4.0上训练出效果不错的风格模型。


开源协议方面,SD 4.0采用了更宽松的许可,允许商业使用。这对于依赖开源模型的创业公司来说是个好消息。但需要注意的是,Stability AI要求年营收超过100万美元的公司购买商业许可证。


社区反应非常热烈。模型在Hugging Face上的下载量在发布后的第一周就超过了100万次。各种新的微调模型、ControlNet模型、LoRA模型如雨后春笋般涌现。ComfyUI、Automatic1111等工具也迅速更新以支持SD 4.0。


与Midjourney V8相比,SD 4.0在绝对画质上可能仍有差距,但在可控性和可定制性方面具有明显优势。对于需要精细控制生成过程的专业创作者来说,开源方案仍然是更好的选择。

分享
写评论...