News 3 min read
Stable Diffusion 3.5发布:三大版本详解及使用指南
Stable Diffusion 3.5 模型发布详解:包含 Large、Large Turbo和Medium三个版本,支持百万级像素分辨率。本文详细介绍各版本特点、技术优化、硬件要求及使用平台,助你快速了解和使用最新AI绘画技术。
本文发布于 686 天前,内容可能已过时,请注意甄别。
今天,我们来聊聊最新发布的Stable Diffusion 3.5模型。这是目前最强大的开源AI绘画模型之一,它不仅可以在普通电脑上运行,而且根据Stability AI社区许可协议提供多种使用权限。现在你可以从Hugging Face下载Stable Diffusion 3.5 Large和Stable Diffusion 3.5 Large Turbo模型,相关代码也已在GitHub开源。
为什么要升级到3.5版本?
今年6月,Stability AI发布了SD3 Medium版本,但这个版本并没有完全达到预期。经过认真听取社区反馈后,团队没有急于修补,而是花时间开发了这个全新的3.5版本,以更好地服务创作者社区。
有哪些新模型可以使用?
Stable Diffusion 3.5提供了三个不同版本的模型,满足不同用户的需求:
- 81亿参数的大型模型
- 最适合专业用途
- 支持1百万像素分辨率
- SD家族中最强大的基础模型
- Large版本的精简版
- 仅需4步即可生成高质量图像
- 速度远快于Large版本
- 保持了优秀的提示词准确性
- 25亿参数的中型模型
- 采用改进的MMDiT-X架构
- 适合消费级硬件运行
- 支持25万到200万像素分辨率
技术特点和优化
新版本在以下方面做出了重大改进:
- 可定制性: 通过Query-Key标准化技术,让模型更容易进行微调和开发
- 硬件友好: Medium版本仅需9.9GB显存(不含文本编码器)即可运行
- 性能均衡: 在图像质量和提示词准确性方面达到了很好的平衡
如何开始使用?
除了直接从Hugging Face下载模型权重自行部署外,你还可以通过以下平台使用:
更多文章
ZCode 说只是做索引,可它翻开的不止当前代码
OpenClaw 2.0 发布:Agent 终于能把没做完的事接着做
“牛来”揭面:智谱 GLM-5.3-Flash 匿名期跑出 44 万亿 Token
GLM-5.3 发布:基座没换,智谱把后训练推到数十倍任务环境
DeepSeek Harness 开源:把 Agent 的整套运行底座拆开了
FFmpeg 9.0 “Lei” 发布:这个版本号,纪念一位中国音视频开发者
DeepSeek-V4-Flash 正式上线:性能超过 GLM,逼近 Opus 4.8,价格更狠
GPT-5.6 Luna 直接降价 80%:百万 Token 输出只要 1.2 美元
Kimi K3 真开源了:2.8T 模型如何只激活 104B 参数?