SD 3.5
SD 3.5 发布于 2024 年 10 月,是 Stable Diffusion 家族里 架构换代的一代:去噪网络从 U-Net 换成 MM-DiT(扩散 Transformer), 文本理解引入 T5-XXL 大语言模型。直观收益是两条: 提示词遵循度更高、图内文字渲染显著变强。
三个档位
| 版本 | 规模 | 定位 |
|---|---|---|
| SD 3.5 Large | 81 亿参数 | 画质旗舰,1 百万像素级输出 |
| SD 3.5 Large Turbo | 81 亿,步数蒸馏 | 约 4 步出图,速度优先 |
| SD 3.5 Medium | 25 亿参数 | 消费级硬件友好,质量与开销平衡 |
Turbo 档把「步数」这个变量直接蒸馏掉了——4 步左右出成图, 是「步数与质量」关系的工程化答案(背景见 采样器与迭代步数)。
许可口径
SD 3.5 采用 Stability 社区许可:年收入低于 100 万美元的个人与机构可免费商用, 超出规模需商业授权;具体条款以官方许可文本为准。 这与 SD 1.5 时代的 CreativeML OpenRAIL-M 是两套不同的许可(商用前必看,见 AI 图片版权与商用)。
给普通用户的含义
手机端云端服务会随官方升级逐步换用更新的模型档位,你感受到的变化是: 描述「听懂了」、画面里的文字不再乱码、复杂构图更稳——这些都来自新架构。 官方 API 侧,基于 SD 3.5 的 Stable Image Ultra 等服务也按 Credits 计费开放, 价格与配额以官方最新公布为准。
新架构同样意味着新生态:SD 3.5 的社区模型数量仍在积累期,
不如 SDXL 丰富(见Civitai 社区模型库)。
相关阅读:模型家族时间线 · SDXL:画质跃升 · AI 图片版权与商用