互联网的那点事
24-10-22 22:53 微博认证:微博互联网观察家

Stability AI 发布了 Stable Diffusion 3.5

有三种变体:Large(8B 参数)、Large Turbo(更快的 4 步生成)和 Medium(2.5B 参数),可在消费级硬件上运行!

模型已在 Hugging Face 和 GitHub 上发布,而 Medium 将于 10 月 29 日发布

所有模型年收入低于100 万美元均可免费用于商业用途,且用户保留生成媒体的所有权!

性能改进:

1.可定制性:

• 通过在模型的 transformer 块 中引入 Query-Key Normalization 技术,这种方法有助于模型训练的稳定性。

• 该技术可以使模型在调整和开发时更加简便,特别是在需要进一步优化或微调模型以适应特定任务时,更容易实现。

2.性能优化:

• 模型可以在普通电脑上跑得动,不需要高端设备,尤其是 Medium 和 Large Turbo 版本速度更快。

3.多样化输出:

• 生成的图片种类更多样,不需要特别复杂的描述,就能生成不同肤色和样貌的人像。

模型版本

1.Stable Diffusion 3.5 Large:

•参数量:80亿
•适用范围:专业应用,支持1兆像素分辨率,注重图像质量和提示词的准确性。

2.Stable Diffusion 3.5 Large Turbo:

•优化版的 Stable Diffusion 3.5 Large,仅需4步即可生成高质量图像,速度更快。

3.Stable Diffusion 3.5 Medium(将于10月29日发布):

•参数量:25亿
•采用改进的 MMDiT-X 架构,支持多分辨率生成,适合普通硬件,平衡质量和易用性。

详细:http://t.cn/A6nZpXD0

发布于 安徽