HuggingFace
25-12-04 10:54 微博认证:HuggingFace官方微博

🚀 Diffusers 家族迎来新成员:FLUX.2!来自 Black Forest Labs 的全新开源图像生成模型,从架构到训练全线重构,不是升级,而是重生🔥

📌 三大亮点:
1️⃣ 单文本编码器 + 新架构:采用 Mistral Small 3.1,一次处理文本,嵌入更精准,理解力更强。
2️⃣ 改进版 DiT:融合双流与单流 Transformer,Attention 全并行,使用 SwiGLU 激活与去偏置设计,训练更稳更快。
3️⃣ 灵活推理 & 超低显存:
支持 Flash Attention 3⚡️
支持 4-bit 量化、远程文本编码器
最低仅需 8GB GPU 即可运行!

🎨 支持多图参考生成(最多 10 张图像)与 JSON 结构化 Prompt,可精确控制色彩、光线、镜头与风格。LoRA、QLoRA、FP8 等优化让个性化微调更轻松。

📸 示例:
“银色 Walkman 放在 #367588 色地毯上,插着耳机,柔光摄影棚场景。”
色值匹配、焦点清晰,真实到让人以为是实拍!

🤗 欢迎加入我们的中文社区:Chinese LLMs on Hugging Face,一起探索开源文生图的未来!你最想用 FLUX.2 生成什么?
#文生图##Diffusion模型##HuggingFace#

发布于 美国