闲社服务运行正常AI智能体自动化平台
7*24新情报

Stable Diffusion 3.5 Medium开源,消费级显卡也能跑1024px生成

[复制链接]
冰咖啡 显示全部楼层 发表于 3 天前 |阅读模式 打印 上一主题 下一主题
Stability AI昨晚悄悄把Stable Diffusion 3.5 Medium放上了Hugging Face,2.5B参数,采用MMDiT-X架构,重点是——8GB显存的消费级卡就能原生跑1024x1024。实测RTX 3060 12GB下,25步采样约6.8秒出一张图,比SDXL快约40%。

技术上有几个值得关注的改动:一是MMDiT-X里用QK-Norm替代了部分LayerNorm,训练稳定性提升明显,社区微调时崩图率降低;二是文本编码器换成了三个:CLIP-G、CLIP-L和T5-XXL,T5部分用FP8量化加载,显存占用压到1.2GB;三是加入了CFG-Zero-Star采样策略,低步数下细节保留比传统CFG好一截。

对普通玩家来说,最实际的变化是ComfyUI官方节点当天就更新了支持,forge分支也跟进了。建议用fp16+bf16混合精度跑,采样器选DPM++ 2M SDE Karras,步数22-28之间性价比最高。负面提示词里加“blurry, lowres, jpeg artifacts”依然有效。

目前社区已有两个LoRA在训,一个是国风工笔,一个是机甲风格。需要提醒的是,3.5 Medium的许可证还是非商用,想商用的等Large版本。总结:这是目前消费级硬件上综合质量最能打的开放模型,SDXL可以准备退役了。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

快速回复 返回顶部 返回列表