SD3.5开源文字渲染文生图 多模态模型

Stable Diffusion 3.5 3.5

Stable Diffusion系列 · Stability AI · 2024-10发布

开源支持本地部署多模态国内可直连有免费额度

模型介绍

Stability 开源 SD3.5,MMDiT 架构,文字渲染与多主题理解大幅提升,2B/8B 覆盖不同显存档位。

模型基础信息

模型系列Stable Diffusion系列
开发机构Stability AI
发布时间2024-10
参数规模2B / 8B
上下文窗口文生图
模型类型文生图 / 图生图
中文能力良好
使用方式网页体验 / API调用 / 本地部署

免费额度与收费政策

开源免费

免费规则详情

开源可商用(遵守许可)。

收费标准简介

本地零成本。

模型能力介绍

✅ 核心优势

  • 文字渲染强
  • 多主题
  • MMDiT
  • 尺寸灵活

⚠️ 短板与局限

  • 生态未及 SD1.5
  • 显存需求中高
  • 中文一般

🎯 适用场景

  • 设计素材
  • 海报
  • 创意图
  • 研究

模型使用教程

本章节整理 Stable Diffusion 3.5 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。

输入文本描述或参考图生成图片。

提示词示例:「一只白色的猫坐在窗台上,逆光,电影级质感」

配合风格标签可获得更稳定效果。

注册 Stability AI 账号获取访问权限,网页版直接使用,开发版通过 API 接入。

curl  -H "Authorization: Bearer $API_KEY" -d '{"prompt":"a cat on a windowsill"}'

SD 3.5(2B/8B)是 Stability 新一代文生图,移植了许多新能力;8B 约需 16-24GB 显存。

  1. diffusers 推理:

pip install diffusers

python -c "from diffusers import StableDiffusion3Pipeline; import torch; pipe=StableDiffusion3Pipeline.from_pretrained('stabilityai/stable-diffusion-3.5-medium', torch_dtype='float16').to('cuda'); img=pipe('赛博朋克城市雨夜').images[0]; img.save('out.png')"

  1. ComfyUI:官方已原生支持 SD3.5,加载节点工作流即可。
  2. 2B 版更低显存(8GB)。

Tips:官方社区许可个人可商用,请阅读条款;多提示词/图文生成能力强。

💡 使用小技巧

2B 版 8GB 显存可跑。

❓ 常见问题 FAQ

Q1:SD3.5 提升点?\nA1:文字与多主题。

访问备注与注意事项