实操审校说明

本文属于部署实操教程。开源项目的版本号、镜像名称、配置项和硬件要求可能变化,请以官方文档、GitHub Release 和你本机实际输出为准。教程中的命令建议先在测试环境执行,再迁移到生产环境。


Stable Diffusion 本地部署教程:搭建 AI 绘画环境

📅 更新时间:2026 年 6 月
🔧 参考环境:Stable Diffusion WebUI v1.10+ / Python 3.11+ / CUDA 12+
👤 适合人群:想本地生成 AI 图片的创作者/设计师
⏱ 预计完成时间:1 小时

一、Stable Diffusion 是什么?

Stable Diffusion 是开源 AI 图片生成模型,可以:

  • 文字生成图片(输入「一只猫」,生成猫的图片)
  • 图片转图片(上传草图,生成精美图片)
  • 局部重绘(修改图片某一部分)
  • 完全本地运行,数据私密

类似工具对比

工具部署方式费用质量
Stable Diffusion本地/自部署免费⭐⭐⭐⭐
Midjourney在线(Discord)$10/月⭐⭐⭐⭐⭐
GPT Image 2在线(OpenAI / ChatGPT)以官方套餐/API 价格为准⭐⭐⭐⭐
通义万相在线(阿里)免费版有限制⭐⭐⭐

二、硬件要求

配置最低推荐
显卡NVIDIA 6GB 显存NVIDIA 12GB+ 显存
内存16 GB32 GB
硬盘20 GB50 GB+
CPU无要求

没有独立显卡? 可以用在线版:

  • DreamStudio(Stability AI 官方)
  • 腾讯绘画(免费)
  • 通义万相(免费)

三、安装 Stable Diffusion WebUI(最简单方式)

Windows 安装(一键包)

  1. 访问:https://github.com/AUTOMATIC1111/stable-diffusion-webui
  2. 下载一键安装包(或按照以下步骤手动安装)

手动安装步骤

# 1. 安装 Python 3.11(注意:不要 3.13,兼容性有问题)
# 下载:https://www.python.org/downloads/release/python-3119/

# 2. 安装 Git
# 下载:https://git-scm.com/download/win

# 3. 克隆 WebUI 仓库
git clone https://github.com/AUTOMATIC1111/stable-diffusion-webui.git
cd stable-diffusion-webui

# 4. 运行安装脚本(Windows)
./webui-user.bat

# macOS/Linux
./webui.sh

首次运行会自动下载依赖(约 10-20 分钟)。

启动后访问

安装完成后,浏览器会自动打开:http://localhost:7860


四、下载模型(Checkpoint)

Stable Diffusion 需要模型文件才能生成图片。

推荐模型下载地址

模型特点下载地址
Stable Diffusion 3.5 / SDXL / FLUX当前主流开源模型生态,按显存和授权选择HuggingFace / Civitai
Realistic Vision真人照片风格Civitai
DreamShaper艺术风格,通用Civitai
Animagine XL二次元风格Civitai

安装模型

  1. 下载 .safetensors 模型文件(约 2-7 GB)
  2. 放到:stable-diffusion-webui/models/Stable-diffusion/
  3. 刷新 WebUI 的模型列表,选择新模型

五、第一次生成图片

  1. WebUI → txt2img(文字生成图片)
  2. Prompt(提示词):a cute cat, high quality, 4k
  3. Negative Prompt(反向提示词):low quality, blurry, worst quality
  4. 点击 Generate
  5. 等待约 10-30 秒,图片生成完成!

提示词技巧

类型示例
质量词high quality, 4k, 8k, masterpiece
风格词anime style, realistic, oil painting
光线词soft lighting, cinematic lighting
反向词low quality, blurry, deformed

六、图生图(Image-to-Image)

  1. WebUI → img2img
  2. 上传参考图片
  3. 输入提示词(描述你想要的效果)
  4. Denoising Strength(重绘强度):0.5-0.7
  5. 生成

用途:根据草图生成成品图、修改图片风格。


七、常用插件(Extensions)

插件功能
ControlNet精确控制姿势/构图
Lora微调模型风格(如「吉卜力风格」)
Inpaint局部重绘
Upscale放大图片(提升分辨率)

安装插件

  1. WebUI → ExtensionsInstall from URL
  2. 输入插件 GitHub 地址
  3. 点击 Install
  4. 重启 WebUI

八、常见问题

❌ 问题1:生成图片很慢

原因:显卡显存不足,用了 CPU 生成

解决

  1. 检查 WebUI 启动时是否显示 CUDA available: True
  2. 降低分辨率(512x512 代替 1024x1024)
  3. 用更小的模型

❌ 问题2:显存不足(Out of Memory)

解决

  1. webui-user.bat 里添加参数:
set COMMANDLINE_ARGS=--medvram --xformers
  1. 重启 WebUI

❌ 问题3:模型下载慢

解决:从国内镜像站下载模型,如:

  • Civitai 镜像:https://civitai.one/
  • HuggingFace 镜像:https://hf-mirror.com/

九、与 Midjourney 对比

对比项Stable DiffusionMidjourney
费用免费$10/月+
控制权完全控制中等
上手难度
图片质量取决于模型和提示词稳定高质量
推荐人群技术爱好者/设计师所有人

结论:想深度定制用 SD,想快速出图用 Midjourney。


*Stable Diffusion 是 AI 绘画的开源方案,适合想深度定制的用户。*