Stable Diffusion WebUI Forge 完整部署与使用教程:从环境配置到量化模型加载
2026/9/13 7:28:21 网站建设 项目流程

Stable Diffusion WebUI Forge 完整部署与使用教程:从环境配置到量化模型加载

【免费下载链接】stable-diffusion-webui-forge项目地址: https://gitcode.com/GitHub_Trending/st/stable-diffusion-webui-forge

Stable Diffusion WebUI Forge 是构建在 Stable Diffusion WebUI 之上的平台(当前基于上游 1.10.1 版本,Gradio 4 界面),主要解决三件事:降低 GPU 显存门槛、加速推理、让实验性功能(如 ControlNet 集成、FreeU V2)开箱可用。适合已在使用 A1111 WebUI 想换轻量方案的用户,以及显存 4GB 起步、想跑 Flux 量化模型的用户。

环境要求:Python、CUDA 与显存最低配置

项目最低要求推荐配置
Python3.8+3.10
CUDA11.8+12.1
PyTorch2.0+2.3.1(官方推荐包为 CUDA 12.1 + PyTorch 2.3.1 组合)
GPU 显存约 4GB(加载 GGUF Q4_0 量化模型)8GB+,可跑 BF16 或 Q8_0 量化
依赖文件requirements_versions.txt已锁版本(gradio 4.40.0、transformers 4.46.1、diffusers 0.31.0 等)

NVIDIA GPU 为推荐硬件;依赖版本已锁,手动升级 torch 或 transformers 容易破坏兼容性,不建议改。

三步完成 Stable Diffusion WebUI Forge 安装部署

主线路径只有三步:

git clone https://gitcode.com/GitHub_Trending/st/stable-diffusion-webui-forge cd stable-diffusion-webui-forge ./webui-user.sh
  • Windows / macOS 对应命令为webui-user.bat,它会自动创建venv虚拟环境并安装依赖,首次启动耗时较长属正常。
  • 需要额外启动参数时,在运行脚本前设置COMMANDLINE_ARGS环境变量(Linux 示例:export COMMANDLINE_ARGS="--port 7862")。
  • 已有 A1111 WebUI 环境、熟悉 Git 的用户,也可以将 Forge 作为 SD-WebUI 的分支安装来复用旧模型与扩展;其余安装方式(一键安装包等)均可跳过,以上述命令为准。

能完成什么事:四大能力与代码依据

  • 文生图 / 图生图:入口 webui.py 启动 Gradio 界面,默认监听 7860 端口,仅 API 模式(--nowebui)则落在 7861 端口。
  • 量化模型加载:原生支持 BitsandBytes NF4 与 GGUF 的 Q8_0 / Q5_0 / Q5_1 / Q4_0 / Q4_1 五个精度级别,其中 NF4、Q8_0、Q4_0、Q4_1 带 LoRA 支持。
  • 显存精细管理:设置页提供 GPU Weight 滑块(GPU 常驻权重比例)、Queue / Async Swap 换页模式切换、换页位置选择,让低显存卡也能承载大模型。
  • 内置扩展生态:extensions-builtin/下预置 ControlNet、IP-Adapter、FreeU V2(实现见 extensions-builtin/sd_forge_freeu/scripts/forge_freeu.py)、多种预处理器(marigold、tile、revision 等),无需再单独装扩展。

第一次拿到生成结果的最小路径

  1. 将 checkpoint / GGUF 模型放入models/Stable-diffusion/,VAE(可选)放入models/VAE/
  2. 浏览器访问http://127.0.0.1:7860/,选择模型,在 txt2img 页填写提示词、尺寸、步数。
  3. 点击 Generate 出图;img2img 页可复用同一流程做图生图。

一个必须知道的界面差异:Gradio 4 画布移动必须使用鼠标右键拖拽,这是从 A1111 迁移后最容易踩的交互变化。

常见故障与性能调优排查

  • 现象:启动报 "Press any key to continue" 或终端卡住。原因:依赖仍在安装 / 下载,或端口被占用。处理:等待完成;仍失败则关闭占用 7860 的进程,或用--port换端口。
  • 现象:Flux 推理卡死、进度不动或 OOM。原因:GPU Weight 设置过高,权重常驻 GPU 超出显存。处理:把 GPU Weight 调低——官方讨论区结论是降低该值可解决绝大多数此类问题。
  • 现象:低比特模型(NF4 / Q4_0)上 LoRA 效果弱。处理:使用 Forge 针对低比特模型的 LoRA 精度优化,并开启"仅加载一次 LoRA"以避免每次生成重复 patch。
  • 现象:API 调用 Flux 相关端点表现异常。原因:API 层 Flux 支持仍在完善,属已知边界而非配置错误。

适用场景与边界

适合:低显存机器跑 Flux / SDXL / SD1.5 文生图、图生图;用量化模型压缩显存;依赖内置 ControlNet 与 IP-Adapter 做可控生成。

不适合 / 尚未实现:Flux 专用 ControlNet 与 ControlNet Union 均未实现(截至 2024-08-26 官方状态);OFT LoRA 曾处于待修复状态;Microsoft Surface 的画布压感支持曾标记为 Broken。上游 SD-WebUI 目前基本停止更新,Forge 按每 90 天或遇重要修复时同步一次上游,长期项目需留意同步节奏。

资源与版本说明

  • 模型目录:models/Stable-diffusion/models/VAE/models/text_encoder/
  • 内置扩展目录:extensions-builtin/(第三方扩展放入extensions/
  • 发布说明:NEWS.md;仓库状态表与更新计划见该文件
  • 依赖锁定清单:requirements_versions.txt

本文基于 Forge 2.0.1(底层 SD-WebUI 1.10.1,Gradio 4.40.0)编写,功能与界面可能随版本更新而变化。

【免费下载链接】stable-diffusion-webui-forge项目地址: https://gitcode.com/GitHub_Trending/st/stable-diffusion-webui-forge

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询