前言
Stable Diffusion 3(SD3)是2026年最受欢迎的开源图像生成模型,相比前代在画质和多样性上大幅提升。本文将带你从零开始搭建运行环境,并生成第一张AI图像。
环境准备
硬件要求
- GPU:至少8GB显存(推荐RTX 4070或更高)
- RAM:16GB以上
- 存储:20GB可用空间
软件安装
- 安装Python 3.10:从官网下载并配置环境变量。
- 创建虚拟环境:
python -m venv sd3-env - 激活环境:
- Windows:
sd3-env\Scripts\activate - Linux/Mac:
source sd3-env/bin/activate
- Windows:
- 安装依赖:
pip install torch torchvision --index-url https://download.pytorch.org/whl/cu118
下载模型
- 从Hugging Face下载SD3模型:
git lfs install && git clone https://huggingface.co/stabilityai/stable-diffusion-3-medium - 或者使用diffusers库自动下载(推荐):
from diffusers import StableDiffusion3Pipeline pipe = StableDiffusion3Pipeline.from_pretrained("stabilityai/stable-diffusion-3-medium", torch_dtype=torch.float16) pipe = pipe.to("cuda")
生成图像
基础示例
prompt = "a cat wearing a astronaut helmet, digital art"
image = pipe(prompt).images[0]
image.save("cat_astronaut.png")
参数调优
- 步数:默认50,可增至100提高细节。
- 引导尺度:默认7.5,数值越大越符合提示。
- 负面提示:排除不需要的元素,如"ugly, blurry"。
- 种子:固定种子可复现结果。
高级技巧
- ControlNet:使用边缘检测控制构图。
- LoRA:微调特定风格,如动漫或写实。
- 批量生成:循环生成多张并筛选最佳。
常见问题
- 显存不足:降低图像尺寸(如512x512)或使用CPU推理(慢)。
- 模型加载慢:第一次会下载模型,后续使用缓存。
- 生成质量差:优化提示词,增加负面提示。
结语
现在你已经拥有自己的AI图像生成器!尝试不同提示词,探索无限创意。更多高级用法可参考官方文档。