短答案
| 显存 | 能跑什么 | 体验 |
|---|---|---|
| 4–6G | SD 1.5(512) | 可用,偏慢 |
| 8G | SD 1.5 全速;SDXL 1024(优化) | 入门线 |
| 12G | SDXL 舒适;Flux FP8(勉强) | 主流线 |
| 16G | Flux dev FP8 流畅;SDXL 批量 | 生产力线 |
| 24G+ | Flux 全精度;多模型并行 | 专业线 |
展开:为什么是这些数字
- SD 1.5(0.98B 参数):模型约 2G,推理峰值 3–4G——任何在产的 AI 显卡都能跑,已不构成门槛。
- SDXL(2.6B):模型约 7G,1024×1024 峰值 8–10G,开注意力优化后 8G 卡可用,12G 留出批量与 ControlNET 余量。
- Flux dev(12B):FP8 版峰值 12–14G(12G 卡勉强),全精度峰值 20G+(16G 卡需要 offload,VAE 解码时易峰值溢出)。
带宽侧:每步去噪都要过一遍整个模型,同显存容量下 900GB/s 带宽的卡比 450GB/s 快接近一倍——这就是 5070 Ti 与 5060 Ti 的真实差距。
选购建议
GeForce RTX 5060 Ti 16GB
· 入门首选。带宽是短板,但 16G 显存让 Flux 和 14B 模型进得去,入门唯一推荐。
16G 显存
AI 算力 36
16G 显存的最低门票:SDXL 全工作流、Flux FP8 可跑,入门首选
¥3,599
京东比价GeForce RTX 5070 Ti
· 15000 元档主力卡。16G 显存 + 900GB/s 带宽,绘画与大模型两用性价比最高。
16G 显存
AI 算力 56
16G + 896GB/s 带宽:Flux 流畅生产的甜点卡
¥6,299
京东比价更完整的对比见显卡 AI 算力对比与AI 绘画场景指南。
常见问题
4G 显存还能玩 Stable Diffusion 吗?
SD 1.5 可以(开 CPU offload 与优化),512 分辨率出一张图 20–40 秒。但体验已属「考古」,¥1.8k 的 3060 12G 是更好的入场券。
显存不够有什么临时办法?
按优先级:开 xformers/SDPA 注意力优化 → 降分辨率 → 换 FP8/GGUF 量化模型 → CPU offload(速度掉 5–10 倍)。这些都是权宜之计,根本解法还是显存容量。