买 AI 显卡,为什么显存比算力更重要?

短答案

算力决定快慢(线性损失),显存决定生死(直接 OOM)。预算冲突时,永远先保显存容量:8G 只够绘画,12G 是底线,16G 才有未来。

三个理由

1. 失败模式不对称。算力不足 = 出图慢 30%,等待而已;显存不足 = CUDA OOM,任务直接失败。买硬件要为「最坏情况」定价。

2. 模型增长快于算力需求。过去三年主流开源模型体积涨了 10 倍(SD1.5→Flux、7B→70B 级),而对「速度」的满意阈值基本没变(出图 10 秒、对话 20 tok/s)。大显存 = 更长的可用周期 = 更高残值。

3. 显存无法后天加,算力可以等。显卡显存焊死;而下一代的算力提升是自然的,你现在觉得「够快」的标准两年后依然够快——但「装得下」的标准一直在涨。

决策表

预算显存目标对应卡
¥3k 内12GRTX 3060 12G / Arc B580
¥3–4k16GRTX 5060 Ti 16G
¥6–8k16G 高带宽RTX 5070 Ti
¥17k+32GRTX 5090
GeForce RTX 5060 Ti 16GB · 入门首选。带宽是短板,但 16G 显存让 Flux 和 14B 模型进得去,入门唯一推荐。
16G 显存 AI 算力 36

「先保显存」策略的最佳注脚:入门价位唯一 16G 新卡

数据支撑见显卡对比与显存性价比榜。

常见问题

显存不够真的没有 workaround 吗?
有,但都是降级:量化(损质)、offload(掉速 5–10 倍)、低分辨率(损功能)。这些手段的本质都是「把装不下变成装得下」,代价远大于当初加 500 元上大一档显存。
↑