模型库

每个模型标注量化后显存需求,并自动匹配满足要求的最便宜在售显卡 —— 这就是「能不能跑」的答案。

模型库回答一个问题:这个模型,我的显卡能不能跑?

  • 最低显存:量化(Q4/FP8)后能跑起来的门槛;
  • 推荐显存:舒适体验(速度 + 上下文/分辨率余量);
  • 推荐显卡:满足推荐显存的最便宜在售卡,实时从硬件库计算,与佣金无关;
  • API/云:本地跑不划算的旗舰模型,给出云入口。

数据随硬件价格每日联动:显卡降价,推荐自动更新。

ALL全模型速查表

大语言模型

模型厂商 / 参数上下文最低显存
量化
推荐显存强项推荐显卡 / 入口
DeepSeek-R1 MIT 推理链最强开源系,本地部署需多卡服务器,个人走 API
DeepSeek
671B MoE
128K——
深度推理数学代码
API / 云 查 API 价格
DeepSeek-V3(聊天主力) MIT 中文写作与综合能力的 API 性价比锚点
DeepSeek
671B MoE
128K——
通用对话写作长文
API / 云 查 API 价格
Qwen3-235B-A22B Apache-2.0 本地需 3 张以上 24G 卡,建议 API 或云端按量
阿里通义
235B MoE
256K——
旗舰级通用Agent
API / 云 查 API 价格
Qwen3-32B Apache-2.0 32B 级综合最强之一:本地写小说/报告的首选
阿里通义
32B 稠密
128K20G24G
本地生产力长文写作
比价
Qwen3-14B Apache-2.0 12G 卡即可跑,速度与质量的最佳平衡
阿里通义
14B 稠密
128K9G12G
主流本地档日常助手
比价
Qwen3-8B Apache-2.0 8G 卡全速,学生与轻量任务首选
阿里通义
8B 稠密
128K6G8G
入门嵌入式边缘
比价
GLM-5-Flash 商用免费 API 免费档主力,零成本起步写工具与 Agent
智谱 AI
未公开
128K——
免费 API原型开发
API / 云 查 API 价格
Llama 3.3 70B Llama License Q4 约 40G:双 24G 卡或 5090+offload
Meta
70B 稠密
128K40G48G
英文最强70B 档基准
比价
Gemma 3 27B Gemma License 支持图像理解,3090/5090 的舒适区
Google
27B 稠密
128K17G24G
多模态单卡 24G 甜点
比价
Gemma 3 12B Gemma License 12G 卡的多模态入门
Google
12B 稠密
128K8G12G
轻量多模态
比价
Mistral Small 3.x 24B Apache-2.0 16G 显存利用率最高的一档
Mistral
24B 稠密
128K14G16G
欧洲系16G 卡甜点
比价
Phi-4 14B MIT 体积小推理强,上下文短是短板
微软
14B 稠密
16K9G12G
小钢炮推理
比价

最低显存 = 量化(Q4/FP8)后可运行;推荐显存 = 舒适体验。推荐显卡为满足推荐显存的最便宜在售卡(自动匹配,与佣金无关)。数据 2026-10-02 更新。

图像生成

模型厂商 / 参数最低显存
量化
推荐显存强项推荐显卡 / 入口
Stable Diffusion 1.5 开源 十年生态沉淀,4G 显存即可考古
Stability AI
0.98B
4G6G
入门LoRA 生态最全
比价
SDXL 1.0 开源(非商用条款) 8G 起步 12G 舒适,ControlNet 生态最全
Stability AI
2.6B
8G12G
主流画质工作流成熟
比价
SD 3.5 Large 社区许可 8B 新架构,提示词理解显著提升
Stability AI
8B
10G16G
提示词遵循写实
比价
Flux.1 dev 非商用 FP8 量化 12G 可跑,16G 舒适;全精度 24G
Black Forest Labs
12B
12G16G
画质天花板手部/文字
比价
Flux.1 schnell Apache-2.0 4 步出图,dev 的商用替代
Black Forest Labs
12B
12G16G
快速出图可商用
比价
Qwen-Image Apache-2.0 中文字生成与指令编辑目前最能打
阿里通义
20B MMDiT
16G24G
中文文字渲染图片编辑
比价

最低显存 = 量化(Q4/FP8)后可运行;推荐显存 = 舒适体验。推荐显卡为满足推荐显存的最便宜在售卡(自动匹配,与佣金无关)。数据 2026-10-02 更新。

视频生成

模型厂商 / 参数最低显存
量化
推荐显存强项推荐显卡 / 入口
Wan2.2 1.3B Apache-2.0 8G 起步,质量与速度的入门平衡点
阿里通义
1.3B
8G12G
入门视频消费级显卡
比价
Wan2.2 14B(TI2V) Apache-2.0 16G 可跑(量化),24G 舒适,支持 1080p
阿里通义
14B MoE
16G24G
开源视频画质第一梯队
比价
HunyuanVideo 社区许可(可商用) 量化 24G 可跑,原味体验建议多卡或云端
腾讯混元
13B
24G45G
运动幅度物理合理
比价
LTX-Video 开源 同硬件下速度数倍于 14B 级模型
Lightricks
13B(2B 蒸馏)
12G16G
生成速度实时预览
比价
CogVideoX-5B 开源 老牌劲旅,工作流兼容性好
智谱 AI
5B
12G16G
轻量文生视频
比价

最低显存 = 量化(Q4/FP8)后可运行;推荐显存 = 舒适体验。推荐显卡为满足推荐显存的最便宜在售卡(自动匹配,与佣金无关)。数据 2026-10-02 更新。

音频 / 音乐

模型厂商 / 参数最低显存
量化
推荐显存强项推荐显卡 / 入口
ACE-Step Apache-2.0 本地音乐生成当前的效率之王,十几秒出完整编曲
ACE Studio × StepFun
3.5B
8G12G
完整歌曲曲风控制
比价
YuE(乐) Apache-2.0(权重) 开源里人声歌曲最强;长歌慢,显存需求高
香港科技大学等
8B MoE
12G24G
完整人声歌曲中文歌词
比价
DiffRhythm MIT 中文人声歌曲的快速方案
中国人民大学等
扩散
8G12G
中文歌全曲秒级
比价
MusicGen Large CC-BY-NC 老牌可靠,注意 NC 许不可商用
Meta
3.3B
4G8G
器乐短句BGM 片段
比价
Stable Audio Open 开源(非商用条款) 做音效与采样素材,不是歌
Stability AI
1.2B
6G8G
音效样本短音频
比价

最低显存 = 量化(Q4/FP8)后可运行;推荐显存 = 舒适体验。推荐显卡为满足推荐显存的最便宜在售卡(自动匹配,与佣金无关)。数据 2026-10-02 更新。

↑