DeepSeek-R1-Distill-Qwen-14B
14BDeepSeek
R1 推理能力蒸馏至 14B,社区热度极高,思维链能力出色。
消费级显卡
131K
最大上下文
3
量化变体
EXL2 4.65bpw
最佳质量
98.0%
精度保留率
量化变体对比
各量化级别的显存、质量损失及 RTX 4090 推理速度
实测 = 本站基准 · 估算 = 公式推算 · 社区 = 公开报告
16B
DeepSeek-V2-Lite Chat
DeepSeek
消费级显卡Mac / 苹果芯片
9.6 GB最低显存·97.0%精度
MoE 通用模型(激活约 2.4B),长上下文,多语言对话能力强。
16B
DeepSeek-Coder-V2-Lite Instruct
DeepSeek
消费级显卡Mac / 苹果芯片
9.8 GB最低显存·99.8%精度
MoE 架构代码模型,激活参数约 2.4B,代码能力卓越。
7B
DeepSeek-R1-Distill-Qwen-7B
DeepSeek
消费级显卡Mac / 苹果芯片
5.2 GB最低显存·97.8%精度
7B 体量的 R1 推理能力,8–12GB 显存思维链实验性价比最高。
32B
DeepSeek-R1-Distill-Qwen-32B
DeepSeek
消费级显卡专业 GPU
16.8 GB最低显存·97.4%精度
R1 蒸馏至 32B,单卡 24GB(Q3/Q4)即可接近前沿推理能力。