DeepSeek-R1-Distill-Llama-8B
8BDeepSeek
R1 推理蒸馏到 Llama 3.1 8B。8–12GB 显卡上最佳思维链之一,社区 GGUF 极丰富。
消费级显卡Mac / 苹果芯片CPU / 轻量VPS
131K
最大上下文
4
量化变体
GGUF Q5_K_M
最佳质量
98.8%
精度保留率
量化变体对比
各量化级别的显存、质量损失及 RTX 4090 推理速度
实测 = 本站基准 · 估算 = 公式推算 · 社区 = 公开报告
7B
DeepSeek-R1-Distill-Qwen-7B
DeepSeek
消费级显卡Mac / 苹果芯片
5.2 GB最低显存·97.8%精度
7B 体量的 R1 推理能力,8–12GB 显存思维链实验性价比最高。
16B
DeepSeek-V2-Lite Chat
DeepSeek
消费级显卡Mac / 苹果芯片
9.6 GB最低显存·97.0%精度
MoE 通用模型(激活约 2.4B),长上下文,多语言对话能力强。
14B
DeepSeek-R1-Distill-Qwen-14B
DeepSeek
消费级显卡
9.2 GB最低显存·98.0%精度
R1 推理能力蒸馏至 14B,社区热度极高,思维链能力出色。
32B
DeepSeek-R1-Distill-Qwen-32B
DeepSeek
消费级显卡专业 GPU
16.8 GB最低显存·97.4%精度
R1 蒸馏至 32B,单卡 24GB(Q3/Q4)即可接近前沿推理能力。