DeepSeek-V2-Lite Chat
16BDeepSeek
MoE 通用模型(激活约 2.4B),长上下文,多语言对话能力强。
消费级显卡Mac / 苹果芯片
164K
最大上下文
2
量化变体
GGUF Q4_K_M
最佳质量
97.0%
精度保留率
量化变体对比
各量化级别的显存、质量损失及 RTX 4090 推理速度
实测 = 本站基准 · 估算 = 公式推算 · 社区 = 公开报告
14B
DeepSeek-R1-Distill-Qwen-14B
DeepSeek
消费级显卡
9.2 GB最低显存·98.0%精度
R1 推理能力蒸馏至 14B,社区热度极高,思维链能力出色。
16B
DeepSeek-Coder-V2-Lite Instruct
DeepSeek
消费级显卡Mac / 苹果芯片
9.8 GB最低显存·99.8%精度
MoE 架构代码模型,激活参数约 2.4B,代码能力卓越。
7B
DeepSeek-R1-Distill-Qwen-7B
DeepSeek
消费级显卡Mac / 苹果芯片
5.2 GB最低显存·97.8%精度
7B 体量的 R1 推理能力,8–12GB 显存思维链实验性价比最高。
8B
DeepSeek-R1-Distill-Llama-8B
DeepSeek
消费级显卡Mac / 苹果芯片
4.9 GB最低显存·98.8%精度
R1 推理蒸馏到 Llama 3.1 8B。8–12GB 显卡上最佳思维链之一,社区 GGUF 极丰富。