Mistral 7B Instruct v0.3
7BMistral AI
经典 Mistral 7B v0.3,仍是本地对话 API 的可靠基线。
消费级显卡Mac / 苹果芯片CPU / 轻量VPS
33K
最大上下文
3
量化变体
GGUF Q6_K
最佳质量
99.1%
精度保留率
量化变体对比
各量化级别的显存、质量损失及 RTX 4090 推理速度
实测 = 本站基准 · 估算 = 公式推算 · 社区 = 公开报告
12B
Mistral Nemo 12B Instruct
Mistral AI
消费级显卡Mac / 苹果芯片
7.8 GB最低显存·99.1%精度
Mistral 与 NVIDIA 合作推出,128K 上下文,多语言能力出色。
24B
Mistral Small 24B Instruct
Mistral AI
消费级显卡专业 GPU
13.5 GB最低显存·97.8%精度
Mistral 高效 24B 模型,多语言能力强,Q4 量化可装入 24GB 显存。
47B MoE
Mixtral 8x7B Instruct
Mistral AI
专业 GPU
25.2 GB最低显存·97.2%精度
经典 MoE 模型,每 token 约 13B 激活参数,Q4 量化需 32GB+ 显存。
675B MoE
Mistral Large 3 675B Instruct
Mistral AI
专业 GPU
312.0 GB最低显存·97.9%精度
Mistral 3 旗舰 MoE(激活 41B / 总 675B),含视觉编码器。FP8 需 8×H200;GGUF 量化仅供研究集群。