Gemma 2 27B Instruct
27BGoogle Gemma 2
最大开源 Gemma 2,推理能力强,Q4 量化需 24GB+ 显存。
消费级显卡专业 GPU
8K
最大上下文
3
量化变体
GGUF Q5_K_M
最佳质量
98.7%
精度保留率
量化变体对比
各量化级别的显存、质量损失及 RTX 4090 推理速度
实测 = 本站基准 · 估算 = 公式推算 · 社区 = 公开报告
相似模型
与 Gemma 2 对比9B
Gemma 2 9B Instruct
Google Gemma 2
消费级显卡Mac / 苹果芯片
5.8 GB最低显存·99.8%精度
Google Gemma 2 采用滑动窗口注意力机制,性能超越同级 9B 模型。
2B
Gemma 2 2B Instruct
Google Gemma 2
消费级显卡Mac / 苹果芯片
1.8 GB最低显存·99.7%精度
超紧凑 Gemma 2,4GB 显存即可运行,适合边缘原型开发。
32B
Qwen2.5 32B Instruct
Alibaba Qwen2.5
消费级显卡专业 GPU
16.4 GB最低显存·97.3%精度
24GB 显存单卡可运行 Q4_K_S,推理能力接近 GPT-4,性价比极高。
24B
Mistral Small 24B Instruct
Mistral AI
消费级显卡专业 GPU
13.5 GB最低显存·97.8%精度
Mistral 高效 24B 模型,多语言能力强,Q4 量化可装入 24GB 显存。