Qwen2.5-Coder 32B Instruct
32BAlibaba Qwen2.5
顶级开源代码模型,HumanEval 在 32B 规模可与 GPT-4o 竞争。
消费级显卡专业 GPU
131K
最大上下文
3
量化变体
GGUF Q4_K_M
最佳质量
97.5%
精度保留率
量化变体对比
各量化级别的显存、质量损失及 RTX 4090 推理速度
实测 = 本站基准 · 估算 = 公式推算 · 社区 = 公开报告
相似模型
与 Qwen2.5 32B 对比32B
Qwen2.5 32B Instruct
Alibaba Qwen2.5
消费级显卡专业 GPU
16.4 GB最低显存·97.3%精度
24GB 显存单卡可运行 Q4_K_S,推理能力接近 GPT-4,性价比极高。
7B
Qwen2.5 7B Instruct
Alibaba Qwen2.5
消费级显卡Mac / 苹果芯片
4.8 GB最低显存·99.3%精度
阿里 Qwen 系列 7B,性能远超同级,代码能力尤其突出。
14B
Qwen2.5 14B Instruct
Alibaba Qwen2.5
消费级显卡Mac / 苹果芯片
9.2 GB最低显存·98.6%精度
性能与资源消耗的最佳平衡点,Q4 量化仅需 16GB 显存。
7B
Qwen2.5-Coder 7B Instruct
Alibaba Qwen2.5
消费级显卡Mac / 苹果芯片
4.8 GB最低显存·98.0%精度
最佳 7B 代码模型,适合 8–16GB 显存的本地开发助手。