Qwen2.5 1.5B Instruct
1.5BAlibaba Qwen2.5
支持 128K 上下文的微型 Qwen,摘要和对话能力出人意料。
消费级显卡Mac / 苹果芯片CPU / 轻量VPS
131K
最大上下文
2
量化变体
GGUF Q8_0
最佳质量
99.6%
精度保留率
量化变体对比
各量化级别的显存、质量损失及 RTX 4090 推理速度
实测 = 本站基准 · 估算 = 公式推算 · 社区 = 公开报告
相似模型
与 Qwen2.5 3B 对比3B
Qwen2.5 3B Instruct
Alibaba Qwen2.5
消费级显卡Mac / 苹果芯片
2.1 GB最低显存·99.7%精度
Qwen2.5 迷你版,适合边缘设备,4GB 显存或树莓派级别硬件即可运行。
0.5B
Qwen2.5 0.5B Instruct
Alibaba Qwen2.5
消费级显卡Mac / 苹果芯片
0.6 GB最低显存·99.5%精度
最小 Qwen2.5,适合树莓派、手机端和超低延迟演示。
7B
Qwen2.5 7B Instruct
Alibaba Qwen2.5
消费级显卡Mac / 苹果芯片
4.8 GB最低显存·99.3%精度
阿里 Qwen 系列 7B,性能远超同级,代码能力尤其突出。
14B
Qwen2.5 14B Instruct
Alibaba Qwen2.5
消费级显卡Mac / 苹果芯片
9.2 GB最低显存·98.6%精度
性能与资源消耗的最佳平衡点,Q4 量化仅需 16GB 显存。