Phi-3.5 Mini Instruct
3.8BMicrosoft Phi
Microsoft 的小巧精悍之作,端侧部署最佳 4B 模型之一。
消费级显卡Mac / 苹果芯片CPU / 轻量VPS
131K
最大上下文
3
量化变体
GGUF Q8_0
最佳质量
99.8%
精度保留率
量化变体对比
各量化级别的显存、质量损失及 RTX 4090 推理速度
实测 = 本站基准 · 估算 = 公式推算 · 社区 = 公开报告
相似模型
与 Phi-4 Mini 对比3.8B
Phi-4 Mini Instruct
Microsoft Phi
消费级显卡Mac / 苹果芯片
2.5 GB最低显存·99.8%精度
最新 Phi mini,数学和代码能力提升,4B 级性能强者。
14B
Phi-3 Medium 14B Instruct
Microsoft Phi
消费级显卡Mac / 苹果芯片
8.8 GB最低显存·99.2%精度
Microsoft 中型 Phi-3,16GB 显卡上质量/显存比极佳。
14B
Phi-4 14B
Microsoft Phi
消费级显卡Mac / 苹果芯片
8.2 GB最低显存·98.7%精度
微软 Phi-4 稠密 14B,同尺寸推理能力突出。Q4 约 9GB,12GB 卡中等上下文可跑。
8B
Llama 3.1 8B Instruct
Meta Llama 3.1
消费级显卡Mac / 苹果芯片
3.2 GB最低显存·99.9%精度
Meta 旗舰 8B 模型,128K 上下文,端侧部署最优选择之一。