Qwen3 235B-A22B Instruct
235B-A22BAlibaba Qwen3
Qwen3 旗舰 MoE(激活 22B / 总 235B)。Q4_K_M 约 142GB,对标 DeepSeek-R1 级模型。
专业 GPU
41K
最大上下文
3
量化变体
GGUF Q4_K_M
最佳质量
97.8%
精度保留率
量化变体对比
各量化级别的显存、质量损失及 RTX 4090 推理速度
实测 = 本站基准 · 估算 = 公式推算 · 社区 = 公开报告
相似模型
与 Qwen3 32B 对比32B
Qwen3 32B Instruct
Alibaba Qwen3
消费级显卡专业 GPU
16.8 GB最低显存·97.5%精度
Qwen3 稠密 32B — Qwen2.5-32B 继任者,推理与思考模式全面升级。
8B
Qwen3 8B Instruct
Alibaba Qwen3
消费级显卡Mac / 苹果芯片
5.1 GB最低显存·99.4%精度
最新 Qwen3 稠密 8B,支持思考模式,本地部署比 Qwen2.5 7B 全面升级。
14B
Qwen3 14B Instruct
Alibaba Qwen3
消费级显卡Mac / 苹果芯片
9.5 GB最低显存·98.8%精度
Qwen3 14B — 2026 Qwen 系列中推理能力与显存占用的最佳平衡点。
30B-A3B
Qwen3 30B-A3B Instruct
Alibaba Qwen3
消费级显卡Mac / 苹果芯片
17.5 GB最低显存·98.9%精度
Qwen3 MoE,仅 3B 激活参数。Q4 约 19GB,16GB 显卡上超越 QwQ-32B。