关于

关于 quantized.uk

一份面向「真在自己硬件上跑模型」的量化参考站 — 由同样在做这件事的人维护。

页面最后更新:2026 年 6 月 24 日 · 数据最后刷新:2026-08-08

谁在维护?

quantized.uk 是一个开发者业余维护的独立项目,起因很简单:不想再靠猜显存、翻遍 Hugging Face 找量化版本。利用空余时间更新 — 有新模型发布或实测发现更准的数字时,就会修正和扩充数据。

为什么做这个站

本地跑 LLM 不该先读一篇论文。可大部分知识散落在 Reddit、Discord 和写给研究者的模型卡里 — 而不是写给盯着 12GB 显存条、犹豫 Q4_K_M 能不能塞进去的人。

quantized.uk 要回答的是下载 20GB 文件之前真正会问的问题:够不够显存?该用哪种格式?质量损失多少?启动命令怎么写?

我们提供什么

79+ 模型的可搜索索引(每种量化的显存、速度、质量估算);交互工具(显存计算器、格式向导、CLI 生成器);真机基准测试;以及分步骤的部署 Cookbook。

我们只索引元数据并链接到 Hugging Face — 不托管、不分发、不出售模型权重。每个模型仍受其自身许可协议约束。

数据从哪来

模型数据来自 Hugging Face 模型卡、社区量化发布(bartowski、turboderp、unsloth 等),以及在条件允许时的本地实测。HF 下载量在每次构建时从公开 API 拉取。

所有数字都是规划估算,非承诺。方法论见 Benchmarks 页面;编辑估算(如格式热度)会明确标注。生产部署前请务必在自己的硬件上验证。

更新频率

没有固定排期 — 有新模型发布或发现数据缺口时更新。模型库和 Cookbook 通常每隔几周批量扩充一批。首页 changelog 记录每次数据变更及日期。

HF 下载统计在每次站点重建时自动刷新。重大变更会记在 changelog 里 — 想了解最近改了什么,看那里最直观。

数据如何改进

模型条目、基准数据和 Cookbook 教程均根据社区发布和亲手实测人工整理。优先收录大家真正在下载的模型、读者真正在用的硬件配置。

如果某个数字看起来不对,先用显存计算器和 Hugging Face 官方模型卡交叉验证 — 后续数据批次会在首页 changelog 中修正。

我们不是什么

quantized.uk 与 Meta、NVIDIA、阿里、Mistral、Google、Hugging Face 或任何模型厂商无关联。我们不是公司、不是托管商、不是模型分发平台。

法律条款、责任限制和商标声明见「使用条款与免责声明」页面。

发现显存数据不对?知道该收录哪个模型?