跳到主要内容

模型层 · 本地部署

Models 图谱量化版对比

你决定用哪个模型之后,真正要面对的问题是:同一模型有几十个量化版,我该下哪一个?
本站只回答这一个问题——不评模型强弱,只帮你选对量化版。

7个系列
11个规格
91个量化仓
699个量化档位
41位量化者

先说清楚:这个站的数据怎么来的

✅ 实测字段

直接从 Hugging Face 公开 API 读取的客观数据:文件体积(字节)、上下文长度、架构、许可、下载量、更新时间。

✅ 推导

由实测字段按公开规则算出:每权重比特数(依 llama.cpp 命名标准)、档位归属、显存需求区间。推导规则在 METHODOLOGY.md 完整公开,任何人可复算。

❌ 我们不说的

哪个量化质量更高、哪个更快、哪个模型更强——这些需要实测,本站不跑 benchmark,所以不装作知道。凡我们给出的主观判断,一律显式标注「我们的口径」。

本站不下载、不托管任何模型权重文件。所有数字都来自公开元数据,点击即可回到发布页核对。 采集时间:2026-09-30(数据快照,非实时)

怎么用这个站

  1. 先看你有多少显存。这是唯一的硬约束,8GB 和 24GB 能跑的档位完全不同。
  2. 在 B 区块查速查表。直接给出「这个显存档位该用哪个量化档」,体积是实测值。
  3. 在 C 区块横向对比量化者。看谁档位全、谁带 imatrix、谁在跟进更新。
  4. 在 D 区块看单档详解。七个字段说清每个变体是什么、差在哪、什么时候该选它。
  5. 下载前先读许可。非宽松许可的,页面会标出来,原文链接就在旁边。

已收录系列 按 GGUF 量化实际下载量排序

收录的量化者 41 位