From b083c2d47916714a47e39fe31b2a324e4c6e71fb Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Sun, 20 Sep 2026 10:36:16 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: Melvin56/GLM-Z1-9B-0414-GGUF Source: Original Platform --- .gitattributes | 47 ++++++++++++++++++++++++++++++++++++++ README.md | 40 ++++++++++++++++++++++++++++++++ glm-z1-9b-0414-BF16.gguf | 3 +++ glm-z1-9b-0414-Q2_K.gguf | 3 +++ glm-z1-9b-0414-Q3_K_M.gguf | 3 +++ glm-z1-9b-0414-Q4_K_M.gguf | 3 +++ glm-z1-9b-0414-Q5_K_M.gguf | 3 +++ glm-z1-9b-0414-Q6_K.gguf | 3 +++ glm-z1-9b-0414-Q8_0.gguf | 3 +++ imatrix.dat | 3 +++ 10 files changed, 111 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 glm-z1-9b-0414-BF16.gguf create mode 100644 glm-z1-9b-0414-Q2_K.gguf create mode 100644 glm-z1-9b-0414-Q3_K_M.gguf create mode 100644 glm-z1-9b-0414-Q4_K_M.gguf create mode 100644 glm-z1-9b-0414-Q5_K_M.gguf create mode 100644 glm-z1-9b-0414-Q6_K.gguf create mode 100644 glm-z1-9b-0414-Q8_0.gguf create mode 100644 imatrix.dat diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..644dcd6 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,47 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +glm-z1-9b-0414-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +glm-z1-9b-0414-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +glm-z1-9b-0414-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +glm-z1-9b-0414-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +glm-z1-9b-0414-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +glm-z1-9b-0414-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +glm-z1-9b-0414-BF16.gguf filter=lfs diff=lfs merge=lfs -text +imatrix.dat filter=lfs diff=lfs merge=lfs -text +glm-z1-9b-0414-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +glm-z1-9b-0414-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +glm-z1-9b-0414-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +glm-z1-9b-0414-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..a4e4b6b --- /dev/null +++ b/README.md @@ -0,0 +1,40 @@ +--- +license: mit +language: +- zh +- en +pipeline_tag: text-generation +library_name: transformers +base_model: +- THUDM/GLM-Z1-9B-0414 +--- +# Melvin56/GLM-Z1-9B-0414-GGUF + +Original Model : [THUDM/GLM-Z1-9B-0414](https://huggingface.co/THUDM/GLM-Z1-9B-0414) + +Llama.cpp build: ced44be3 (5199) + +I used imatrix to create all these quants using this [Dataset](https://gist.github.com/bartowski1182/eb213dccb3571f863da82e99418f81e8). + +--- +# Update-02 + * [Fixed Quant] Re-quantized all quants to fix this issue. [#13099](https://github.com/ggml-org/llama.cpp/pull/13099) [#13140](https://github.com/ggml-org/llama.cpp/pull/13140) + +--- + +| | CPU (AVX2) | CPU (ARM NEON) | Metal | cuBLAS | rocBLAS | SYCL | CLBlast | Vulkan | Kompute | +| :------------ | :---------: | :------------: | :---: | :----: | :-----: | :---: | :------: | :----: | :------: | +| K-quants | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ 🐢5 | ✅ 🐢5 | ❌ | +| I-quants | ✅ 🐢4 | ✅ 🐢4 | ✅ 🐢4 | ✅ | ✅ | Partial¹ | ❌ | ❌ | ❌ | +``` +✅: feature works +🚫: feature does not work +❓: unknown, please contribute if you can test it youself +🐢: feature is slow +¹: IQ3_S and IQ1_S, see #5886 +²: Only with -ngl 0 +³: Inference is 50% slower +⁴: Slower than K-quants of comparable size +⁵: Slower than cuBLAS/rocBLAS on similar cards +⁶: Only q8_0 and iq4_nl +``` \ No newline at end of file diff --git a/glm-z1-9b-0414-BF16.gguf b/glm-z1-9b-0414-BF16.gguf new file mode 100644 index 0000000..6e9151c --- /dev/null +++ b/glm-z1-9b-0414-BF16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:13430cfaceb00eed29f0b74e5a4e0ca4a2a4a7a8c87c4f41064626215979534f +size 18811581824 diff --git a/glm-z1-9b-0414-Q2_K.gguf b/glm-z1-9b-0414-Q2_K.gguf new file mode 100644 index 0000000..60eb93b --- /dev/null +++ b/glm-z1-9b-0414-Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:196d7d0dfe09e50e0289368ebfb062baba9d03e03ec4bb000f60a97c6b1d5f6c +size 4006344352 diff --git a/glm-z1-9b-0414-Q3_K_M.gguf b/glm-z1-9b-0414-Q3_K_M.gguf new file mode 100644 index 0000000..18bac6f --- /dev/null +++ b/glm-z1-9b-0414-Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ba5ac2aadda6cc5a4aebe104d0e543725f291ba208fd909be295be537a4331cf +size 4974507680 diff --git a/glm-z1-9b-0414-Q4_K_M.gguf b/glm-z1-9b-0414-Q4_K_M.gguf new file mode 100644 index 0000000..69e208d --- /dev/null +++ b/glm-z1-9b-0414-Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8bd081e631ec9fa3397ee34e70bbccbcffd1d2d814394af43422d7c0bb6f018b +size 6166574752 diff --git a/glm-z1-9b-0414-Q5_K_M.gguf b/glm-z1-9b-0414-Q5_K_M.gguf new file mode 100644 index 0000000..0b95368 --- /dev/null +++ b/glm-z1-9b-0414-Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b9afb935f0e0fd4928d74b994120fe3184483e7e4c16ce174dad4424a960ded5 +size 7050917536 diff --git a/glm-z1-9b-0414-Q6_K.gguf b/glm-z1-9b-0414-Q6_K.gguf new file mode 100644 index 0000000..222d128 --- /dev/null +++ b/glm-z1-9b-0414-Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a3ecebe2e5554acc886db7fcf54528e62bef4e38dae9fe0954ac67e941da649a +size 8266643104 diff --git a/glm-z1-9b-0414-Q8_0.gguf b/glm-z1-9b-0414-Q8_0.gguf new file mode 100644 index 0000000..fbbf28c --- /dev/null +++ b/glm-z1-9b-0414-Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:9d6be6bf45587941507e188772f086ad70ce315daeb066e4f057663fcb7e5c06 +size 9999611552 diff --git a/imatrix.dat b/imatrix.dat new file mode 100644 index 0000000..a855d55 --- /dev/null +++ b/imatrix.dat @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:50a10528f0c7c985615fdbff371c1b1ae80b6e2d9065dd8d7cabb12be5493128 +size 5476127