初始化项目,由ModelHub XC社区提供模型

Model: Melvin56/GLM-Z1-9B-0414-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-09-20 10:36:16 +08:00
commit b083c2d479
10 changed files with 111 additions and 0 deletions

47
.gitattributes vendored Normal file
View File

@@ -0,0 +1,47 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
glm-z1-9b-0414-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
glm-z1-9b-0414-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
glm-z1-9b-0414-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
glm-z1-9b-0414-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
glm-z1-9b-0414-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
glm-z1-9b-0414-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
glm-z1-9b-0414-BF16.gguf filter=lfs diff=lfs merge=lfs -text
imatrix.dat filter=lfs diff=lfs merge=lfs -text
glm-z1-9b-0414-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
glm-z1-9b-0414-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
glm-z1-9b-0414-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
glm-z1-9b-0414-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text

40
README.md Normal file
View File

@@ -0,0 +1,40 @@
---
license: mit
language:
- zh
- en
pipeline_tag: text-generation
library_name: transformers
base_model:
- THUDM/GLM-Z1-9B-0414
---
# Melvin56/GLM-Z1-9B-0414-GGUF
Original Model : [THUDM/GLM-Z1-9B-0414](https://huggingface.co/THUDM/GLM-Z1-9B-0414)
Llama.cpp build: ced44be3 (5199)
I used imatrix to create all these quants using this [Dataset](https://gist.github.com/bartowski1182/eb213dccb3571f863da82e99418f81e8).
---
# Update-02
* [Fixed Quant] Re-quantized all quants to fix this issue. [#13099](https://github.com/ggml-org/llama.cpp/pull/13099) [#13140](https://github.com/ggml-org/llama.cpp/pull/13140)
---
| | CPU (AVX2) | CPU (ARM NEON) | Metal | cuBLAS | rocBLAS | SYCL | CLBlast | Vulkan | Kompute |
| :------------ | :---------: | :------------: | :---: | :----: | :-----: | :---: | :------: | :----: | :------: |
| K-quants | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ 🐢5 | ✅ 🐢5 | ❌ |
| I-quants | ✅ 🐢4 | ✅ 🐢4 | ✅ 🐢4 | ✅ | ✅ | Partial¹ | ❌ | ❌ | ❌ |
```
✅: feature works
🚫: feature does not work
❓: unknown, please contribute if you can test it youself
🐢: feature is slow
¹: IQ3_S and IQ1_S, see #5886
²: Only with -ngl 0
³: Inference is 50% slower
⁴: Slower than K-quants of comparable size
⁵: Slower than cuBLAS/rocBLAS on similar cards
⁶: Only q8_0 and iq4_nl
```

3
glm-z1-9b-0414-BF16.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:13430cfaceb00eed29f0b74e5a4e0ca4a2a4a7a8c87c4f41064626215979534f
size 18811581824

3
glm-z1-9b-0414-Q2_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:196d7d0dfe09e50e0289368ebfb062baba9d03e03ec4bb000f60a97c6b1d5f6c
size 4006344352

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ba5ac2aadda6cc5a4aebe104d0e543725f291ba208fd909be295be537a4331cf
size 4974507680

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8bd081e631ec9fa3397ee34e70bbccbcffd1d2d814394af43422d7c0bb6f018b
size 6166574752

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b9afb935f0e0fd4928d74b994120fe3184483e7e4c16ce174dad4424a960ded5
size 7050917536

3
glm-z1-9b-0414-Q6_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a3ecebe2e5554acc886db7fcf54528e62bef4e38dae9fe0954ac67e941da649a
size 8266643104

3
glm-z1-9b-0414-Q8_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9d6be6bf45587941507e188772f086ad70ce315daeb066e4f057663fcb7e5c06
size 9999611552

3
imatrix.dat Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:50a10528f0c7c985615fdbff371c1b1ae80b6e2d9065dd8d7cabb12be5493128
size 5476127