commit afc81800832a0ae55bf27b0f739dc87c9107b463 Author: ModelHub XC Date: Wed Sep 30 12:35:17 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: ZeroWw/Qwen3-4B-Esper3-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..cd982e5 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,41 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +Qwen3-4B-Esper3.f16.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-4B-Esper3.q5_k.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-4B-Esper3.q6_k.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-4B-Esper3.q8_0.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-4B-Esper3.q8_p.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-4B-Esper3.q8q4.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/Qwen3-4B-Esper3.f16.gguf b/Qwen3-4B-Esper3.f16.gguf new file mode 100644 index 0000000..2b2b809 --- /dev/null +++ b/Qwen3-4B-Esper3.f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2d1ae119d51422048a7648d90a145d907378da1ad4e8c5bb096d477704ab6429 +size 8051286336 diff --git a/Qwen3-4B-Esper3.q5_k.gguf b/Qwen3-4B-Esper3.q5_k.gguf new file mode 100644 index 0000000..77b43d4 --- /dev/null +++ b/Qwen3-4B-Esper3.q5_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:93a2e432faa0f9639fdb99eae1515306a3f0d1fe4380d80c116b75db7cfe09a9 +size 3348361536 diff --git a/Qwen3-4B-Esper3.q6_k.gguf b/Qwen3-4B-Esper3.q6_k.gguf new file mode 100644 index 0000000..8c23d0d --- /dev/null +++ b/Qwen3-4B-Esper3.q6_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d481cae57f6a0126d55f72261d90218833642c01f84e0e1e860719d21cf3e4db +size 3765109056 diff --git a/Qwen3-4B-Esper3.q8_0.gguf b/Qwen3-4B-Esper3.q8_0.gguf new file mode 100644 index 0000000..8226b37 --- /dev/null +++ b/Qwen3-4B-Esper3.q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:eb39a407fca1974de6188b24d6a56a71a9123ea91a872f13dd45a315aeae5745 +size 4645052736 diff --git a/Qwen3-4B-Esper3.q8_p.gguf b/Qwen3-4B-Esper3.q8_p.gguf new file mode 100644 index 0000000..736db8c --- /dev/null +++ b/Qwen3-4B-Esper3.q8_p.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:557b28cf292699d22e2d920a4aa82bc606942a824a7ca72df1b44288a2337385 +size 4280406336 diff --git a/Qwen3-4B-Esper3.q8q4.gguf b/Qwen3-4B-Esper3.q8q4.gguf new file mode 100644 index 0000000..e6bb987 --- /dev/null +++ b/Qwen3-4B-Esper3.q8q4.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7217932fa5aa60091d520967e355d00e08e894c3e51b08f8bf53749aa958f1f8 +size 2591482176 diff --git a/README.md b/README.md new file mode 100644 index 0000000..5e80ae5 --- /dev/null +++ b/README.md @@ -0,0 +1,17 @@ + +--- +license: mit +language: +- en +pipeline_tag: text-generation +--- + +My own (ZeroWw) quantizations. +output and embed tensors quantized to f16. +all other tensors quantized to q5_k or q6_k. + +Result: +both f16.q6 and f16.q5 are smaller than q8_0 standard quantization +and they perform as well as the pure f16. + +Updated on: Wed May 07, 09:53:08