From 1a287434a437ed2f1a66c5a2b2d4d0916831241d Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Fri, 18 Sep 2026 16:20:20 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: hfl/chinese-alpaca-2-7b-16k-gguf Source: Original Platform --- .gitattributes | 47 +++++++++++++++++++++++++++++++++++++++++ README.md | 36 +++++++++++++++++++++++++++++++ configuration.json | 1 + ggml-model-f16.gguf | 3 +++ ggml-model-q2_k-im.gguf | 3 +++ ggml-model-q2_k.gguf | 3 +++ ggml-model-q3_k-im.gguf | 3 +++ ggml-model-q3_k.gguf | 3 +++ ggml-model-q4_0.gguf | 3 +++ ggml-model-q4_k-im.gguf | 3 +++ ggml-model-q4_k.gguf | 3 +++ ggml-model-q5_0.gguf | 3 +++ ggml-model-q5_k-im.gguf | 3 +++ ggml-model-q5_k.gguf | 3 +++ ggml-model-q6_k-im.gguf | 3 +++ ggml-model-q6_k.gguf | 3 +++ ggml-model-q8_0.gguf | 3 +++ 17 files changed, 126 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 configuration.json create mode 100644 ggml-model-f16.gguf create mode 100644 ggml-model-q2_k-im.gguf create mode 100644 ggml-model-q2_k.gguf create mode 100644 ggml-model-q3_k-im.gguf create mode 100644 ggml-model-q3_k.gguf create mode 100644 ggml-model-q4_0.gguf create mode 100644 ggml-model-q4_k-im.gguf create mode 100644 ggml-model-q4_k.gguf create mode 100644 ggml-model-q5_0.gguf create mode 100644 ggml-model-q5_k-im.gguf create mode 100644 ggml-model-q5_k.gguf create mode 100644 ggml-model-q6_k-im.gguf create mode 100644 ggml-model-q6_k.gguf create mode 100644 ggml-model-q8_0.gguf diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..53d7257 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,47 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bin.* filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zstandard filter=lfs diff=lfs merge=lfs -text +*.tfevents* filter=lfs diff=lfs merge=lfs -text +*.db* filter=lfs diff=lfs merge=lfs -text +*.ark* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.gguf* filter=lfs diff=lfs merge=lfs -text +*.ggml filter=lfs diff=lfs merge=lfs -text +*.llamafile* filter=lfs diff=lfs merge=lfs -text +*.pt2 filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text \ No newline at end of file diff --git a/README.md b/README.md new file mode 100644 index 0000000..15b3c18 --- /dev/null +++ b/README.md @@ -0,0 +1,36 @@ +--- +license: apache-2.0 +language: +- zh +- en +--- + +# Chinese-Alpaca-2-7B-16K-GGUF + +This repository contains the GGUF-v3 models (llama.cpp compatible) for **Chinese-Alpaca-2-7B-16K**. + + +## Performance + +Metric: PPL, lower is better + +| Quant | original | imatrix (`-im`) | +|-----|------|------| +| Q2_K | 11.8181 +/- 0.16402 | 13.6285 +/- 0.19294 | +| Q3_K | 9.5596 +/- 0.13369 | 9.3748 +/- 0.13108 | +| Q4_0 | 9.6480 +/- 0.13459 | - | +| Q4_K | 8.9622 +/- 0.12507 | 8.9229 +/- 0.12467 | +| Q5_0 | 8.9274 +/- 0.12485 | - | +| Q5_K | 8.8370 +/- 0.12353 | 8.8221 +/- 0.12348 | +| Q6_K | 8.7830 +/- 0.12290 | 8.7695 +/- 0.12260 | +| Q8_0 | 8.7644 +/- 0.12261 | - | +| F16 | 8.7676 +/- 0.12268 | - | + +*The model with `-im` suffix is generated with important matrix, which has generally better performance (not always though).* + + +## Others + +For Hugging Face version, please see: https://huggingface.co/hfl/chinese-alpaca-2-7b-16k + +Please refer to [https://github.com/ymcui/Chinese-LLaMA-Alpaca-2/](https://github.com/ymcui/Chinese-LLaMA-Alpaca-2/) for more details. \ No newline at end of file diff --git a/configuration.json b/configuration.json new file mode 100644 index 0000000..159097f --- /dev/null +++ b/configuration.json @@ -0,0 +1 @@ +{"framework": "pytorch", "task": "others", "allow_remote": true} \ No newline at end of file diff --git a/ggml-model-f16.gguf b/ggml-model-f16.gguf new file mode 100644 index 0000000..de5d2c0 --- /dev/null +++ b/ggml-model-f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f4d68b8e3dc68ddb6004b6a9da2a7055ea89c1beb27978c5f5387e80e816edc6 +size 13860294272 diff --git a/ggml-model-q2_k-im.gguf b/ggml-model-q2_k-im.gguf new file mode 100644 index 0000000..367d745 --- /dev/null +++ b/ggml-model-q2_k-im.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:618fb8b420eae90a74f990282e5e586dafe3c67299ddabb7f5f76bf0ffd9036d +size 2642955936 diff --git a/ggml-model-q2_k.gguf b/ggml-model-q2_k.gguf new file mode 100644 index 0000000..52680ab --- /dev/null +++ b/ggml-model-q2_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:27684bb63a68b4b0cfb6a8ba09e77fac13d9c6c4fda6a80e8cd28f4007f6a466 +size 2936032864 diff --git a/ggml-model-q3_k-im.gguf b/ggml-model-q3_k-im.gguf new file mode 100644 index 0000000..a50796f --- /dev/null +++ b/ggml-model-q3_k-im.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:db4b6b48e701092860103dba906f8c560a9a894fffb3c3809c966112836a25d4 +size 3417788064 diff --git a/ggml-model-q3_k.gguf b/ggml-model-q3_k.gguf new file mode 100644 index 0000000..49e7573 --- /dev/null +++ b/ggml-model-q3_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f318eaf970bdff773f30033718905611a55a6aff4be125d2c147eb118c9607b9 +size 3417788000 diff --git a/ggml-model-q4_0.gguf b/ggml-model-q4_0.gguf new file mode 100644 index 0000000..f217218 --- /dev/null +++ b/ggml-model-q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1171d93f346bee0433989c1adc5095ef72f70cc9eb7747b6bd30f6eb04d0aa6c +size 3958263392 diff --git a/ggml-model-q4_k-im.gguf b/ggml-model-q4_k-im.gguf new file mode 100644 index 0000000..5a4fc94 --- /dev/null +++ b/ggml-model-q4_k-im.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:fec3b48c8548f74b88a20067f5a1847f7737761c94fe4cee2d006a77402566e1 +size 4213460640 diff --git a/ggml-model-q4_k.gguf b/ggml-model-q4_k.gguf new file mode 100644 index 0000000..270442c --- /dev/null +++ b/ggml-model-q4_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3323b7ec307eb3e7f709424e00268b8314c0c94af7c948a0e0d34789d2069086 +size 4213460576 diff --git a/ggml-model-q5_0.gguf b/ggml-model-q5_0.gguf new file mode 100644 index 0000000..1713a83 --- /dev/null +++ b/ggml-model-q5_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f76b3ae9ad887860c9dc06db440c1d325830e01f77bfa732203b6bd1061358fe +size 4796075616 diff --git a/ggml-model-q5_k-im.gguf b/ggml-model-q5_k-im.gguf new file mode 100644 index 0000000..5c9c4b4 --- /dev/null +++ b/ggml-model-q5_k-im.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1953a4d010ef352ccf343484d4e835c8cfdd2417a5305a273025300e0d626631 +size 4927540896 diff --git a/ggml-model-q5_k.gguf b/ggml-model-q5_k.gguf new file mode 100644 index 0000000..4176c8b --- /dev/null +++ b/ggml-model-q5_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2abb2305770ea349519473f959316f2c3f4c8d3c8adf00b62b5ffffcfffd422c +size 4927540832 diff --git a/ggml-model-q6_k-im.gguf b/ggml-model-q6_k-im.gguf new file mode 100644 index 0000000..27f7a95 --- /dev/null +++ b/ggml-model-q6_k-im.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:64f8bd42b07f304559c8fd5fd58b7d7dc7150d59ad9391d119099371cd8fac51 +size 5686251168 diff --git a/ggml-model-q6_k.gguf b/ggml-model-q6_k.gguf new file mode 100644 index 0000000..5ab9a39 --- /dev/null +++ b/ggml-model-q6_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ccc96c6dc3b292d15e3c1855841bb17be3ca5d48eb01880f67d58d41101d232f +size 5686251104 diff --git a/ggml-model-q8_0.gguf b/ggml-model-q8_0.gguf new file mode 100644 index 0000000..cc179c7 --- /dev/null +++ b/ggml-model-q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d62440b7cb2222daa0e3e069b37733fa3b721ab9ca04a7830a6f49ad9147d551 +size 7364365920