From f18c6a4b5c768c1d469c375a0332934e3e758215 Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Wed, 16 Sep 2026 05:32:16 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: hfl/chinese-alpaca-2-7b-64k-gguf Source: Original Platform --- .gitattributes | 49 +++++++++++++++++++++++++++++++++++++++++ README.md | 37 +++++++++++++++++++++++++++++++ ggml-model-f16.gguf | 3 +++ ggml-model-q2_k-im.gguf | 3 +++ ggml-model-q2_k.gguf | 3 +++ ggml-model-q3_k-im.gguf | 3 +++ ggml-model-q3_k.gguf | 3 +++ ggml-model-q4_0.gguf | 3 +++ ggml-model-q4_k-im.gguf | 3 +++ ggml-model-q4_k.gguf | 3 +++ ggml-model-q5_0.gguf | 3 +++ ggml-model-q5_k-im.gguf | 3 +++ ggml-model-q5_k.gguf | 3 +++ ggml-model-q6_k-im.gguf | 3 +++ ggml-model-q6_k.gguf | 3 +++ ggml-model-q8_0.gguf | 3 +++ 16 files changed, 128 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 ggml-model-f16.gguf create mode 100644 ggml-model-q2_k-im.gguf create mode 100644 ggml-model-q2_k.gguf create mode 100644 ggml-model-q3_k-im.gguf create mode 100644 ggml-model-q3_k.gguf create mode 100644 ggml-model-q4_0.gguf create mode 100644 ggml-model-q4_k-im.gguf create mode 100644 ggml-model-q4_k.gguf create mode 100644 ggml-model-q5_0.gguf create mode 100644 ggml-model-q5_k-im.gguf create mode 100644 ggml-model-q5_k.gguf create mode 100644 ggml-model-q6_k-im.gguf create mode 100644 ggml-model-q6_k.gguf create mode 100644 ggml-model-q8_0.gguf diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..e3289ed --- /dev/null +++ b/.gitattributes @@ -0,0 +1,49 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +ggml-model-q2_k.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-q3_k.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-q4_k.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-q5_k.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-q6_k.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-q4_0.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-q5_0.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-q8_0.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-f16.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-q2_k-im.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-q3_k-im.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-q4_k-im.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-q5_k-im.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-q6_k-im.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..95bf63b --- /dev/null +++ b/README.md @@ -0,0 +1,37 @@ +--- +license: apache-2.0 +language: +- zh +- en +--- + +# Chinese-Alpaca-2-7B-64K + +This repository contains GGUF-v3 version (llama.cpp compatible) of **Chinese-Alpaca-2-7B-64K**, which is tuned on Chinese-Alpaca-2-7B with **YaRN method**. + + +## Performance + +Metric: PPL, lower is better + +| Quant | original | imatrix (`-im`) | +|-----|------|------| +| Q2_K | 9.8201 +/- 0.13298 | 10.3057 +/- 0.14197 | +| Q3_K | 8.4435 +/- 0.11467 | 8.3556 +/- 0.11316 | +| Q4_0 | 8.3573 +/- 0.11496 | - | +| Q4_K | 8.0558 +/- 0.10948 | 8.0557 +/- 0.10964 | +| Q5_0 | 8.0220 +/- 0.10954 | - | +| Q5_K | 7.9388 +/- 0.10802 | 7.9440 +/- 0.10815 | +| Q6_K | 7.9267 +/- 0.10792 | 7.9126 +/- 0.10775 | +| Q8_0 | 7.9117 +/- 0.10773 | - | +| F16 | 7.9124 +/- 0.10780 | - | + +*The model with `-im` suffix is generated with important matrix, which has generally better performance (not always though).* + + +## Others + + +For full model in HuggingFace format, please see: https://huggingface.co/hfl/chinese-alpaca-2-7b-64k + +Please refer to [https://github.com/ymcui/Chinese-LLaMA-Alpaca-2/](https://github.com/ymcui/Chinese-LLaMA-Alpaca-2/) for more details. \ No newline at end of file diff --git a/ggml-model-f16.gguf b/ggml-model-f16.gguf new file mode 100644 index 0000000..25bc711 --- /dev/null +++ b/ggml-model-f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:bb327e4d632c8fea0bb2cd2948345b61a259e3218ff856fbcce132e67eda41bd +size 13860294400 diff --git a/ggml-model-q2_k-im.gguf b/ggml-model-q2_k-im.gguf new file mode 100644 index 0000000..f2daae2 --- /dev/null +++ b/ggml-model-q2_k-im.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:00022a39638d001cacdc4b495d0d3a0a727615169a3dea90ccd7182a851b6d4b +size 2642956064 diff --git a/ggml-model-q2_k.gguf b/ggml-model-q2_k.gguf new file mode 100644 index 0000000..b7de1ae --- /dev/null +++ b/ggml-model-q2_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:48f8b749957dc95fdbc2312312bb3bcc1069a22ede411bff0be485d5fb06da3e +size 2936033056 diff --git a/ggml-model-q3_k-im.gguf b/ggml-model-q3_k-im.gguf new file mode 100644 index 0000000..65fdeb1 --- /dev/null +++ b/ggml-model-q3_k-im.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1f06a152410a5333a6448ae925a1d63fb41567540a0c213d16ee03dffaaa1ff7 +size 3417788192 diff --git a/ggml-model-q3_k.gguf b/ggml-model-q3_k.gguf new file mode 100644 index 0000000..ecc100e --- /dev/null +++ b/ggml-model-q3_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e476ab02d70cb6a700d25e72ba17fa3718496c6bc82396aeea5bafcd4ce6c75f +size 3417788192 diff --git a/ggml-model-q4_0.gguf b/ggml-model-q4_0.gguf new file mode 100644 index 0000000..216e9a7 --- /dev/null +++ b/ggml-model-q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1b384cf97a3fce1932ecb19f5d5e305acd30f9aae17ffcf0201636e3598e03df +size 3958263584 diff --git a/ggml-model-q4_k-im.gguf b/ggml-model-q4_k-im.gguf new file mode 100644 index 0000000..7181b3c --- /dev/null +++ b/ggml-model-q4_k-im.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3aee4d095df8be23a185fb49ba6cd9afc92486a67b126e80e5026b75d63f3e88 +size 4213460768 diff --git a/ggml-model-q4_k.gguf b/ggml-model-q4_k.gguf new file mode 100644 index 0000000..5293e94 --- /dev/null +++ b/ggml-model-q4_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5f89e831736e57f143ad0742216a2fde61b535448507cf7e85cfa56c6eeaa4d6 +size 4213460768 diff --git a/ggml-model-q5_0.gguf b/ggml-model-q5_0.gguf new file mode 100644 index 0000000..9fb36bb --- /dev/null +++ b/ggml-model-q5_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:14d6f073d8a8f9b24e9eae30be3eb2da9fa4b4185441cb925f5c444c5635c144 +size 4796075808 diff --git a/ggml-model-q5_k-im.gguf b/ggml-model-q5_k-im.gguf new file mode 100644 index 0000000..7c49b70 --- /dev/null +++ b/ggml-model-q5_k-im.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f340d3542acff6e9c2cfab357106b2673fdb64d0ed33034a92d3d8c71dd5b6cc +size 4927541024 diff --git a/ggml-model-q5_k.gguf b/ggml-model-q5_k.gguf new file mode 100644 index 0000000..f6f661c --- /dev/null +++ b/ggml-model-q5_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3cef17d3322dcfd15d6c1da04853c86534493848c3cca5a9d8ee553899d6d306 +size 4927541024 diff --git a/ggml-model-q6_k-im.gguf b/ggml-model-q6_k-im.gguf new file mode 100644 index 0000000..701df37 --- /dev/null +++ b/ggml-model-q6_k-im.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c1cdf50b48e6ed399f99b0c773612682c8f195ca22958c9ecc4c5eabd15aa2ba +size 5686251296 diff --git a/ggml-model-q6_k.gguf b/ggml-model-q6_k.gguf new file mode 100644 index 0000000..e914a13 --- /dev/null +++ b/ggml-model-q6_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:18bb859f18c49ff467095281b5f2d111c4c82af64b9c4c50837f59973f59f932 +size 5686251296 diff --git a/ggml-model-q8_0.gguf b/ggml-model-q8_0.gguf new file mode 100644 index 0000000..bebbe48 --- /dev/null +++ b/ggml-model-q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:30909142d9dba439029ef248ba02b15c79981c2a51f5231375ae529b9aaae20b +size 7364366112