From 1b95935559a894020844c9beedf639ece5bcb81f Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Mon, 27 Jul 2026 23:40:05 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: shaowenchen/colossal-llama-2-7b-base-gguf Source: Original Platform --- .gitattributes | 36 ++++++++++++++ README.md | 73 ++++++++++++++++++++++++++++ colossal-llama-2-7b-base.Q2_K.gguf | 3 ++ colossal-llama-2-7b-base.Q3_K.gguf | 3 ++ colossal-llama-2-7b-base.Q3_K_L.gguf | 3 ++ colossal-llama-2-7b-base.Q3_K_S.gguf | 3 ++ colossal-llama-2-7b-base.Q4_0.gguf | 3 ++ colossal-llama-2-7b-base.Q4_1.gguf | 3 ++ colossal-llama-2-7b-base.Q4_K.gguf | 3 ++ colossal-llama-2-7b-base.Q4_K_S.gguf | 3 ++ colossal-llama-2-7b-base.Q5_0.gguf | 3 ++ colossal-llama-2-7b-base.Q5_1.gguf | 3 ++ colossal-llama-2-7b-base.Q5_K.gguf | 3 ++ colossal-llama-2-7b-base.Q5_K_S.gguf | 3 ++ colossal-llama-2-7b-base.Q6_K.gguf | 3 ++ colossal-llama-2-7b-base.Q8_0.gguf | 3 ++ colossal-llama-2-7b-base.gguf | 3 ++ configuration.json | 10 ++++ 18 files changed, 164 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 colossal-llama-2-7b-base.Q2_K.gguf create mode 100644 colossal-llama-2-7b-base.Q3_K.gguf create mode 100644 colossal-llama-2-7b-base.Q3_K_L.gguf create mode 100644 colossal-llama-2-7b-base.Q3_K_S.gguf create mode 100644 colossal-llama-2-7b-base.Q4_0.gguf create mode 100644 colossal-llama-2-7b-base.Q4_1.gguf create mode 100644 colossal-llama-2-7b-base.Q4_K.gguf create mode 100644 colossal-llama-2-7b-base.Q4_K_S.gguf create mode 100644 colossal-llama-2-7b-base.Q5_0.gguf create mode 100644 colossal-llama-2-7b-base.Q5_1.gguf create mode 100644 colossal-llama-2-7b-base.Q5_K.gguf create mode 100644 colossal-llama-2-7b-base.Q5_K_S.gguf create mode 100644 colossal-llama-2-7b-base.Q6_K.gguf create mode 100644 colossal-llama-2-7b-base.Q8_0.gguf create mode 100644 colossal-llama-2-7b-base.gguf create mode 100644 configuration.json diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..e79ce6a --- /dev/null +++ b/.gitattributes @@ -0,0 +1,36 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +*.gguf filter=lfs diff=lfs merge=lfs -text \ No newline at end of file diff --git a/README.md b/README.md new file mode 100644 index 0000000..0834498 --- /dev/null +++ b/README.md @@ -0,0 +1,73 @@ +--- +inference: false +language: + - zh +license: other +model_creator: hpcai-tech +model_link: https://huggingface.co/hpcai-tech/Colossal-LLaMA-2-7b-base +model_name: Colossal-LLaMA-2-7b-base +model_type: llama +pipeline_tag: text-generation +quantized_by: shaowenchen +tasks: + - text2text-generation +tags: + - gguf + - llama + - llama-2 + - chinese +--- + +## Provided files + +| Name | Quant method | Size | +| ------------------------------------ | ------------ | ------ | +| colossal-llama-2-7b-base.Q2_K.gguf | Q2_K | 2.8 GB | +| colossal-llama-2-7b-base.Q3_K.gguf | Q3_K | 3.2 GB | +| colossal-llama-2-7b-base.Q3_K_L.gguf | Q3_K_L | 3.5 GB | +| colossal-llama-2-7b-base.Q3_K_S.gguf | Q3_K_S | 2.9 GB | +| colossal-llama-2-7b-base.Q4_0.gguf | Q4_0 | 3.8 GB | +| colossal-llama-2-7b-base.Q4_1.gguf | Q4_1 | 4.2 GB | +| colossal-llama-2-7b-base.Q4_K.gguf | Q4_K | 4.0 GB | +| colossal-llama-2-7b-base.Q4_K_S.gguf | Q4_K_S | 3.8 GB | +| colossal-llama-2-7b-base.Q5_0.gguf | Q5_0 | 4.5 GB | +| colossal-llama-2-7b-base.Q5_1.gguf | Q5_1 | 4.9 GB | +| colossal-llama-2-7b-base.Q5_K.gguf | Q5_K | 4.7 GB | +| colossal-llama-2-7b-base.Q5_K_S.gguf | Q5_K_S | 4.5 GB | +| colossal-llama-2-7b-base.Q6_K.gguf | Q6_K | 5.4 GB | +| colossal-llama-2-7b-base.Q8_0.gguf | Q8_0 | 7.0 GB | +| colossal-llama-2-7b-base.gguf | full | 13 GB | + +Usage: + +```bash +docker run --rm -it -p 8000:8000 -v /path/to/models:/models -e MODEL=/models/gguf-model-name.gguf shaowenchen/llama-cpp-python:0.2.6 +``` + +## Provided images + +| Name | Quant method | Compressed Size | +| -------------------------------------------------- | ------------ | --------------- | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q2_K` | Q2_K | 3.24 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q3_K` | Q3_K | 3.68 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q3_K_L` | Q3_K_L | 3.98 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q3_K_S` | Q3_K_S | 3.38 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q4_0` | Q4_0 | 4.05 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q4_1` | Q4_1 | 4.47 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q4_K` | Q4_K | 4.39 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q4_K_S` | Q4_K_S | 4.18 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q5_0` | Q5_0 | 4.99 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q5_1` | Q5_1 | 5.35 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q5_K` | Q5_K | 5.12 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q5_K_S` | Q5_K_S | 5 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q6_K` | Q6_K | 5.82 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:Q8_0` | Q8_0 | 7.18 GB | +| `shaowenchen/colossal-llama-2-7b-base-gguf:full` | full | 10.49 GB | + +Usage: + +``` +docker run --rm -p 8000:8000 shaowenchen/colossal-llama-2-7b-base-gguf:Q2_K +``` + +and you can view http://localhost:8000/docs to see the swagger UI. diff --git a/colossal-llama-2-7b-base.Q2_K.gguf b/colossal-llama-2-7b-base.Q2_K.gguf new file mode 100644 index 0000000..6ca1cca --- /dev/null +++ b/colossal-llama-2-7b-base.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e219c42c29beae8aac63dcd03001f9b9dc8f486800eef40715fbd6a1f018ae16 +size 3001289920 diff --git a/colossal-llama-2-7b-base.Q3_K.gguf b/colossal-llama-2-7b-base.Q3_K.gguf new file mode 100644 index 0000000..2132b4d --- /dev/null +++ b/colossal-llama-2-7b-base.Q3_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7e6840b267ac4ea4b174ea445ae3d853c17d51648c9f1235cc69d043a1b03181 +size 3488789184 diff --git a/colossal-llama-2-7b-base.Q3_K_L.gguf b/colossal-llama-2-7b-base.Q3_K_L.gguf new file mode 100644 index 0000000..5d9b67a --- /dev/null +++ b/colossal-llama-2-7b-base.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d733a63af21dc0f651385b7257894e5193b93cf76ac181bec185a11e28b95cff +size 3787895488 diff --git a/colossal-llama-2-7b-base.Q3_K_S.gguf b/colossal-llama-2-7b-base.Q3_K_S.gguf new file mode 100644 index 0000000..2cbb768 --- /dev/null +++ b/colossal-llama-2-7b-base.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1e24a7b4466e893c643c068c4b7e60a404c237da07d8fdafb8a00ab80601f075 +size 3139089088 diff --git a/colossal-llama-2-7b-base.Q4_0.gguf b/colossal-llama-2-7b-base.Q4_0.gguf new file mode 100644 index 0000000..1732821 --- /dev/null +++ b/colossal-llama-2-7b-base.Q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:45e903a6cd3bbb28602ae0ae3ec95d16781ac5e02d6a38dc6d83194a7d8dd7b3 +size 4036776128 diff --git a/colossal-llama-2-7b-base.Q4_1.gguf b/colossal-llama-2-7b-base.Q4_1.gguf new file mode 100644 index 0000000..0dbf6d2 --- /dev/null +++ b/colossal-llama-2-7b-base.Q4_1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:464ae338803c0e26e5879b0827439b8b8a1e4b8e3f5cf931dfc1e1152e809034 +size 4459217088 diff --git a/colossal-llama-2-7b-base.Q4_K.gguf b/colossal-llama-2-7b-base.Q4_K.gguf new file mode 100644 index 0000000..0282662 --- /dev/null +++ b/colossal-llama-2-7b-base.Q4_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8632596330a5486e5f081917e9dbcad5d8bd295b9ef2366dc5ca0bcc3c144a3c +size 4291973312 diff --git a/colossal-llama-2-7b-base.Q4_K_S.gguf b/colossal-llama-2-7b-base.Q4_K_S.gguf new file mode 100644 index 0000000..fb0be3b --- /dev/null +++ b/colossal-llama-2-7b-base.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c3cdde2664a115d043645047528c94ab90f56bb50751fc0efd6bbeeb4e7305d0 +size 4067709120 diff --git a/colossal-llama-2-7b-base.Q5_0.gguf b/colossal-llama-2-7b-base.Q5_0.gguf new file mode 100644 index 0000000..f4218b3 --- /dev/null +++ b/colossal-llama-2-7b-base.Q5_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:dd159a3634b510f5b3ab9446eca06d14d3ac0eee5f86f1ba28a1672e0b0cf575 +size 4881658048 diff --git a/colossal-llama-2-7b-base.Q5_1.gguf b/colossal-llama-2-7b-base.Q5_1.gguf new file mode 100644 index 0000000..cc8cfca --- /dev/null +++ b/colossal-llama-2-7b-base.Q5_1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e5db8433440d6235ec6dea4ff7264a9d392d108e6b6f931703707b9c2581c13d +size 5304099008 diff --git a/colossal-llama-2-7b-base.Q5_K.gguf b/colossal-llama-2-7b-base.Q5_K.gguf new file mode 100644 index 0000000..e5091fd --- /dev/null +++ b/colossal-llama-2-7b-base.Q5_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:271ddf43e131ff2157b782d78ef80b50fc7674bf65a779e51b156642fde0fe9e +size 5013123264 diff --git a/colossal-llama-2-7b-base.Q5_K_S.gguf b/colossal-llama-2-7b-base.Q5_K_S.gguf new file mode 100644 index 0000000..2d54dae --- /dev/null +++ b/colossal-llama-2-7b-base.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:fe5ab9ca90efc56f6872682c58e1dea6dc979c55b8bf505dbb8f7a28236ddc32 +size 4881658048 diff --git a/colossal-llama-2-7b-base.Q6_K.gguf b/colossal-llama-2-7b-base.Q6_K.gguf new file mode 100644 index 0000000..4194054 --- /dev/null +++ b/colossal-llama-2-7b-base.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:76f2a2f193330e30321143bffe459795daf642de83ff6725ef9148eef9e2e543 +size 5779345088 diff --git a/colossal-llama-2-7b-base.Q8_0.gguf b/colossal-llama-2-7b-base.Q8_0.gguf new file mode 100644 index 0000000..6e2ea6f --- /dev/null +++ b/colossal-llama-2-7b-base.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1057be471ed493e366220ef36a047719df5afa099990da8986367e4ca086d7f4 +size 7484854976 diff --git a/colossal-llama-2-7b-base.gguf b/colossal-llama-2-7b-base.gguf new file mode 100644 index 0000000..446f7d2 --- /dev/null +++ b/colossal-llama-2-7b-base.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c30c7d0bcdfc113e1c3e49f565b28fb7f2ef5119222bd1993a38e711cf0c2c8c +size 14086828704 diff --git a/configuration.json b/configuration.json new file mode 100644 index 0000000..a4676f1 --- /dev/null +++ b/configuration.json @@ -0,0 +1,10 @@ +{ + "framework": "pytorch", + "task": "text-generation", + "model": { + "type": "llama2" + }, + "pipeline": { + "type": "colossal-llama-2-7b-base-text-generation-pipe" + } +} \ No newline at end of file