初始化项目,由ModelHub XC社区提供模型

Model: shaowenchen/colossal-llama-2-7b-base-gguf
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-07-27 23:40:05 +08:00
commit 1b95935559
18 changed files with 164 additions and 0 deletions

36
.gitattributes vendored Normal file
View File

@@ -0,0 +1,36 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
*.gguf filter=lfs diff=lfs merge=lfs -text

73
README.md Normal file
View File

@@ -0,0 +1,73 @@
---
inference: false
language:
- zh
license: other
model_creator: hpcai-tech
model_link: https://huggingface.co/hpcai-tech/Colossal-LLaMA-2-7b-base
model_name: Colossal-LLaMA-2-7b-base
model_type: llama
pipeline_tag: text-generation
quantized_by: shaowenchen
tasks:
- text2text-generation
tags:
- gguf
- llama
- llama-2
- chinese
---
## Provided files
| Name | Quant method | Size |
| ------------------------------------ | ------------ | ------ |
| colossal-llama-2-7b-base.Q2_K.gguf | Q2_K | 2.8 GB |
| colossal-llama-2-7b-base.Q3_K.gguf | Q3_K | 3.2 GB |
| colossal-llama-2-7b-base.Q3_K_L.gguf | Q3_K_L | 3.5 GB |
| colossal-llama-2-7b-base.Q3_K_S.gguf | Q3_K_S | 2.9 GB |
| colossal-llama-2-7b-base.Q4_0.gguf | Q4_0 | 3.8 GB |
| colossal-llama-2-7b-base.Q4_1.gguf | Q4_1 | 4.2 GB |
| colossal-llama-2-7b-base.Q4_K.gguf | Q4_K | 4.0 GB |
| colossal-llama-2-7b-base.Q4_K_S.gguf | Q4_K_S | 3.8 GB |
| colossal-llama-2-7b-base.Q5_0.gguf | Q5_0 | 4.5 GB |
| colossal-llama-2-7b-base.Q5_1.gguf | Q5_1 | 4.9 GB |
| colossal-llama-2-7b-base.Q5_K.gguf | Q5_K | 4.7 GB |
| colossal-llama-2-7b-base.Q5_K_S.gguf | Q5_K_S | 4.5 GB |
| colossal-llama-2-7b-base.Q6_K.gguf | Q6_K | 5.4 GB |
| colossal-llama-2-7b-base.Q8_0.gguf | Q8_0 | 7.0 GB |
| colossal-llama-2-7b-base.gguf | full | 13 GB |
Usage:
```bash
docker run --rm -it -p 8000:8000 -v /path/to/models:/models -e MODEL=/models/gguf-model-name.gguf shaowenchen/llama-cpp-python:0.2.6
```
## Provided images
| Name | Quant method | Compressed Size |
| -------------------------------------------------- | ------------ | --------------- |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q2_K` | Q2_K | 3.24 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q3_K` | Q3_K | 3.68 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q3_K_L` | Q3_K_L | 3.98 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q3_K_S` | Q3_K_S | 3.38 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q4_0` | Q4_0 | 4.05 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q4_1` | Q4_1 | 4.47 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q4_K` | Q4_K | 4.39 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q4_K_S` | Q4_K_S | 4.18 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q5_0` | Q5_0 | 4.99 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q5_1` | Q5_1 | 5.35 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q5_K` | Q5_K | 5.12 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q5_K_S` | Q5_K_S | 5 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q6_K` | Q6_K | 5.82 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q8_0` | Q8_0 | 7.18 GB |
| `shaowenchen/colossal-llama-2-7b-base-gguf:full` | full | 10.49 GB |
Usage:
```
docker run --rm -p 8000:8000 shaowenchen/colossal-llama-2-7b-base-gguf:Q2_K
```
and you can view http://localhost:8000/docs to see the swagger UI.

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e219c42c29beae8aac63dcd03001f9b9dc8f486800eef40715fbd6a1f018ae16
size 3001289920

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7e6840b267ac4ea4b174ea445ae3d853c17d51648c9f1235cc69d043a1b03181
size 3488789184

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d733a63af21dc0f651385b7257894e5193b93cf76ac181bec185a11e28b95cff
size 3787895488

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1e24a7b4466e893c643c068c4b7e60a404c237da07d8fdafb8a00ab80601f075
size 3139089088

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:45e903a6cd3bbb28602ae0ae3ec95d16781ac5e02d6a38dc6d83194a7d8dd7b3
size 4036776128

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:464ae338803c0e26e5879b0827439b8b8a1e4b8e3f5cf931dfc1e1152e809034
size 4459217088

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8632596330a5486e5f081917e9dbcad5d8bd295b9ef2366dc5ca0bcc3c144a3c
size 4291973312

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c3cdde2664a115d043645047528c94ab90f56bb50751fc0efd6bbeeb4e7305d0
size 4067709120

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:dd159a3634b510f5b3ab9446eca06d14d3ac0eee5f86f1ba28a1672e0b0cf575
size 4881658048

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e5db8433440d6235ec6dea4ff7264a9d392d108e6b6f931703707b9c2581c13d
size 5304099008

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:271ddf43e131ff2157b782d78ef80b50fc7674bf65a779e51b156642fde0fe9e
size 5013123264

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:fe5ab9ca90efc56f6872682c58e1dea6dc979c55b8bf505dbb8f7a28236ddc32
size 4881658048

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:76f2a2f193330e30321143bffe459795daf642de83ff6725ef9148eef9e2e543
size 5779345088

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1057be471ed493e366220ef36a047719df5afa099990da8986367e4ca086d7f4
size 7484854976

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c30c7d0bcdfc113e1c3e49f565b28fb7f2ef5119222bd1993a38e711cf0c2c8c
size 14086828704

10
configuration.json Normal file
View File

@@ -0,0 +1,10 @@
{
"framework": "pytorch",
"task": "text-generation",
"model": {
"type": "llama2"
},
"pipeline": {
"type": "colossal-llama-2-7b-base-text-generation-pipe"
}
}