初始化项目,由ModelHub XC社区提供模型
Model: shaowenchen/colossal-llama-2-7b-base-gguf Source: Original Platform
This commit is contained in:
36
.gitattributes
vendored
Normal file
36
.gitattributes
vendored
Normal file
@@ -0,0 +1,36 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
*.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
73
README.md
Normal file
73
README.md
Normal file
@@ -0,0 +1,73 @@
|
||||
---
|
||||
inference: false
|
||||
language:
|
||||
- zh
|
||||
license: other
|
||||
model_creator: hpcai-tech
|
||||
model_link: https://huggingface.co/hpcai-tech/Colossal-LLaMA-2-7b-base
|
||||
model_name: Colossal-LLaMA-2-7b-base
|
||||
model_type: llama
|
||||
pipeline_tag: text-generation
|
||||
quantized_by: shaowenchen
|
||||
tasks:
|
||||
- text2text-generation
|
||||
tags:
|
||||
- gguf
|
||||
- llama
|
||||
- llama-2
|
||||
- chinese
|
||||
---
|
||||
|
||||
## Provided files
|
||||
|
||||
| Name | Quant method | Size |
|
||||
| ------------------------------------ | ------------ | ------ |
|
||||
| colossal-llama-2-7b-base.Q2_K.gguf | Q2_K | 2.8 GB |
|
||||
| colossal-llama-2-7b-base.Q3_K.gguf | Q3_K | 3.2 GB |
|
||||
| colossal-llama-2-7b-base.Q3_K_L.gguf | Q3_K_L | 3.5 GB |
|
||||
| colossal-llama-2-7b-base.Q3_K_S.gguf | Q3_K_S | 2.9 GB |
|
||||
| colossal-llama-2-7b-base.Q4_0.gguf | Q4_0 | 3.8 GB |
|
||||
| colossal-llama-2-7b-base.Q4_1.gguf | Q4_1 | 4.2 GB |
|
||||
| colossal-llama-2-7b-base.Q4_K.gguf | Q4_K | 4.0 GB |
|
||||
| colossal-llama-2-7b-base.Q4_K_S.gguf | Q4_K_S | 3.8 GB |
|
||||
| colossal-llama-2-7b-base.Q5_0.gguf | Q5_0 | 4.5 GB |
|
||||
| colossal-llama-2-7b-base.Q5_1.gguf | Q5_1 | 4.9 GB |
|
||||
| colossal-llama-2-7b-base.Q5_K.gguf | Q5_K | 4.7 GB |
|
||||
| colossal-llama-2-7b-base.Q5_K_S.gguf | Q5_K_S | 4.5 GB |
|
||||
| colossal-llama-2-7b-base.Q6_K.gguf | Q6_K | 5.4 GB |
|
||||
| colossal-llama-2-7b-base.Q8_0.gguf | Q8_0 | 7.0 GB |
|
||||
| colossal-llama-2-7b-base.gguf | full | 13 GB |
|
||||
|
||||
Usage:
|
||||
|
||||
```bash
|
||||
docker run --rm -it -p 8000:8000 -v /path/to/models:/models -e MODEL=/models/gguf-model-name.gguf shaowenchen/llama-cpp-python:0.2.6
|
||||
```
|
||||
|
||||
## Provided images
|
||||
|
||||
| Name | Quant method | Compressed Size |
|
||||
| -------------------------------------------------- | ------------ | --------------- |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q2_K` | Q2_K | 3.24 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q3_K` | Q3_K | 3.68 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q3_K_L` | Q3_K_L | 3.98 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q3_K_S` | Q3_K_S | 3.38 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q4_0` | Q4_0 | 4.05 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q4_1` | Q4_1 | 4.47 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q4_K` | Q4_K | 4.39 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q4_K_S` | Q4_K_S | 4.18 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q5_0` | Q5_0 | 4.99 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q5_1` | Q5_1 | 5.35 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q5_K` | Q5_K | 5.12 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q5_K_S` | Q5_K_S | 5 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q6_K` | Q6_K | 5.82 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:Q8_0` | Q8_0 | 7.18 GB |
|
||||
| `shaowenchen/colossal-llama-2-7b-base-gguf:full` | full | 10.49 GB |
|
||||
|
||||
Usage:
|
||||
|
||||
```
|
||||
docker run --rm -p 8000:8000 shaowenchen/colossal-llama-2-7b-base-gguf:Q2_K
|
||||
```
|
||||
|
||||
and you can view http://localhost:8000/docs to see the swagger UI.
|
||||
3
colossal-llama-2-7b-base.Q2_K.gguf
Normal file
3
colossal-llama-2-7b-base.Q2_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:e219c42c29beae8aac63dcd03001f9b9dc8f486800eef40715fbd6a1f018ae16
|
||||
size 3001289920
|
||||
3
colossal-llama-2-7b-base.Q3_K.gguf
Normal file
3
colossal-llama-2-7b-base.Q3_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:7e6840b267ac4ea4b174ea445ae3d853c17d51648c9f1235cc69d043a1b03181
|
||||
size 3488789184
|
||||
3
colossal-llama-2-7b-base.Q3_K_L.gguf
Normal file
3
colossal-llama-2-7b-base.Q3_K_L.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:d733a63af21dc0f651385b7257894e5193b93cf76ac181bec185a11e28b95cff
|
||||
size 3787895488
|
||||
3
colossal-llama-2-7b-base.Q3_K_S.gguf
Normal file
3
colossal-llama-2-7b-base.Q3_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:1e24a7b4466e893c643c068c4b7e60a404c237da07d8fdafb8a00ab80601f075
|
||||
size 3139089088
|
||||
3
colossal-llama-2-7b-base.Q4_0.gguf
Normal file
3
colossal-llama-2-7b-base.Q4_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:45e903a6cd3bbb28602ae0ae3ec95d16781ac5e02d6a38dc6d83194a7d8dd7b3
|
||||
size 4036776128
|
||||
3
colossal-llama-2-7b-base.Q4_1.gguf
Normal file
3
colossal-llama-2-7b-base.Q4_1.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:464ae338803c0e26e5879b0827439b8b8a1e4b8e3f5cf931dfc1e1152e809034
|
||||
size 4459217088
|
||||
3
colossal-llama-2-7b-base.Q4_K.gguf
Normal file
3
colossal-llama-2-7b-base.Q4_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:8632596330a5486e5f081917e9dbcad5d8bd295b9ef2366dc5ca0bcc3c144a3c
|
||||
size 4291973312
|
||||
3
colossal-llama-2-7b-base.Q4_K_S.gguf
Normal file
3
colossal-llama-2-7b-base.Q4_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:c3cdde2664a115d043645047528c94ab90f56bb50751fc0efd6bbeeb4e7305d0
|
||||
size 4067709120
|
||||
3
colossal-llama-2-7b-base.Q5_0.gguf
Normal file
3
colossal-llama-2-7b-base.Q5_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:dd159a3634b510f5b3ab9446eca06d14d3ac0eee5f86f1ba28a1672e0b0cf575
|
||||
size 4881658048
|
||||
3
colossal-llama-2-7b-base.Q5_1.gguf
Normal file
3
colossal-llama-2-7b-base.Q5_1.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:e5db8433440d6235ec6dea4ff7264a9d392d108e6b6f931703707b9c2581c13d
|
||||
size 5304099008
|
||||
3
colossal-llama-2-7b-base.Q5_K.gguf
Normal file
3
colossal-llama-2-7b-base.Q5_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:271ddf43e131ff2157b782d78ef80b50fc7674bf65a779e51b156642fde0fe9e
|
||||
size 5013123264
|
||||
3
colossal-llama-2-7b-base.Q5_K_S.gguf
Normal file
3
colossal-llama-2-7b-base.Q5_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:fe5ab9ca90efc56f6872682c58e1dea6dc979c55b8bf505dbb8f7a28236ddc32
|
||||
size 4881658048
|
||||
3
colossal-llama-2-7b-base.Q6_K.gguf
Normal file
3
colossal-llama-2-7b-base.Q6_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:76f2a2f193330e30321143bffe459795daf642de83ff6725ef9148eef9e2e543
|
||||
size 5779345088
|
||||
3
colossal-llama-2-7b-base.Q8_0.gguf
Normal file
3
colossal-llama-2-7b-base.Q8_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:1057be471ed493e366220ef36a047719df5afa099990da8986367e4ca086d7f4
|
||||
size 7484854976
|
||||
3
colossal-llama-2-7b-base.gguf
Normal file
3
colossal-llama-2-7b-base.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:c30c7d0bcdfc113e1c3e49f565b28fb7f2ef5119222bd1993a38e711cf0c2c8c
|
||||
size 14086828704
|
||||
10
configuration.json
Normal file
10
configuration.json
Normal file
@@ -0,0 +1,10 @@
|
||||
{
|
||||
"framework": "pytorch",
|
||||
"task": "text-generation",
|
||||
"model": {
|
||||
"type": "llama2"
|
||||
},
|
||||
"pipeline": {
|
||||
"type": "colossal-llama-2-7b-base-text-generation-pipe"
|
||||
}
|
||||
}
|
||||
Reference in New Issue
Block a user