初始化项目,由ModelHub XC社区提供模型
Model: hfl/llama-3-chinese-8b-gguf Source: Original Platform
This commit is contained in:
47
.gitattributes
vendored
Normal file
47
.gitattributes
vendored
Normal file
@@ -0,0 +1,47 @@
|
|||||||
|
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bin.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.model filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||||
|
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zstandard filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.db* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ark* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text
|
||||||
|
**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.gguf* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ggml filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.llamafile* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pt2 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||||
45
README.md
Normal file
45
README.md
Normal file
@@ -0,0 +1,45 @@
|
|||||||
|
---
|
||||||
|
license: apache-2.0
|
||||||
|
language:
|
||||||
|
- zh
|
||||||
|
- en
|
||||||
|
---
|
||||||
|
|
||||||
|
# Llama-3-Chinese-8B-GGUF
|
||||||
|
|
||||||
|
<p align="center">
|
||||||
|
<a href="https://github.com/ymcui/Chinese-LLaMA-Alpaca-3"><img src="https://ymcui.com/images/chinese-llama-alpaca-3-banner.png" width="600"/></a>
|
||||||
|
</p>
|
||||||
|
|
||||||
|
This repository contains **Llama-3-Chinese-8B-GGUF** (llama.cpp/ollama/tgw, etc. compatible), which is the quantized version of [Llama-3-Chinese-8B](https://huggingface.co/hfl/llama-3-chinese-8b).
|
||||||
|
|
||||||
|
**Note: this is a foundation model, which is not suitable for conversation, QA, etc.**
|
||||||
|
|
||||||
|
Further details (performance, usage, etc.) should refer to GitHub project page: https://github.com/ymcui/Chinese-LLaMA-Alpaca-3
|
||||||
|
|
||||||
|
## Performance
|
||||||
|
|
||||||
|
Metric: PPL, **lower is better**
|
||||||
|
|
||||||
|
*Note: Old models have been removed due to its inferior performance.*
|
||||||
|
|
||||||
|
| Quant | Size | PPL (old model) | 👍🏻 PPL (new model) |
|
||||||
|
| :---: | -------: | ------------------: | ------------------: |
|
||||||
|
| Q2_K | 2.96 GB | 17.7212 +/- 0.59814 | 11.8595 +/- 0.20061 |
|
||||||
|
| Q3_K | 3.74 GB | 8.6303 +/- 0.28481 | 5.7559 +/- 0.09152 |
|
||||||
|
| Q4_0 | 4.34 GB | 8.2513 +/- 0.27102 | 5.5495 +/- 0.08832 |
|
||||||
|
| Q4_K | 4.58 GB | 7.8897 +/- 0.25830 | 5.3126 +/- 0.08500 |
|
||||||
|
| Q5_0 | 5.21 GB | 7.7975 +/- 0.25639 | 5.2222 +/- 0.08317 |
|
||||||
|
| Q5_K | 5.34 GB | 7.7062 +/- 0.25218 | 5.1813 +/- 0.08264 |
|
||||||
|
| Q6_K | 6.14 GB | 7.6600 +/- 0.25043 | 5.1481 +/- 0.08205 |
|
||||||
|
| Q8_0 | 7.95 GB | 7.6512 +/- 0.25064 | 5.1350 +/- 0.08190 |
|
||||||
|
| F16 | 14.97 GB | 7.6389 +/- 0.25001 | 5.1302 +/- 0.08184 |
|
||||||
|
|
||||||
|
|
||||||
|
## Others
|
||||||
|
|
||||||
|
- For full model, please see: https://huggingface.co/hfl/llama-3-chinese-8b
|
||||||
|
|
||||||
|
- For LoRA-only model, please see: https://huggingface.co/hfl/llama-3-chinese-8b-lora
|
||||||
|
|
||||||
|
- If you have questions/issues regarding this model, please submit an issue through https://github.com/ymcui/Chinese-LLaMA-Alpaca-3
|
||||||
1
configuration.json
Normal file
1
configuration.json
Normal file
@@ -0,0 +1 @@
|
|||||||
|
{"framework": "pytorch", "task": "others", "allow_remote": true}
|
||||||
3
ggml-model-f16.gguf
Normal file
3
ggml-model-f16.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:ae38d05b676c08ba1b422769fbb3d5206d5f60dad9cfbb753efe8f18540081ca
|
||||||
|
size 16068890432
|
||||||
3
ggml-model-q2_k.gguf
Normal file
3
ggml-model-q2_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:405c81fce3f2ea2f9127635a2e42902887db7ab887247ee34980f869e15b70e2
|
||||||
|
size 3179130720
|
||||||
3
ggml-model-q3_k.gguf
Normal file
3
ggml-model-q3_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:221ff0298644cbe4624519944f10b66963d16a309fd7c125380a8b7b7ca96150
|
||||||
|
size 4018917216
|
||||||
3
ggml-model-q4_0.gguf
Normal file
3
ggml-model-q4_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:4d21960dc94aa421728f470262c716965d9a94a8734152fca7f6f9d8ebaf9a81
|
||||||
|
size 4661210976
|
||||||
3
ggml-model-q4_k.gguf
Normal file
3
ggml-model-q4_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:5ea2740a1f02b0f1f006de70ada17e5d27e6dc8525a1c433a71bf7c61f864394
|
||||||
|
size 4920733536
|
||||||
3
ggml-model-q5_0.gguf
Normal file
3
ggml-model-q5_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:67e98af9d1003262f2f38e3a780d3cbb84d8cec071f428f74f07b5a13ed105fe
|
||||||
|
size 5599293280
|
||||||
3
ggml-model-q5_k.gguf
Normal file
3
ggml-model-q5_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:8e8583ecc97337db5ae30f7914514245a6c1c7cfc0242659f72df816f9b9a98b
|
||||||
|
size 5732986720
|
||||||
3
ggml-model-q6_k.gguf
Normal file
3
ggml-model-q6_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:1f1331c415761089fb2802f0fffa1918d3927b82a24fddb6de47568a42300909
|
||||||
|
size 6596005728
|
||||||
3
ggml-model-q8_0.gguf
Normal file
3
ggml-model-q8_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:cee7939eb39f8eb7c31d9ea2e3a712b7e95fb25171affd77ff06b1b5a5c7c870
|
||||||
|
size 8540770144
|
||||||
Reference in New Issue
Block a user