初始化项目,由ModelHub XC社区提供模型
Model: hfl/llama-3-chinese-8b-gguf Source: Original Platform
This commit is contained in:
47
.gitattributes
vendored
Normal file
47
.gitattributes
vendored
Normal file
@@ -0,0 +1,47 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zstandard filter=lfs diff=lfs merge=lfs -text
|
||||
*.tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
*.db* filter=lfs diff=lfs merge=lfs -text
|
||||
*.ark* filter=lfs diff=lfs merge=lfs -text
|
||||
**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text
|
||||
**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text
|
||||
**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.gguf* filter=lfs diff=lfs merge=lfs -text
|
||||
*.ggml filter=lfs diff=lfs merge=lfs -text
|
||||
*.llamafile* filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
45
README.md
Normal file
45
README.md
Normal file
@@ -0,0 +1,45 @@
|
||||
---
|
||||
license: apache-2.0
|
||||
language:
|
||||
- zh
|
||||
- en
|
||||
---
|
||||
|
||||
# Llama-3-Chinese-8B-GGUF
|
||||
|
||||
<p align="center">
|
||||
<a href="https://github.com/ymcui/Chinese-LLaMA-Alpaca-3"><img src="https://ymcui.com/images/chinese-llama-alpaca-3-banner.png" width="600"/></a>
|
||||
</p>
|
||||
|
||||
This repository contains **Llama-3-Chinese-8B-GGUF** (llama.cpp/ollama/tgw, etc. compatible), which is the quantized version of [Llama-3-Chinese-8B](https://huggingface.co/hfl/llama-3-chinese-8b).
|
||||
|
||||
**Note: this is a foundation model, which is not suitable for conversation, QA, etc.**
|
||||
|
||||
Further details (performance, usage, etc.) should refer to GitHub project page: https://github.com/ymcui/Chinese-LLaMA-Alpaca-3
|
||||
|
||||
## Performance
|
||||
|
||||
Metric: PPL, **lower is better**
|
||||
|
||||
*Note: Old models have been removed due to its inferior performance.*
|
||||
|
||||
| Quant | Size | PPL (old model) | 👍🏻 PPL (new model) |
|
||||
| :---: | -------: | ------------------: | ------------------: |
|
||||
| Q2_K | 2.96 GB | 17.7212 +/- 0.59814 | 11.8595 +/- 0.20061 |
|
||||
| Q3_K | 3.74 GB | 8.6303 +/- 0.28481 | 5.7559 +/- 0.09152 |
|
||||
| Q4_0 | 4.34 GB | 8.2513 +/- 0.27102 | 5.5495 +/- 0.08832 |
|
||||
| Q4_K | 4.58 GB | 7.8897 +/- 0.25830 | 5.3126 +/- 0.08500 |
|
||||
| Q5_0 | 5.21 GB | 7.7975 +/- 0.25639 | 5.2222 +/- 0.08317 |
|
||||
| Q5_K | 5.34 GB | 7.7062 +/- 0.25218 | 5.1813 +/- 0.08264 |
|
||||
| Q6_K | 6.14 GB | 7.6600 +/- 0.25043 | 5.1481 +/- 0.08205 |
|
||||
| Q8_0 | 7.95 GB | 7.6512 +/- 0.25064 | 5.1350 +/- 0.08190 |
|
||||
| F16 | 14.97 GB | 7.6389 +/- 0.25001 | 5.1302 +/- 0.08184 |
|
||||
|
||||
|
||||
## Others
|
||||
|
||||
- For full model, please see: https://huggingface.co/hfl/llama-3-chinese-8b
|
||||
|
||||
- For LoRA-only model, please see: https://huggingface.co/hfl/llama-3-chinese-8b-lora
|
||||
|
||||
- If you have questions/issues regarding this model, please submit an issue through https://github.com/ymcui/Chinese-LLaMA-Alpaca-3
|
||||
1
configuration.json
Normal file
1
configuration.json
Normal file
@@ -0,0 +1 @@
|
||||
{"framework": "pytorch", "task": "others", "allow_remote": true}
|
||||
3
ggml-model-f16.gguf
Normal file
3
ggml-model-f16.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:ae38d05b676c08ba1b422769fbb3d5206d5f60dad9cfbb753efe8f18540081ca
|
||||
size 16068890432
|
||||
3
ggml-model-q2_k.gguf
Normal file
3
ggml-model-q2_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:405c81fce3f2ea2f9127635a2e42902887db7ab887247ee34980f869e15b70e2
|
||||
size 3179130720
|
||||
3
ggml-model-q3_k.gguf
Normal file
3
ggml-model-q3_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:221ff0298644cbe4624519944f10b66963d16a309fd7c125380a8b7b7ca96150
|
||||
size 4018917216
|
||||
3
ggml-model-q4_0.gguf
Normal file
3
ggml-model-q4_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:4d21960dc94aa421728f470262c716965d9a94a8734152fca7f6f9d8ebaf9a81
|
||||
size 4661210976
|
||||
3
ggml-model-q4_k.gguf
Normal file
3
ggml-model-q4_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:5ea2740a1f02b0f1f006de70ada17e5d27e6dc8525a1c433a71bf7c61f864394
|
||||
size 4920733536
|
||||
3
ggml-model-q5_0.gguf
Normal file
3
ggml-model-q5_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:67e98af9d1003262f2f38e3a780d3cbb84d8cec071f428f74f07b5a13ed105fe
|
||||
size 5599293280
|
||||
3
ggml-model-q5_k.gguf
Normal file
3
ggml-model-q5_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:8e8583ecc97337db5ae30f7914514245a6c1c7cfc0242659f72df816f9b9a98b
|
||||
size 5732986720
|
||||
3
ggml-model-q6_k.gguf
Normal file
3
ggml-model-q6_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:1f1331c415761089fb2802f0fffa1918d3927b82a24fddb6de47568a42300909
|
||||
size 6596005728
|
||||
3
ggml-model-q8_0.gguf
Normal file
3
ggml-model-q8_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:cee7939eb39f8eb7c31d9ea2e3a712b7e95fb25171affd77ff06b1b5a5c7c870
|
||||
size 8540770144
|
||||
Reference in New Issue
Block a user