初始化项目,由ModelHub XC社区提供模型
Model: mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF Source: Original Platform
This commit is contained in:
50
.gitattributes
vendored
Normal file
50
.gitattributes
vendored
Normal file
@@ -0,0 +1,50 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.f16.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Llama3.1-8b-instruct-LLMPC-Red-Team.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.IQ3_M.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.IQ3_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:50a2328b9de1d72c4be27ea0b646f110064276231c357346248d6feb2bffa848
|
||||
size 3784828000
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.IQ3_S.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.IQ3_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:433e89eac970a62b6d98527ab3364785e46c80d639f279e38e951abb850bc64c
|
||||
size 3682329696
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.IQ3_XS.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.IQ3_XS.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:ecfbe4779bb407b30d6f6283eaafb0dea7e56b5507b21331861ae47620db984b
|
||||
size 3518751840
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.IQ4_XS.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.IQ4_XS.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:b6ffe52810aefebdd4a1a71c32c98393a8f8f203f45fbe29f5519e6fb4ddb0bf
|
||||
size 4484367456
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q2_K.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q2_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:5e92b6b53641bbe6a7e0024b0809363b297fb531b328a7faf45e51be18a36c77
|
||||
size 3179136096
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q3_K_L.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q3_K_L.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:5bafb7d91c18820b60016f7a90840ac4786a9eb16a0ed6c74cc7f0bcda47a1fe
|
||||
size 4321961056
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q3_K_M.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q3_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:63706cd933f9701bd02cc09daf9f4d2f3054c83ca27d467aca3255b0375c89a7
|
||||
size 4018922592
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q3_K_S.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q3_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:0446ba65327d69e183f491fc43d9e52cf2fc109fe20224fad0e183c00797b8d3
|
||||
size 3664503904
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q4_K_M.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q4_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:f4ef0e3585530ffc06264fd09801830d0f9fa1f2febd17a2ad5566b23a7ef7dd
|
||||
size 4920738912
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q4_K_S.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q4_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:b04349f24b018be7bd070904bbe1313f6a77de21343a8a619276227d9a7e2f99
|
||||
size 4692673632
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q5_K_M.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q5_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:9499ff9d2be479e800dc3341fd97d88b24c4ff706e9db41c90535825d6f28159
|
||||
size 5732992096
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q5_K_S.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q5_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:b88c01ef7d2a3596c55a9fa105fc7119d0716a8dd07949ab0014f2651d13877d
|
||||
size 5599298656
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q6_K.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q6_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:b9536f8b3fbcaf6e7f1bf4d19c735f85906c6624bfd68ae9100e3b9293c3d768
|
||||
size 6596011104
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q8_0.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.Q8_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:f609ba81babd6734ea2788d64f0c01ba1d57d9f2e519cd040b26a7af4eb9e711
|
||||
size 8540775520
|
||||
3
Llama3.1-8b-instruct-LLMPC-Red-Team.f16.gguf
Normal file
3
Llama3.1-8b-instruct-LLMPC-Red-Team.f16.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:57a81d381d2bcfc02d8d174d15bae6a036188bc61c43124ced46a6748d02c088
|
||||
size 16068895840
|
||||
67
README.md
Normal file
67
README.md
Normal file
@@ -0,0 +1,67 @@
|
||||
---
|
||||
base_model: LLM-PBE/Llama3.1-8b-instruct-LLMPC-Red-Team
|
||||
language:
|
||||
- en
|
||||
library_name: transformers
|
||||
license: llama3.1
|
||||
quantized_by: mradermacher
|
||||
---
|
||||
## About
|
||||
|
||||
<!-- ### quantize_version: 2 -->
|
||||
<!-- ### output_tensor_quantised: 1 -->
|
||||
<!-- ### convert_type: hf -->
|
||||
<!-- ### vocab_type: -->
|
||||
<!-- ### tags: -->
|
||||
static quants of https://huggingface.co/LLM-PBE/Llama3.1-8b-instruct-LLMPC-Red-Team
|
||||
|
||||
<!-- provided-files -->
|
||||
weighted/imatrix quants are available at https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-i1-GGUF
|
||||
## Usage
|
||||
|
||||
If you are unsure how to use GGUF files, refer to one of [TheBloke's
|
||||
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
|
||||
more details, including on how to concatenate multi-part files.
|
||||
|
||||
## Provided Quants
|
||||
|
||||
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
|
||||
|
||||
| Link | Type | Size/GB | Notes |
|
||||
|:-----|:-----|--------:|:------|
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.Q2_K.gguf) | Q2_K | 3.3 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.IQ3_XS.gguf) | IQ3_XS | 3.6 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.Q3_K_S.gguf) | Q3_K_S | 3.8 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.IQ3_S.gguf) | IQ3_S | 3.8 | beats Q3_K* |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.IQ3_M.gguf) | IQ3_M | 3.9 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.Q3_K_M.gguf) | Q3_K_M | 4.1 | lower quality |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.Q3_K_L.gguf) | Q3_K_L | 4.4 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.IQ4_XS.gguf) | IQ4_XS | 4.6 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.Q4_K_S.gguf) | Q4_K_S | 4.8 | fast, recommended |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.Q4_K_M.gguf) | Q4_K_M | 5.0 | fast, recommended |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.Q5_K_S.gguf) | Q5_K_S | 5.7 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.Q5_K_M.gguf) | Q5_K_M | 5.8 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.Q6_K.gguf) | Q6_K | 6.7 | very good quality |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.Q8_0.gguf) | Q8_0 | 8.6 | fast, best quality |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Llama3.1-8b-instruct-LLMPC-Red-Team-GGUF/resolve/main/Llama3.1-8b-instruct-LLMPC-Red-Team.f16.gguf) | f16 | 16.2 | 16 bpw, overkill |
|
||||
|
||||
Here is a handy graph by ikawrakow comparing some lower-quality quant
|
||||
types (lower is better):
|
||||
|
||||

|
||||
|
||||
And here are Artefact2's thoughts on the matter:
|
||||
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
|
||||
|
||||
## FAQ / Model Request
|
||||
|
||||
See https://huggingface.co/mradermacher/model_requests for some answers to
|
||||
questions you might have and/or if you want some other model quantized.
|
||||
|
||||
## Thanks
|
||||
|
||||
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
|
||||
me use its servers and providing upgrades to my workstation to enable
|
||||
this work in my free time.
|
||||
|
||||
<!-- end -->
|
||||
Reference in New Issue
Block a user