初始化项目,由ModelHub XC社区提供模型
Model: mradermacher/Loki-GGUF Source: Original Platform
This commit is contained in:
49
.gitattributes
vendored
Normal file
49
.gitattributes
vendored
Normal file
@@ -0,0 +1,49 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.f16.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Loki.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
3
Loki.IQ3_M.gguf
Normal file
3
Loki.IQ3_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:a8504e0e6546812874b74d4f2677946f19ee5cd83deab1eee5358ad43190024f
|
||||
size 3784830464
|
||||
3
Loki.IQ3_S.gguf
Normal file
3
Loki.IQ3_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:1b2e584166b06f8e47f8ed58ec91c25997d8b6f14f8be9f8995eff8162acf377
|
||||
size 3682332160
|
||||
3
Loki.IQ3_XS.gguf
Normal file
3
Loki.IQ3_XS.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:12cc3cb4957dc1f012d16275bf324e4fcb3e789a2fce6550952b5bb7884b1977
|
||||
size 3518754304
|
||||
3
Loki.IQ4_XS.gguf
Normal file
3
Loki.IQ4_XS.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:eb2c87fd275b1eeace8f20019df956568e0840539a5605884620b9263cb2b53c
|
||||
size 4484369920
|
||||
3
Loki.Q2_K.gguf
Normal file
3
Loki.Q2_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:2b6c9e3be1a44ef9ebe7b6f3bb73bbcffe9f8e5cf854056c8d7588eaf107d461
|
||||
size 3179138560
|
||||
3
Loki.Q3_K_L.gguf
Normal file
3
Loki.Q3_K_L.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:f9f901900932f5f8ad954ec096ccfe0e459884c74c906383ef83c402521426f1
|
||||
size 4321963520
|
||||
3
Loki.Q3_K_M.gguf
Normal file
3
Loki.Q3_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:c71d6488f953e34c77d24751ea93edc0eec5c4a30def92070a4ca0f5d76a8161
|
||||
size 4018925056
|
||||
3
Loki.Q3_K_S.gguf
Normal file
3
Loki.Q3_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:1a5f2e392b2802221fd3e44acdbd153316cb153710fcc83280d337317ece873e
|
||||
size 3664506368
|
||||
3
Loki.Q4_K_M.gguf
Normal file
3
Loki.Q4_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:8fbd78c993ae4d0745dd583ad9f468b63c21de2dc2fa804ca81e6bb6c0a1eb54
|
||||
size 4920741376
|
||||
3
Loki.Q4_K_S.gguf
Normal file
3
Loki.Q4_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:d681dce4787c5406277780527f9c9114e92dd4ecd2a5cd694d62cb636fbe78e2
|
||||
size 4692676096
|
||||
3
Loki.Q5_K_M.gguf
Normal file
3
Loki.Q5_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:c08094835824bf5f0fc2b0f0ddef2a769f37f531fd4dce37c50304d8cbf1abe2
|
||||
size 5732994560
|
||||
3
Loki.Q5_K_S.gguf
Normal file
3
Loki.Q5_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:2c7d13f421e331883ebd5505fd89e67dc7858025324bdde4b6d95939979aee6b
|
||||
size 5599301120
|
||||
3
Loki.Q6_K.gguf
Normal file
3
Loki.Q6_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:f51234932e5f93d02efda04741eaa2fdf94b0f40de8c57c120a2b7bea3f61642
|
||||
size 6596013568
|
||||
3
Loki.Q8_0.gguf
Normal file
3
Loki.Q8_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:f6942d4242176804e27d0afb6fd0c9d18d95b9ec0dc926b4fa538daa4f3241cd
|
||||
size 8540777984
|
||||
3
Loki.f16.gguf
Normal file
3
Loki.f16.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:0daa7d5f74c5cdf09bfcac8bef0074c7ee3d953a36e796f3bfb412e477a7b799
|
||||
size 16068898304
|
||||
69
README.md
Normal file
69
README.md
Normal file
@@ -0,0 +1,69 @@
|
||||
---
|
||||
base_model: MrRobotoAI/Loki
|
||||
language:
|
||||
- en
|
||||
library_name: transformers
|
||||
quantized_by: mradermacher
|
||||
tags:
|
||||
- mergekit
|
||||
- merge
|
||||
---
|
||||
## About
|
||||
|
||||
<!-- ### quantize_version: 2 -->
|
||||
<!-- ### output_tensor_quantised: 1 -->
|
||||
<!-- ### convert_type: hf -->
|
||||
<!-- ### vocab_type: -->
|
||||
<!-- ### tags: -->
|
||||
static quants of https://huggingface.co/MrRobotoAI/Loki
|
||||
|
||||
<!-- provided-files -->
|
||||
weighted/imatrix quants are available at https://huggingface.co/mradermacher/Loki-i1-GGUF
|
||||
## Usage
|
||||
|
||||
If you are unsure how to use GGUF files, refer to one of [TheBloke's
|
||||
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
|
||||
more details, including on how to concatenate multi-part files.
|
||||
|
||||
## Provided Quants
|
||||
|
||||
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
|
||||
|
||||
| Link | Type | Size/GB | Notes |
|
||||
|:-----|:-----|--------:|:------|
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.Q2_K.gguf) | Q2_K | 3.3 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.IQ3_XS.gguf) | IQ3_XS | 3.6 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.Q3_K_S.gguf) | Q3_K_S | 3.8 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.IQ3_S.gguf) | IQ3_S | 3.8 | beats Q3_K* |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.IQ3_M.gguf) | IQ3_M | 3.9 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.Q3_K_M.gguf) | Q3_K_M | 4.1 | lower quality |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.Q3_K_L.gguf) | Q3_K_L | 4.4 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.IQ4_XS.gguf) | IQ4_XS | 4.6 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.Q4_K_S.gguf) | Q4_K_S | 4.8 | fast, recommended |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.Q4_K_M.gguf) | Q4_K_M | 5.0 | fast, recommended |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.Q5_K_S.gguf) | Q5_K_S | 5.7 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.Q5_K_M.gguf) | Q5_K_M | 5.8 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.Q6_K.gguf) | Q6_K | 6.7 | very good quality |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.Q8_0.gguf) | Q8_0 | 8.6 | fast, best quality |
|
||||
| [GGUF](https://huggingface.co/mradermacher/Loki-GGUF/resolve/main/Loki.f16.gguf) | f16 | 16.2 | 16 bpw, overkill |
|
||||
|
||||
Here is a handy graph by ikawrakow comparing some lower-quality quant
|
||||
types (lower is better):
|
||||
|
||||

|
||||
|
||||
And here are Artefact2's thoughts on the matter:
|
||||
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
|
||||
|
||||
## FAQ / Model Request
|
||||
|
||||
See https://huggingface.co/mradermacher/model_requests for some answers to
|
||||
questions you might have and/or if you want some other model quantized.
|
||||
|
||||
## Thanks
|
||||
|
||||
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
|
||||
me use its servers and providing upgrades to my workstation to enable
|
||||
this work in my free time.
|
||||
|
||||
<!-- end -->
|
||||
Reference in New Issue
Block a user