初始化项目,由ModelHub XC社区提供模型

Model: mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-08-06 04:27:16 +08:00
commit 1d2d6d7ccc
26 changed files with 210 additions and 0 deletions

59
.gitattributes vendored Normal file
View File

@@ -0,0 +1,59 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-IQ4_NL.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text
Llama_3.1_8b_Hermedive_V1.01.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:81a18cf0c9335bc0a8196c5e692addebd30948986bb088a72f862277d6783807
size 2162111008

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8414030e74b47b9161752bc98c8f4c1386eb27279a3127782c9eb2e40c1b95b0
size 2019766816

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9dca31a20bae7bc1ed505972b0795861157402f09a762a64103533ac0b827057
size 2948433440

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:82be081d77d1661683f4d550ef9a9ad1026dfc0e996ff8e20a061294c065c898
size 2758641184

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:440716b1a9ca872821dc2822c9fb60d07a4fef2edfbb89e11841245d678c966d
size 2605920800

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4181a23385016d92840aea24ae7efd8b07f4a7a37eb90793e80ce8618cbefdad
size 2399351328

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4a76ffe94b849f98a6ff3899a49ef9feffab15bb08c47c079ca8add9642c8e1c
size 3784993312

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:816586a78dd6ac4dd2a8040f55a445c5d07dabd831520011762dda9d9b5d2c78
size 3682495008

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:26e56eebf764feb45fbcb7c5fe0e5f631bd4ccb3f5e6ce4fd09e31273619fcbf
size 3518917152

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f80f196eb76a041cca0d7242832f39a84c43a300b690f0732e5bb7650b9e6e75
size 3275064864

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:017e1807e236faa0ef3a4a1fefd3ae5c65096d63eff15bb1513b28d0c87ff5ae
size 4678176288

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f61ecef59d647aae3fb5ce55710f02a7e2a34d70629b2c2012af3a3baf7dac03
size 4447845920

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b8038201835ada7e0ea8cf9de49ec418776db0f6a7a652bbc8c07427b0d10525
size 3179288096

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:220c913faf22b1a641da29ae4c168610d2626a58ed81519eb2a0329f7b95a1dd
size 2988971552

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e83bfba368863a727d3d73500acae1ba132fc1c67f72a9f34494312e62f0ca9c
size 4322126368

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:867ccd6dc676b06d80fb0b1289db7e3b9cd3352049b9a2e741391115b469ee4e
size 4019087904

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b9878f6e82d0d247b3fee734fdcaf4f4beff0662958735b72eef91be83b1ac75
size 3664669216

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8f2bd25794d482a365b8aeaba8a9e8640c117f89a32b82d533621fc1a6b66fe9
size 4676079136

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:222fd4cc9cf27bd05509c881660d7392abbdf955eda3a8062c1e199c8293469d
size 5130448416

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ea914b5dbff5aaf14a6eb29446aa077e8ecd5a22fce47e704451a7f7cf0fbd56
size 4920921632

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e0f1c41b196635f257919296de973bd2950aa88acdb351436fa92556823d24be
size 4692856352

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:2316f7f0c59958a21c92e2c8248e3e88e133cfe680d0bea1eb72386a87011130
size 5733191200

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:2d7d66f34c02d2043c966913fb890d753ee362d52a8235c2548c01993c0b8764
size 5599497760

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8536d08e2682320e568c8d05e8bd519486da32ce4f873dc92dd66d2d9aa88b7c
size 6596227616

79
README.md Normal file
View File

@@ -0,0 +1,79 @@
---
base_model: Nexesenex/Llama_3.1_8b_Hermedive_V1.01
language:
- en
library_name: transformers
license: llama3.1
quantized_by: mradermacher
tags:
- mergekit
- merge
---
## About
<!-- ### quantize_version: 2 -->
<!-- ### output_tensor_quantised: 1 -->
<!-- ### convert_type: hf -->
<!-- ### vocab_type: -->
<!-- ### tags: nicoboss -->
weighted/imatrix quants of https://huggingface.co/Nexesenex/Llama_3.1_8b_Hermedive_V1.01
<!-- provided-files -->
static quants are available at https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-GGUF
## Usage
If you are unsure how to use GGUF files, refer to one of [TheBloke's
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
more details, including on how to concatenate multi-part files.
## Provided Quants
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
| Link | Type | Size/GB | Notes |
|:-----|:-----|--------:|:------|
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-IQ1_S.gguf) | i1-IQ1_S | 2.1 | for the desperate |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-IQ1_M.gguf) | i1-IQ1_M | 2.3 | mostly desperate |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 2.5 | |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-IQ2_XS.gguf) | i1-IQ2_XS | 2.7 | |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-IQ2_S.gguf) | i1-IQ2_S | 2.9 | |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-IQ2_M.gguf) | i1-IQ2_M | 3.0 | |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-Q2_K_S.gguf) | i1-Q2_K_S | 3.1 | very low quality |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-Q2_K.gguf) | i1-Q2_K | 3.3 | IQ3_XXS probably better |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 3.4 | lower quality |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-IQ3_XS.gguf) | i1-IQ3_XS | 3.6 | |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-Q3_K_S.gguf) | i1-Q3_K_S | 3.8 | IQ3_XS probably better |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-IQ3_S.gguf) | i1-IQ3_S | 3.8 | beats Q3_K* |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-IQ3_M.gguf) | i1-IQ3_M | 3.9 | |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-Q3_K_M.gguf) | i1-Q3_K_M | 4.1 | IQ3_S probably better |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-Q3_K_L.gguf) | i1-Q3_K_L | 4.4 | IQ3_M probably better |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-IQ4_XS.gguf) | i1-IQ4_XS | 4.5 | |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-Q4_0.gguf) | i1-Q4_0 | 4.8 | fast, low quality |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-IQ4_NL.gguf) | i1-IQ4_NL | 4.8 | prefer IQ4_XS |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-Q4_K_S.gguf) | i1-Q4_K_S | 4.8 | optimal size/speed/quality |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-Q4_K_M.gguf) | i1-Q4_K_M | 5.0 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-Q4_1.gguf) | i1-Q4_1 | 5.2 | |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-Q5_K_S.gguf) | i1-Q5_K_S | 5.7 | |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-Q5_K_M.gguf) | i1-Q5_K_M | 5.8 | |
| [GGUF](https://huggingface.co/mradermacher/Llama_3.1_8b_Hermedive_V1.01-i1-GGUF/resolve/main/Llama_3.1_8b_Hermedive_V1.01.i1-Q6_K.gguf) | i1-Q6_K | 6.7 | practically like static Q6_K |
Here is a handy graph by ikawrakow comparing some lower-quality quant
types (lower is better):
![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png)
And here are Artefact2's thoughts on the matter:
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
## FAQ / Model Request
See https://huggingface.co/mradermacher/model_requests for some answers to
questions you might have and/or if you want some other model quantized.
## Thanks
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
me use its servers and providing upgrades to my workstation to enable
this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to.
<!-- end -->