初始化项目,由ModelHub XC社区提供模型

Model: mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-06-17 18:52:16 +08:00
commit feaae9f94e
24 changed files with 198 additions and 0 deletions

57
.gitattributes vendored Normal file
View File

@@ -0,0 +1,57 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
imatrix.dat filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text
mistral-nemo-gutenberg-12B.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text

75
README.md Normal file
View File

@@ -0,0 +1,75 @@
---
base_model: nbeerbower/mistral-nemo-gutenberg-12B
datasets:
- jondurbin/gutenberg-dpo-v0.1
language:
- en
library_name: transformers
license: apache-2.0
quantized_by: mradermacher
---
## About
<!-- ### quantize_version: 2 -->
<!-- ### output_tensor_quantised: 1 -->
<!-- ### convert_type: hf -->
<!-- ### vocab_type: -->
<!-- ### tags: nicoboss -->
weighted/imatrix quants of https://huggingface.co/nbeerbower/mistral-nemo-gutenberg-12B
<!-- provided-files -->
static quants are available at https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-GGUF
## Usage
If you are unsure how to use GGUF files, refer to one of [TheBloke's
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
more details, including on how to concatenate multi-part files.
## Provided Quants
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
| Link | Type | Size/GB | Notes |
|:-----|:-----|--------:|:------|
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-IQ1_S.gguf) | i1-IQ1_S | 3.1 | for the desperate |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-IQ1_M.gguf) | i1-IQ1_M | 3.3 | mostly desperate |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 3.7 | |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-IQ2_XS.gguf) | i1-IQ2_XS | 4.0 | |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-IQ2_S.gguf) | i1-IQ2_S | 4.2 | |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-IQ2_M.gguf) | i1-IQ2_M | 4.5 | |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-Q2_K.gguf) | i1-Q2_K | 4.9 | IQ3_XXS probably better |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 5.0 | lower quality |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-IQ3_XS.gguf) | i1-IQ3_XS | 5.4 | |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-Q3_K_S.gguf) | i1-Q3_K_S | 5.6 | IQ3_XS probably better |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-IQ3_S.gguf) | i1-IQ3_S | 5.7 | beats Q3_K* |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-IQ3_M.gguf) | i1-IQ3_M | 5.8 | |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-Q3_K_M.gguf) | i1-Q3_K_M | 6.2 | IQ3_S probably better |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-Q3_K_L.gguf) | i1-Q3_K_L | 6.7 | IQ3_M probably better |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-IQ4_XS.gguf) | i1-IQ4_XS | 6.8 | |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-Q4_0.gguf) | i1-Q4_0 | 7.2 | fast, low quality |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-Q4_K_S.gguf) | i1-Q4_K_S | 7.2 | optimal size/speed/quality |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-Q4_K_M.gguf) | i1-Q4_K_M | 7.6 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-Q5_K_S.gguf) | i1-Q5_K_S | 8.6 | |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-Q5_K_M.gguf) | i1-Q5_K_M | 8.8 | |
| [GGUF](https://huggingface.co/mradermacher/mistral-nemo-gutenberg-12B-i1-GGUF/resolve/main/mistral-nemo-gutenberg-12B.i1-Q6_K.gguf) | i1-Q6_K | 10.2 | practically like static Q6_K |
Here is a handy graph by ikawrakow comparing some lower-quality quant
types (lower is better):
![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png)
And here are Artefact2's thoughts on the matter:
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
## FAQ / Model Request
See https://huggingface.co/mradermacher/model_requests for some answers to
questions you might have and/or if you want some other model quantized.
## Thanks
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
me use its servers and providing upgrades to my workstation to enable
this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to.
<!-- end -->

3
imatrix.dat Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d5c8a8225abba263408e6415cd72f588fcbe38b9ff4cf534e81c6edffca75d2f
size 7054405

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:add9ebf1a38e5595e5d9b821865ae6e9fa4ca1f4cf04c67bd425407999dfd18a
size 3221628288

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:2a8b14cfaedffee036e3f0699f58d2f779dfca9d30009542ee8a9b4791f84c4f
size 2999215488

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:012586298187a9d4a269d828e1524db8f6aba894932abe517f5cea3ce6329ee8
size 4435027328

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:64318532fac860eb8d0d9f50efe4d01b8d05f86b36ea06b5b3ae3ac702c10d31
size 4138476928

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:bb4f6111e53c5df57ccfe2f3f1c7593950cf3dc72b449cbaf98024768de9c2c0
size 3915081088

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e49624d9c0f7941ad4a4867303e016bfee2d8f9e7ec542a9d1829f3a0c826dd7
size 3592316288

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c39fd4645f8a1c07304c40e410ee947332bc7c56237a11446de73c1e7012e8e4
size 5722236288

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b0fb7ad70cc4e2a4df4be29310b25f7a552d58b2f46dc59ebda5d521e44b5d21
size 5562082688

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:5fd59287120096f8943ba7d0c252060df18c552543edeebb309b91803e5673f6
size 5306492288

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:08549262387e07e8b8e5cd404bcfc7c27dd5983f221f5b9141a8a5156eef7d8f
size 4945388928

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:bb09d60c93c899160018b27bfb2fe0b22c7bdef61b0991a68d757863e4467081
size 6742713728

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:94525aafa4417bb4aa4638915c0a992a76cd3ab871bfcdc97ef4926aa41835fa
size 4791051648

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:2c4a8f02ea7d1e36f6a035f787721549e21d586378c9b951e18503107f4fbfb8
size 6561506688

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d80ad8c4d552b127c1aa8caf8889b59d7a76858a43cd10fe6c680fbc7b2f54d3
size 6083093888

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a9fef9f3bff12a5ad21234987e4f6e04f83c09fb2783c03bb94bb2c7f7bbd831
size 5534229888

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a22de49bd96a4a804d33e51ea7a0ba4e55459f5799c8a666694a14fc0525f9e5
size 7094642048

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ac614240fb177c17f69ae80076cf6645e92ec65be148594785734f29d9370375
size 7477208448

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b0930e2ca4f4331c0f92e03210bd8e86b25d758a0aad4c951e70cb37b91b44c3
size 7120201088

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:aec11f254eb41d8c1298bde84d96059257acbf683748091e95a0bb578410f041
size 8727635328

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:0c0327155900f23102639b0cc779e3a37ca4fdc998b45145bd53d16b5b249f3e
size 8518739328

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:84518f0cc71abc28731d5fd6f2eabc05f2fd51dd0e1594dd601463a7db795cf6
size 10056213888