初始化项目,由ModelHub XC社区提供模型

Model: mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-05-10 12:33:22 +08:00
commit ba44125a58
25 changed files with 208 additions and 0 deletions

58
.gitattributes vendored Normal file
View File

@@ -0,0 +1,58 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
imatrix.dat filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
Gemma2-9B-KuwaNovelist-v3.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:26959f5a969f1f55756cbf1460b0668518f7727a4875d73083aa52017ce6ea48
size 2545952896

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f7babcbc492cd95c3a4ca637f8cbfa1961b7a8fab0b952a7716de7ccb754ce17
size 2378565760

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9bebfb2ed912b2261f9925dd376c5eb6146299a54500077ffa9ad1506b045eee
size 3434670208

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c9359175af7a7467513aec4eefb6db3b0ce9febf74d3f5a1c5dcf22dcba0442a
size 3211487360

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:0bebb4cbe1977dd6d655b7fff2c7d24254bf79a491647ae0a5ea72f7fe3e5603
size 3067381888

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e3b427f3b110c4b4746ef4e5afeec7abd3a90dd198565dd39a2e501ae69a8333
size 2824931456

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:062177085545145f119e5c46b34673ced5800381bc0e55d8f7b96d41f82245ca
size 4494616704

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:06c42b211fe3c15bef700ab3cc5a9a692c328b01fc9335658243c78f664a9d28
size 4337666176

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a160ca0e9b3d19e3c1feafc057e00fdbb0a3f39ed0198ffff88a84cb286efdcc
size 4144990336

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b28bfdd4c176bbe365d86b302e13ff05c09f9d10583a2d951b859c4af4961acd
size 3796740224

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:78d8e859906389bf31b9cce208782a262ec36b9e8ab9e8cec3bce699063de7eb
size 5183031424

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7c75931131067bffd4d2094893c3643d2c79a8f271c8a0c29aa01d024defa806
size 3805399168

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f8c814dba018f1371071519c2745c99b53eef9016c8f63fea1c4f8cf592535af
size 3552512128

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7281478cfeee39fc9417838c86a5c97aca23de243fed2d922c572d8ef441679f
size 5132454016

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9998802ce9089f43b07a7543a820e380e86dea9e689c7fb4b4ea784ec6ac01a8
size 4761782400

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9b06781b63fe75e4616f4f349b06e03ea652c31ad43f05fd79c1a14c75cf6ebe
size 4337666176

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e7f20221ffb6933fc619c5a91c406ae8447fbf9973f0f77bcd57bef272685e8d
size 5459200128

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:434ebb3550ddc7b53d4b823df8898ee284b440b5b9c1f13d4a273f376462988a
size 5761058944

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:55e1e5198e295930f3d8ace30350203b28aad17baea73f79451f642511118fe3
size 5478926464

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8464df124bca803f138ebecc44810ccb5c8183b2bd113c4d4e50bfffb08af4bf
size 6647367808

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f8a45a63f925f846aec64ec2b5a6014bc8fe9c52d911a4c846da59d2e2208ce5
size 6483593344

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:04aaf77fa8d79aa41a4c1a43e73f41e84a8a05eaaff2ba5fb9ea260bd48f2e0e
size 7589070976

81
README.md Normal file
View File

@@ -0,0 +1,81 @@
---
base_model: Alsebay/Gemma2-9B-KuwaNovelist-v3
language:
- en
library_name: transformers
license: gemma
quantized_by: mradermacher
tags:
- text-generation-inference
- transformers
- unsloth
- gemma2
- trl
- sft
---
## About
<!-- ### quantize_version: 2 -->
<!-- ### output_tensor_quantised: 1 -->
<!-- ### convert_type: hf -->
<!-- ### vocab_type: -->
<!-- ### tags: nicoboss -->
weighted/imatrix quants of https://huggingface.co/Alsebay/Gemma2-9B-KuwaNovelist-v3
<!-- provided-files -->
static quants are available at https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-GGUF
## Usage
If you are unsure how to use GGUF files, refer to one of [TheBloke's
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
more details, including on how to concatenate multi-part files.
## Provided Quants
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
| Link | Type | Size/GB | Notes |
|:-----|:-----|--------:|:------|
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-IQ1_S.gguf) | i1-IQ1_S | 2.5 | for the desperate |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-IQ1_M.gguf) | i1-IQ1_M | 2.6 | mostly desperate |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 2.9 | |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-IQ2_XS.gguf) | i1-IQ2_XS | 3.2 | |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-IQ2_S.gguf) | i1-IQ2_S | 3.3 | |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-IQ2_M.gguf) | i1-IQ2_M | 3.5 | |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-Q2_K_S.gguf) | i1-Q2_K_S | 3.7 | very low quality |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 3.9 | lower quality |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-Q2_K.gguf) | i1-Q2_K | 3.9 | IQ3_XXS probably better |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-IQ3_XS.gguf) | i1-IQ3_XS | 4.2 | |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-IQ3_S.gguf) | i1-IQ3_S | 4.4 | beats Q3_K* |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-Q3_K_S.gguf) | i1-Q3_K_S | 4.4 | IQ3_XS probably better |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-IQ3_M.gguf) | i1-IQ3_M | 4.6 | |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-Q3_K_M.gguf) | i1-Q3_K_M | 4.9 | IQ3_S probably better |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-Q3_K_L.gguf) | i1-Q3_K_L | 5.2 | IQ3_M probably better |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-IQ4_XS.gguf) | i1-IQ4_XS | 5.3 | |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-Q4_0.gguf) | i1-Q4_0 | 5.6 | fast, low quality |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-Q4_K_S.gguf) | i1-Q4_K_S | 5.6 | optimal size/speed/quality |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-Q4_K_M.gguf) | i1-Q4_K_M | 5.9 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-Q5_K_S.gguf) | i1-Q5_K_S | 6.6 | |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-Q5_K_M.gguf) | i1-Q5_K_M | 6.7 | |
| [GGUF](https://huggingface.co/mradermacher/Gemma2-9B-KuwaNovelist-v3-i1-GGUF/resolve/main/Gemma2-9B-KuwaNovelist-v3.i1-Q6_K.gguf) | i1-Q6_K | 7.7 | practically like static Q6_K |
Here is a handy graph by ikawrakow comparing some lower-quality quant
types (lower is better):
![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png)
And here are Artefact2's thoughts on the matter:
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
## FAQ / Model Request
See https://huggingface.co/mradermacher/model_requests for some answers to
questions you might have and/or if you want some other model quantized.
## Thanks
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
me use its servers and providing upgrades to my workstation to enable
this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to.
<!-- end -->

3
imatrix.dat Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:bfc0ef70662e4ca9f9ab228f4f61df70359f060a433f189f3e2069d1aff6a2ac
size 6116887