初始化项目,由ModelHub XC社区提供模型

Model: mradermacher/gemma-2-9b-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-06-14 16:44:20 +08:00
commit f7a79ae7c6
17 changed files with 167 additions and 0 deletions

50
.gitattributes vendored Normal file
View File

@@ -0,0 +1,50 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.f16.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
gemma-2-9b.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text

72
README.md Normal file
View File

@@ -0,0 +1,72 @@
---
base_model: google/gemma-2-9b
extra_gated_button_content: Acknowledge license
extra_gated_heading: Access Gemma on Hugging Face
extra_gated_prompt: To access Gemma on Hugging Face, youre required to review and
agree to Googles usage license. To do this, please ensure youre logged in to Hugging
Face and click below. Requests are processed immediately.
language:
- en
library_name: transformers
license: gemma
quantized_by: mradermacher
---
## About
<!-- ### quantize_version: 2 -->
<!-- ### output_tensor_quantised: 1 -->
<!-- ### convert_type: hf -->
<!-- ### vocab_type: -->
<!-- ### tags: -->
static quants of https://huggingface.co/google/gemma-2-9b
<!-- provided-files -->
weighted/imatrix quants are available at https://huggingface.co/mradermacher/gemma-2-9b-i1-GGUF
## Usage
If you are unsure how to use GGUF files, refer to one of [TheBloke's
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
more details, including on how to concatenate multi-part files.
## Provided Quants
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
| Link | Type | Size/GB | Notes |
|:-----|:-----|--------:|:------|
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.Q2_K.gguf) | Q2_K | 3.9 | |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.IQ3_XS.gguf) | IQ3_XS | 4.2 | |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.IQ3_S.gguf) | IQ3_S | 4.4 | beats Q3_K* |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.Q3_K_S.gguf) | Q3_K_S | 4.4 | |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.IQ3_M.gguf) | IQ3_M | 4.6 | |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.Q3_K_M.gguf) | Q3_K_M | 4.9 | lower quality |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.Q3_K_L.gguf) | Q3_K_L | 5.2 | |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.IQ4_XS.gguf) | IQ4_XS | 5.3 | |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.Q4_K_S.gguf) | Q4_K_S | 5.6 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.Q4_K_M.gguf) | Q4_K_M | 5.9 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.Q5_K_S.gguf) | Q5_K_S | 6.6 | |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.Q5_K_M.gguf) | Q5_K_M | 6.7 | |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.Q6_K.gguf) | Q6_K | 7.7 | very good quality |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.Q8_0.gguf) | Q8_0 | 9.9 | fast, best quality |
| [GGUF](https://huggingface.co/mradermacher/gemma-2-9b-GGUF/resolve/main/gemma-2-9b.f16.gguf) | f16 | 18.6 | 16 bpw, overkill |
Here is a handy graph by ikawrakow comparing some lower-quality quant
types (lower is better):
![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png)
And here are Artefact2's thoughts on the matter:
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
## FAQ / Model Request
See https://huggingface.co/mradermacher/model_requests for some answers to
questions you might have and/or if you want some other model quantized.
## Thanks
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
me use its servers and providing upgrades to my workstation to enable
this work in my free time.
<!-- end -->

3
gemma-2-9b.IQ3_M.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:0133ac259987d54fb2b744a431079e2eb8e2287056bffffe24579c877a75a75b
size 4494616000

3
gemma-2-9b.IQ3_S.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:fcd713893a3612b8a3c240e062cb7fb8b1457472a82293bc5374c83993da9ead
size 4337665472

3
gemma-2-9b.IQ3_XS.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6f64278ae4985ca4aa0b7cd409ec3cb72e4f99abe743b3a539d144c33fbaa73f
size 4144989632

3
gemma-2-9b.IQ4_XS.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:30b4a6649033dd9dfa38cf8bd01e8a21a6a73000f049703663488f50bd4ac8a9
size 5223171520

3
gemma-2-9b.Q2_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f58dcd82e00ea1d36b817445d9057a9db397300a757ee4edf4391f7ba2f93ed4
size 3805398464

3
gemma-2-9b.Q3_K_L.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:0b1147d0f40d8544e006ef82e53d3a1295a9d782b3b527205c66b1c76091cb54
size 5132453312

3
gemma-2-9b.Q3_K_M.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:cf8b4b29d190221e97f917ac98752a2dfabb0564bfb95a651e1e368ef8b95846
size 4761781696

3
gemma-2-9b.Q3_K_S.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:80a5f0a001b1f5961cbe899723cf73811e6b22987024a469f4296cc30dcb57e9
size 4337665472

3
gemma-2-9b.Q4_K_M.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:eceb44190366047c155468e307a00a1710b52b4730fad87a720374f275b097eb
size 5761058240

3
gemma-2-9b.Q4_K_S.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ba127604b3e2b3480982d2e481f737c3a19f3f91843103f450c1715eb27ec791
size 5478925760

3
gemma-2-9b.Q5_K_M.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:672ffac1dcd27566dfc5dc2729e001512dfee2ed23c5ca10a0b5a796ee570b24
size 6647367104

3
gemma-2-9b.Q5_K_S.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:51888bd65452164c16fcc4d375ab694413518974d6e4cae005abb556a49f7dd1
size 6483592640

3
gemma-2-9b.Q6_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7660ebe3a0f190fc3d661ef70ade8f919084e35afc07f972674423efc0cc7881
size 7589070272

3
gemma-2-9b.Q8_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:59058993e3962b751836b1aec9214fb710b7a6d427fff9f4a27b399fb76fbd47
size 9827149248

3
gemma-2-9b.f16.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:3d6877342eb22e38d271df3b88a5056fc01b7b14754bf1d29424aba41deaab5d
size 18490680768