初始化项目,由ModelHub XC社区提供模型

Model: mradermacher/mamba-ko-2.8b-i1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-06-19 17:02:22 +08:00
commit d98d0494dc
25 changed files with 205 additions and 0 deletions

58
.gitattributes vendored Normal file
View File

@@ -0,0 +1,58 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
imatrix.dat filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
mamba-ko-2.8b.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text

78
README.md Normal file
View File

@@ -0,0 +1,78 @@
---
base_model: kuotient/mamba-ko-2.8b
datasets:
- maywell/korean_textbooks
language:
- ko
library_name: transformers
license: apache-2.0
quantized_by: mradermacher
tags:
- mamba
---
## About
<!-- ### quantize_version: 2 -->
<!-- ### output_tensor_quantised: 1 -->
<!-- ### convert_type: hf -->
<!-- ### vocab_type: -->
<!-- ### tags: nicoboss -->
weighted/imatrix quants of https://huggingface.co/kuotient/mamba-ko-2.8b
<!-- provided-files -->
static quants are available at https://huggingface.co/mradermacher/mamba-ko-2.8b-GGUF
## Usage
If you are unsure how to use GGUF files, refer to one of [TheBloke's
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
more details, including on how to concatenate multi-part files.
## Provided Quants
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
| Link | Type | Size/GB | Notes |
|:-----|:-----|--------:|:------|
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-IQ1_S.gguf) | i1-IQ1_S | 0.8 | for the desperate |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-IQ1_M.gguf) | i1-IQ1_M | 0.8 | mostly desperate |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 0.9 | |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-IQ2_S.gguf) | i1-IQ2_S | 1.0 | |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-IQ2_XS.gguf) | i1-IQ2_XS | 1.0 | |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-IQ2_M.gguf) | i1-IQ2_M | 1.1 | |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-Q2_K.gguf) | i1-Q2_K | 1.1 | IQ3_XXS probably better |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-Q2_K_S.gguf) | i1-Q2_K_S | 1.1 | very low quality |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 1.2 | lower quality |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-IQ3_M.gguf) | i1-IQ3_M | 1.4 | |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-IQ3_S.gguf) | i1-IQ3_S | 1.4 | beats Q3_K* |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-IQ3_XS.gguf) | i1-IQ3_XS | 1.4 | |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-Q3_K_L.gguf) | i1-Q3_K_L | 1.4 | IQ3_M probably better |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-Q3_K_M.gguf) | i1-Q3_K_M | 1.4 | IQ3_S probably better |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-Q3_K_S.gguf) | i1-Q3_K_S | 1.4 | IQ3_XS probably better |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-IQ4_XS.gguf) | i1-IQ4_XS | 1.6 | |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-Q4_0.gguf) | i1-Q4_0 | 1.7 | fast, low quality |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-Q4_K_M.gguf) | i1-Q4_K_M | 1.7 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-Q4_K_S.gguf) | i1-Q4_K_S | 1.7 | optimal size/speed/quality |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-Q5_K_M.gguf) | i1-Q5_K_M | 2.1 | |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-Q5_K_S.gguf) | i1-Q5_K_S | 2.1 | |
| [GGUF](https://huggingface.co/mradermacher/mamba-ko-2.8b-i1-GGUF/resolve/main/mamba-ko-2.8b.i1-Q6_K.gguf) | i1-Q6_K | 2.4 | practically like static Q6_K |
Here is a handy graph by ikawrakow comparing some lower-quality quant
types (lower is better):
![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png)
And here are Artefact2's thoughts on the matter:
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
## FAQ / Model Request
See https://huggingface.co/mradermacher/model_requests for some answers to
questions you might have and/or if you want some other model quantized.
## Thanks
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
me use its servers and providing upgrades to my workstation to enable
this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to.
<!-- end -->

3
imatrix.dat Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:3744f888a294723965fd1e6f9c0dbab4849283ca77ecc0286303f1a6daea2a7b
size 3325947

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:5d951f35409a37b2671626a1f9c26d9f9c19fe4350e28f467a52d16571dda1b7
size 714866464

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a30d8917cb30d7dae91ea9b9e9288319e8c17d8778b4d53f6dcd87d1a8a427cd
size 654409504

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6ce867d6875f6b9a6acf38eefe0552b205e719646b2a413fe73a4bcd8ca7a4d6
size 976846624

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8273f810ecccdc5dce1c0f1be296a3e2ea68674fcbc88065af0f957c78190c2b
size 896237344

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b7863ca121e8d579a45d6a8718716ae4fb303940cf23d45575a36622f4097a35
size 896237344

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ed775e9c1f99e879b6e8f51259561bfb39dd795a7a03890823d54d2d11ea7609
size 815628064

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4a0706bb5b816f2820878acf2d27345ffad2f49ba631915dbd66900000107079
size 1276074304

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a64d96257c036a4a5540aef0875494c8d620c31d26377d1a36f066599b6b3041
size 1276074304

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:70d9236eac67ecc5093fdcf3dc7ac379327ee1b98045bbc01b7472a84f7ab4e8
size 1276074304

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9a4548c8e389456de1263cabb1758a9f1d30cf7415fa60d70387f225f1fb9848
size 1138065184

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:95c66d5d7183dc6e8326e42d3e179c7ba705b21587497ddfc9f38e34359e7da3
size 1538054464

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e129529c994badd04d1233c26d42b06e712f11098526f4732d3f9f3a96a12f63
size 1014094144

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c2808ecabcff1e2eb5f45ab64166b7ec24f094d9cf057b94c1bffa78e710981c
size 1014094144

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7ebb412a2ef1e8d00d9a8377837cdba4c01bd393d79ff07aab3cecc9bba1f90f
size 1276074304

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:808502eeb8e3098dc033cb66bc9dfae0fc9166436bf49dc7572e3e1502229004
size 1276074304

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6ad5e962e545c7bca8f04f06c9d7f7fa917adc7b6d311504de26470904253763
size 1276074304

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8d4b63d14e6b86d496c743e02dd5eee3bf3b347768f1b988fc5df649d1a19e15
size 1618663744

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b5a1167be8be53475fdb860f6f34a160e8224a5abedd26ca5e891d4a5145ec2f
size 1625217344

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:bf47209bf09601f0bcfccfa594a4bfb70be0c06449c66f1b802555c8ad29d1f8
size 1625217344

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c9e1417d82831c508ebcb1ad6942a5c6a1b01d633c67be39ee056824d4676e69
size 1950931264

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:17bc49d6fe69e928a2c402e1c20506104896758a2170ab069f97dff2305e4136
size 1950931264

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d8df1c15ee27c7ab0b02236eb30686784a5173cd3e68cd210d6018f2805437ac
size 2309904704