初始化项目,由ModelHub XC社区提供模型

Model: mradermacher/deepseek-moe-16b-base-i1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-06-13 23:56:20 +08:00
commit 7429bb4704
27 changed files with 213 additions and 0 deletions

60
.gitattributes vendored Normal file
View File

@@ -0,0 +1,60 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
imatrix.dat filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-IQ4_NL.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text
deepseek-moe-16b-base.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text

78
README.md Normal file
View File

@@ -0,0 +1,78 @@
---
base_model: deepseek-ai/deepseek-moe-16b-base
language:
- en
library_name: transformers
license: other
license_link: https://github.com/deepseek-ai/DeepSeek-MoE/blob/main/LICENSE-MODEL
license_name: deepseek
quantized_by: mradermacher
---
## About
<!-- ### quantize_version: 2 -->
<!-- ### output_tensor_quantised: 1 -->
<!-- ### convert_type: hf -->
<!-- ### vocab_type: -->
<!-- ### tags: nicoboss -->
weighted/imatrix quants of https://huggingface.co/deepseek-ai/deepseek-moe-16b-base
<!-- provided-files -->
static quants are available at https://huggingface.co/mradermacher/deepseek-moe-16b-base-GGUF
## Usage
If you are unsure how to use GGUF files, refer to one of [TheBloke's
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
more details, including on how to concatenate multi-part files.
## Provided Quants
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
| Link | Type | Size/GB | Notes |
|:-----|:-----|--------:|:------|
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-IQ1_S.gguf) | i1-IQ1_S | 5.3 | for the desperate |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-IQ1_M.gguf) | i1-IQ1_M | 5.6 | mostly desperate |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 6.0 | |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-IQ2_XS.gguf) | i1-IQ2_XS | 6.3 | |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-IQ2_S.gguf) | i1-IQ2_S | 6.4 | |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-IQ2_M.gguf) | i1-IQ2_M | 6.7 | |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-Q2_K.gguf) | i1-Q2_K | 6.8 | IQ3_XXS probably better |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-Q2_K_S.gguf) | i1-Q2_K_S | 6.8 | very low quality |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 7.3 | lower quality |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-IQ3_XS.gguf) | i1-IQ3_XS | 7.5 | |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-IQ3_S.gguf) | i1-IQ3_S | 7.9 | beats Q3_K* |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-Q3_K_S.gguf) | i1-Q3_K_S | 7.9 | IQ3_XS probably better |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-IQ3_M.gguf) | i1-IQ3_M | 8.0 | |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-Q3_K_M.gguf) | i1-Q3_K_M | 8.6 | IQ3_S probably better |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-Q3_K_L.gguf) | i1-Q3_K_L | 8.9 | IQ3_M probably better |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-IQ4_XS.gguf) | i1-IQ4_XS | 9.0 | |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-IQ4_NL.gguf) | i1-IQ4_NL | 9.4 | prefer IQ4_XS |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-Q4_0.gguf) | i1-Q4_0 | 9.4 | fast, low quality |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-Q4_K_S.gguf) | i1-Q4_K_S | 10.0 | optimal size/speed/quality |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-Q4_1.gguf) | i1-Q4_1 | 10.4 | |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-Q4_K_M.gguf) | i1-Q4_K_M | 11.0 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-Q5_K_S.gguf) | i1-Q5_K_S | 11.7 | |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-Q5_K_M.gguf) | i1-Q5_K_M | 12.5 | |
| [GGUF](https://huggingface.co/mradermacher/deepseek-moe-16b-base-i1-GGUF/resolve/main/deepseek-moe-16b-base.i1-Q6_K.gguf) | i1-Q6_K | 14.8 | practically like static Q6_K |
Here is a handy graph by ikawrakow comparing some lower-quality quant
types (lower is better):
![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png)
And here are Artefact2's thoughts on the matter:
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
## FAQ / Model Request
See https://huggingface.co/mradermacher/model_requests for some answers to
questions you might have and/or if you want some other model quantized.
## Thanks
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
me use its servers and providing upgrades to my workstation to enable
this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to.
<!-- end -->

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:468c8eb2056a50844e0cb49c34619be6ac49b0c23c1ac40652f77316e729390b
size 5487392160

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:95369a767b8e8e961f05cf8a27579502cd64afda8992827a41891f99d04e88a4
size 5236452768

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9925e25312d844b71db583c5b7bc649e9641bd3855a06877fd5be7405911cce3
size 6616866208

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f90afdc0b61842f76d1e9419bc577e57419e4b5ccf4e31010c987751f5d58bd4
size 6282280352

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6a0074d4c56918812103423d8da5934de42748d6af8402a06ec97e531b81a20a
size 6243880352

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:53c20de7ce0dc04f9e51c1e96dcc313ded72e0cf808d9a2573647373f31f4f68
size 5905624480

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:2cff89576e11d53cec43ac7c2d2bfaaf6a04a25ff68c47d70252b17e5df147ed
size 7881837984

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:59f62c24af486383f049587d4a7db6b745a5f1dfeedd612c1066f131e92e2c31
size 7800171936

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8f3d17aef9ce829637cca6faa88666566cd5d75ec8a50f88c3ce0d04d9458418
size 7414476192

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:0abeb78accc2d9a63ebcfe5cffe8345da94566589e4252a3b42b99d8f109c325
size 7249984928

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ecacab46e96833e8efca7aeb7ff89035fd13a8c9b1c206e736e1eaac938e9102
size 9281975712

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d540bbc3188ffddaa78bf0200a424f1f94cdc970e2f3ea32eec7cba41594b789
size 8933316000

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:20ea952250de91bd2ecc45d05763d5c756e1f3e11dacc5d81c20069d1144208b
size 6706697632

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:71049d3438e5a5b1874c9c771d51759fd18807830526cbd77f3ddeb30057c4aa
size 6718670240

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1b6af3524ec72dc07e345ab3d25a76c82f2b3b03286148da2663623e801852d3
size 8839355808

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6f27cbbacf93f499245e82610c111375925e633f9b0cc09145bfdbbf8f9746d1
size 8480152992

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:beb0b2b26c3802fdf49719a9b49208d940fce1704397259556cf11253f9da332
size 7800171936

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:383002a02bb618d49bf2852e333951c5453ffb70df44f83e42f966e4856aac18
size 9307166112

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:33357af1cec66c57d3fe18eb5b7e750bfbaf89c555e42af1bf7d6efefa6ed4b1
size 10292123040

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:75283a5a6b1639c07d2b4b319b8c5672f9d809d326f6bcd045ac2da1e2be7126
size 10850182560

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:405533f822cf16481d364835825a7a0636b9b6ff96969b60719b81af0f0c498e
size 9935639968

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e63bb4dc4e202a01ce1f445cf5d9e40286a32621e58b8cc1fe9b4ba93f1d44fe
size 12389590432

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:723d3fdf62e09aa2a0e69681ff86abf055ce23da91555f64fe0c881e9d1b076a
size 11615098272

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:44e01a8806e1a9e02bd8c8cf43c9ef1145b6a5e10e060e79e4313e7c9ac84abf
size 14661041568

3
imatrix.dat Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d0f93c9dcf0d31c4fb558dfa8cd475af08d9aeba2735283ec9df0759011cbb8c
size 40000062