初始化项目,由ModelHub XC社区提供模型

Model: mradermacher/DeepKAT-32B-i1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-07-20 02:13:09 +08:00
commit ddabdc668e
26 changed files with 220 additions and 0 deletions

59
.gitattributes vendored Normal file
View File

@@ -0,0 +1,59 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.imatrix.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text
DeepKAT-32B.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:49f1dcb7d75e9bb60a8930de0a4e7faa9ae03284f4923653a0b96be3a387d22d
size 7959869216

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b3300846df167d10f5d403732ebfc711d4c25aad1fdf26b5d59f4169dada0aa9
size 7323842336

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:0892380a9429ee4d3134d25b47530374dece5d91621fc847ed5ec76c891adb57
size 11362861856

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f6a4424700bb5b766d78579d4e6ef3028446e6dbbb1673716e0a16e4e814e9f8
size 10514826016

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:2b7dd57f1a5a99f874bb4980453ebb2e237e83adff804b0f1850920e291a52a0
size 9951835936

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d98a394638f2d2f4c745eb34d077104d81e0d73a84e1c51b21399f40a50919f4
size 9019914016

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c9b0da6bcedb903cbff13353e354e0dee871fc204836500736262e7f4a38db44
size 14930083616

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:5622ecb461ec8f11887382e35cdf0ce9f41612c276aec05715fe98c5dd23f23b
size 14434303776

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:272362b98c862dc785532614395c08cc5b311e390bb02f1ef091c17efa91b230
size 13702922016

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:3cc6a4beb602f326d1c22e66b76f43140f7b01abf23f06a0ea202ff471c09583
size 12821037856

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ac3b9f3661ed3af1c39deb877b505d41d2f948ec8a7436717ca4f96ad0c83b7f
size 17690495776

3
DeepKAT-32B.i1-Q2_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a19b2ff18bebcc2c55e12631b227c7e9e3ec27f6fc9521fb44cf6468dd32c3cc
size 12344652576

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1b241518c9e47f6d965ccddf25521288e0f715226758a7a984463e8417a489b3
size 11465814816

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1fcb47e9d1f7337900a16bc5a0c2675ad1c26043b7cc1d3f4d1a053c723373f9
size 17330994976

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:bff3a1c92e6b597a4ffe0dc641f6cfb0da28903c98ba2d5b82c1f7c2fe79bff0
size 15971778336

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:bd7edd9d34b348c1a431b37dc389bd10061eea1f672a82c8b631d186b1825273
size 14389739296

3
DeepKAT-32B.i1-Q4_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8fe8fdb56e51b9e2a520f781d92f32c4c28005cfcaf60ba76a2e325b6543bcd4
size 18703088416

3
DeepKAT-32B.i1-Q4_1.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:be92292015e4639b66a2a551706d0db82e780cc987e6ff052aeda6590441e7c1
size 20636523296

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:04f9e31ca46ec31cc871e8de45abc0fd923f6a5558603c1254d3067874e473a9
size 19762150176

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:0b9793d0044a97e301757eceb556926b0fa9f4c324476784cd18a348cecbf183
size 18771245856

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d205f4349bfaeabf738757b46c4ab70eb6874110508d39e8356c906028875f9b
size 23214832416

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:309fccd63eace63667aef9ab9ea51f796966f5b7aee4f85c1d007d85aa381911
size 22635494176

3
DeepKAT-32B.i1-Q6_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:90ffd92a54819c56095dad4f850c8105f02780316098aa47191d03b34b584640
size 26883307296

3
DeepKAT-32B.imatrix.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:84f412bf0f81541f4a91d58ea54f7711e0ce45d1940f2de67872c6927c02f601
size 15273216

89
README.md Normal file
View File

@@ -0,0 +1,89 @@
---
base_model: Akicou/DeepKAT-32B
language: en
library_name: transformers
license: mit
mradermacher:
readme_rev: 1
quantized_by: mradermacher
tags:
- pytorch
- mergekit
- code-generation
- agentic-ai
- software-engineering
---
## About
<!-- ### quantize_version: 2 -->
<!-- ### output_tensor_quantised: 1 -->
<!-- ### convert_type: hf -->
<!-- ### vocab_type: -->
<!-- ### tags: nicoboss -->
<!-- ### quants: Q2_K IQ3_M Q4_K_S IQ3_XXS Q3_K_M small-IQ4_NL Q4_K_M IQ2_M Q6_K IQ4_XS Q2_K_S IQ1_M Q3_K_S IQ2_XXS Q3_K_L IQ2_XS Q5_K_S IQ2_S IQ1_S Q5_K_M Q4_0 IQ3_XS Q4_1 IQ3_S -->
<!-- ### quants_skip: -->
<!-- ### skip_mmproj: -->
weighted/imatrix quants of https://huggingface.co/Akicou/DeepKAT-32B
<!-- provided-files -->
***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#DeepKAT-32B-i1-GGUF).***
static quants are available at https://huggingface.co/mradermacher/DeepKAT-32B-GGUF
## Usage
If you are unsure how to use GGUF files, refer to one of [TheBloke's
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
more details, including on how to concatenate multi-part files.
## Provided Quants
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
| Link | Type | Size/GB | Notes |
|:-----|:-----|--------:|:------|
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.imatrix.gguf) | imatrix | 0.1 | imatrix file (for creating your own quants) |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-IQ1_S.gguf) | i1-IQ1_S | 7.4 | for the desperate |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-IQ1_M.gguf) | i1-IQ1_M | 8.1 | mostly desperate |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 9.1 | |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-IQ2_XS.gguf) | i1-IQ2_XS | 10.1 | |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-IQ2_S.gguf) | i1-IQ2_S | 10.6 | |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-IQ2_M.gguf) | i1-IQ2_M | 11.5 | |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-Q2_K_S.gguf) | i1-Q2_K_S | 11.6 | very low quality |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-Q2_K.gguf) | i1-Q2_K | 12.4 | IQ3_XXS probably better |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 12.9 | lower quality |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-IQ3_XS.gguf) | i1-IQ3_XS | 13.8 | |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-Q3_K_S.gguf) | i1-Q3_K_S | 14.5 | IQ3_XS probably better |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-IQ3_S.gguf) | i1-IQ3_S | 14.5 | beats Q3_K* |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-IQ3_M.gguf) | i1-IQ3_M | 15.0 | |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-Q3_K_M.gguf) | i1-Q3_K_M | 16.1 | IQ3_S probably better |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-Q3_K_L.gguf) | i1-Q3_K_L | 17.4 | IQ3_M probably better |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-IQ4_XS.gguf) | i1-IQ4_XS | 17.8 | |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-Q4_0.gguf) | i1-Q4_0 | 18.8 | fast, low quality |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-Q4_K_S.gguf) | i1-Q4_K_S | 18.9 | optimal size/speed/quality |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-Q4_K_M.gguf) | i1-Q4_K_M | 19.9 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-Q4_1.gguf) | i1-Q4_1 | 20.7 | |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-Q5_K_S.gguf) | i1-Q5_K_S | 22.7 | |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-Q5_K_M.gguf) | i1-Q5_K_M | 23.3 | |
| [GGUF](https://huggingface.co/mradermacher/DeepKAT-32B-i1-GGUF/resolve/main/DeepKAT-32B.i1-Q6_K.gguf) | i1-Q6_K | 27.0 | practically like static Q6_K |
Here is a handy graph by ikawrakow comparing some lower-quality quant
types (lower is better):
![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png)
And here are Artefact2's thoughts on the matter:
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
## FAQ / Model Request
See https://huggingface.co/mradermacher/model_requests for some answers to
questions you might have and/or if you want some other model quantized.
## Thanks
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
me use its servers and providing upgrades to my workstation to enable
this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to.
<!-- end -->