初始化项目,由ModelHub XC社区提供模型

Model: mradermacher/Kai-30B-Instruct-i1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-06-13 23:56:19 +08:00
commit 51a3331a35
26 changed files with 222 additions and 0 deletions

59
.gitattributes vendored Normal file
View File

@@ -0,0 +1,59 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.imatrix.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text
Kai-30B-Instruct.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:141aa341279936e44e224a49c51afd331d1ecc147e6d41e12d3d26c2d3490329
size 8176787232

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:adbb8e517ce30719c798a85715c078f499bb6b49d3072710c54aaf6ac6f9cc9c
size 7498981152

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:57bdb2ebe18c2aacd2eef817844112f4833c1fc74cc79278478d3c1011e920ef
size 11794763552

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d7549673f6e02af2a83c61768ed0332cad391d02a600af37187ffa3085bfbcb7
size 10891022112

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:39f26837ed7e34f188331262f7f9a874955dafd19cc78ab6d5559b7c02744993
size 10306543392

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:aa7b8a069e7bb205eddc80d51636784353cf8447ffc104ca94c7f7d4e1dc20a6
size 9306464032

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:268679531c1a5ad441aec04c51ab411ab3f6c99dc93c967a7c77aa213fcbc30d
size 15564701472

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ab8b20d129b39edce378ba9e96f1f399f1d593a526225e16301a94360c3074fb
size 15018786592

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:40531ceb892da47960de4a12385b6bc2f6e8a9680490e9be108dd1c09850cd85
size 14234320672

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:06a8fbd5cc298a8876630fdac0418a45fa70df45e936646dcd2f25faa5b54d97
size 13333876512

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8c0edd700fc7e6a950c7aa38f9a5f5697798bc0725f406750f08d7b5616a3ecb
size 18475052832

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ba8d285213455cb5bdf23ebe80b5f7ac320ad4bc2d08968cb9948221d5e9020d
size 12825235232

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:760b44d3adec734b9851d3f90b4a5c2a4a71dc0c85d11adefdd2692975c98d46
size 11858415392

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:bd7306db149c8e8fadc0def2b6f78e66bef50bb9e9fc480d13829eb3474f2651
size 18139447072

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1af836cab8cdc5ce791936cf7a0accbe36383c10de8dfa6a90dee7b8fdbd64cc
size 16654925600

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:75241300bbf233062a179f12215ba0dc29d94d0dd515b2eedd0b71e9ae6d060e
size 14960295712

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c5f48221434c5aba6bb2bb146021ab28af6a2152ae4b94d69faf931a0f3f20a0
size 19530755872

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:72d85b81b9e1a861d026e26d097c558d3ca83561baa5256640a00f13ff02b837
size 21587111712

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9d1275c86b7ed0a1e9aa034570886f1aae78fc4e40cc6e0927ab3ec02bb9cd87
size 20658712352

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:be54c9e78f3ffb2723ed67d936bc28e0c33fbe5ddb4506f448d07dd49a026c7b
size 19598651168

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:61438cdf3df0db083b29454f68da58d62c52674f2f8a4578935919185520e579
size 24321847072

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f9fd0519d36c5fc44697c1d8936b19e1b1c58a405ae547faefd8e7475145c8e5
size 23707692832

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6f9875dc2046210272e3e920196c6ccabb658db96ebb9ca793b3aaedc2fc9f9d
size 28213927712

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1820c70c39a47ea8396cba36853151dddf7defaf497cbeaad3fdfa47397f5d4b
size 15301696

91
README.md Normal file
View File

@@ -0,0 +1,91 @@
---
base_model: NoesisLab/Kai-30B-Instruct
language:
- en
library_name: transformers
license: apache-2.0
mradermacher:
readme_rev: 1
quantized_by: mradermacher
tags:
- math
- reasoning
- text-generation
- ads
- distillation
- code
---
## About
<!-- ### quantize_version: 2 -->
<!-- ### output_tensor_quantised: 1 -->
<!-- ### convert_type: hf -->
<!-- ### vocab_type: -->
<!-- ### tags: nicoboss -->
<!-- ### quants: Q2_K IQ3_M Q4_K_S IQ3_XXS Q3_K_M small-IQ4_NL Q4_K_M IQ2_M Q6_K IQ4_XS Q2_K_S IQ1_M Q3_K_S IQ2_XXS Q3_K_L IQ2_XS Q5_K_S IQ2_S IQ1_S Q5_K_M Q4_0 IQ3_XS Q4_1 IQ3_S -->
<!-- ### quants_skip: -->
<!-- ### skip_mmproj: -->
weighted/imatrix quants of https://huggingface.co/NoesisLab/Kai-30B-Instruct
<!-- provided-files -->
***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#Kai-30B-Instruct-i1-GGUF).***
static quants are available at https://huggingface.co/mradermacher/Kai-30B-Instruct-GGUF
## Usage
If you are unsure how to use GGUF files, refer to one of [TheBloke's
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
more details, including on how to concatenate multi-part files.
## Provided Quants
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
| Link | Type | Size/GB | Notes |
|:-----|:-----|--------:|:------|
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.imatrix.gguf) | imatrix | 0.1 | imatrix file (for creating your own quants) |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-IQ1_S.gguf) | i1-IQ1_S | 7.6 | for the desperate |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-IQ1_M.gguf) | i1-IQ1_M | 8.3 | mostly desperate |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 9.4 | |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-IQ2_XS.gguf) | i1-IQ2_XS | 10.4 | |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-IQ2_S.gguf) | i1-IQ2_S | 11.0 | |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-IQ2_M.gguf) | i1-IQ2_M | 11.9 | |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-Q2_K_S.gguf) | i1-Q2_K_S | 12.0 | very low quality |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-Q2_K.gguf) | i1-Q2_K | 12.9 | IQ3_XXS probably better |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 13.4 | lower quality |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-IQ3_XS.gguf) | i1-IQ3_XS | 14.3 | |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-Q3_K_S.gguf) | i1-Q3_K_S | 15.1 | IQ3_XS probably better |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-IQ3_S.gguf) | i1-IQ3_S | 15.1 | beats Q3_K* |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-IQ3_M.gguf) | i1-IQ3_M | 15.7 | |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-Q3_K_M.gguf) | i1-Q3_K_M | 16.8 | IQ3_S probably better |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-Q3_K_L.gguf) | i1-Q3_K_L | 18.2 | IQ3_M probably better |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-IQ4_XS.gguf) | i1-IQ4_XS | 18.6 | |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-Q4_0.gguf) | i1-Q4_0 | 19.6 | fast, low quality |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-Q4_K_S.gguf) | i1-Q4_K_S | 19.7 | optimal size/speed/quality |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-Q4_K_M.gguf) | i1-Q4_K_M | 20.8 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-Q4_1.gguf) | i1-Q4_1 | 21.7 | |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-Q5_K_S.gguf) | i1-Q5_K_S | 23.8 | |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-Q5_K_M.gguf) | i1-Q5_K_M | 24.4 | |
| [GGUF](https://huggingface.co/mradermacher/Kai-30B-Instruct-i1-GGUF/resolve/main/Kai-30B-Instruct.i1-Q6_K.gguf) | i1-Q6_K | 28.3 | practically like static Q6_K |
Here is a handy graph by ikawrakow comparing some lower-quality quant
types (lower is better):
![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png)
And here are Artefact2's thoughts on the matter:
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
## FAQ / Model Request
See https://huggingface.co/mradermacher/model_requests for some answers to
questions you might have and/or if you want some other model quantized.
## Thanks
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
me use its servers and providing upgrades to my workstation to enable
this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to.
<!-- end -->