commit 01aaf7b1a99cd9c15fc95b13bff31fcead6c40fc Author: ModelHub XC Date: Wed Jul 8 12:34:10 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: mradermacher/Mio-Qwen3-8B-i1-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..916a284 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,60 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.imatrix.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-IQ4_NL.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text +Mio-Qwen3-8B.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/Mio-Qwen3-8B.i1-IQ1_M.gguf b/Mio-Qwen3-8B.i1-IQ1_M.gguf new file mode 100644 index 0000000..15804e4 --- /dev/null +++ b/Mio-Qwen3-8B.i1-IQ1_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ecb7bd75ce3ac6b38bc43c880bf9e9ba354448dcb58fe298771122965a968888 +size 2256148032 diff --git a/Mio-Qwen3-8B.i1-IQ1_S.gguf b/Mio-Qwen3-8B.i1-IQ1_S.gguf new file mode 100644 index 0000000..54ffe81 --- /dev/null +++ b/Mio-Qwen3-8B.i1-IQ1_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f5b4b23ffb976e01dafe4cab0be12842675a56947ba8fc1c2b1b47bff99a49da +size 2115769920 diff --git a/Mio-Qwen3-8B.i1-IQ2_M.gguf b/Mio-Qwen3-8B.i1-IQ2_M.gguf new file mode 100644 index 0000000..cfffc87 --- /dev/null +++ b/Mio-Qwen3-8B.i1-IQ2_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8ebcbc3a17fc64a293d77b310d2ac05abca52ecaa7ade686817df8fb3a87de95 +size 3051914816 diff --git a/Mio-Qwen3-8B.i1-IQ2_S.gguf b/Mio-Qwen3-8B.i1-IQ2_S.gguf new file mode 100644 index 0000000..0c0a668 --- /dev/null +++ b/Mio-Qwen3-8B.i1-IQ2_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:81d06cac277121cd4d7b6cbef8d2f40dbe33600e50fe8c12f8901503587dbcd3 +size 2864744000 diff --git a/Mio-Qwen3-8B.i1-IQ2_XS.gguf b/Mio-Qwen3-8B.i1-IQ2_XS.gguf new file mode 100644 index 0000000..35372aa --- /dev/null +++ b/Mio-Qwen3-8B.i1-IQ2_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d48ec971b4de4aae355717d211e01ae99d4868984c3d1d3a4e8900814e0f80c1 +size 2696156736 diff --git a/Mio-Qwen3-8B.i1-IQ2_XXS.gguf b/Mio-Qwen3-8B.i1-IQ2_XXS.gguf new file mode 100644 index 0000000..f1e2ae0 --- /dev/null +++ b/Mio-Qwen3-8B.i1-IQ2_XXS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:080eb1c3dc018621e226351e96dec2e3c16d4268b702ee956c57bcc26c093bb9 +size 2490111552 diff --git a/Mio-Qwen3-8B.i1-IQ3_M.gguf b/Mio-Qwen3-8B.i1-IQ3_M.gguf new file mode 100644 index 0000000..683549c --- /dev/null +++ b/Mio-Qwen3-8B.i1-IQ3_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:21faa2984b9fbd0d47e422ae6cac1aefa660ad5a5e234aee84daea71d26ce666 +size 3896620608 diff --git a/Mio-Qwen3-8B.i1-IQ3_S.gguf b/Mio-Qwen3-8B.i1-IQ3_S.gguf new file mode 100644 index 0000000..182845b --- /dev/null +++ b/Mio-Qwen3-8B.i1-IQ3_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3f0b73c12a7c8024d4336abeb6873f026f8548823da02412476a83f4d95154ff +size 3789665856 diff --git a/Mio-Qwen3-8B.i1-IQ3_XS.gguf b/Mio-Qwen3-8B.i1-IQ3_XS.gguf new file mode 100644 index 0000000..422b501 --- /dev/null +++ b/Mio-Qwen3-8B.i1-IQ3_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0b9544f5a406d3ca793e754f6c87c8c25133b01a7cdb06353a5b29b6fa09a551 +size 3626874432 diff --git a/Mio-Qwen3-8B.i1-IQ3_XXS.gguf b/Mio-Qwen3-8B.i1-IQ3_XXS.gguf new file mode 100644 index 0000000..9eb294f --- /dev/null +++ b/Mio-Qwen3-8B.i1-IQ3_XXS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:25e2070e52aeec6ccae42dbfab2f962505c7aeb3582e38365ac9af063dc53f54 +size 3369633344 diff --git a/Mio-Qwen3-8B.i1-IQ4_NL.gguf b/Mio-Qwen3-8B.i1-IQ4_NL.gguf new file mode 100644 index 0000000..789c348 --- /dev/null +++ b/Mio-Qwen3-8B.i1-IQ4_NL.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0989ef92c815adf4871bc8f4e4f5d665e8831a62cee5906dea68effd57b4f70b +size 4793624128 diff --git a/Mio-Qwen3-8B.i1-IQ4_XS.gguf b/Mio-Qwen3-8B.i1-IQ4_XS.gguf new file mode 100644 index 0000000..b6b8803 --- /dev/null +++ b/Mio-Qwen3-8B.i1-IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5e8f61459aa4ca31c6c917bd0fc48bfe57dc6905799826c49a9548b6d2db8daf +size 4561839680 diff --git a/Mio-Qwen3-8B.i1-Q2_K.gguf b/Mio-Qwen3-8B.i1-Q2_K.gguf new file mode 100644 index 0000000..aef3e2a --- /dev/null +++ b/Mio-Qwen3-8B.i1-Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:07d2a69bce33a9e35a3802edd9c9c247d986b788322129797cb584a281599e4a +size 3281733184 diff --git a/Mio-Qwen3-8B.i1-Q2_K_S.gguf b/Mio-Qwen3-8B.i1-Q2_K_S.gguf new file mode 100644 index 0000000..5bb9466 --- /dev/null +++ b/Mio-Qwen3-8B.i1-Q2_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6e04b8f22fdba84a62bad3787d480a195bcbedca006ca9004b2cb4e29d5f7a3a +size 3083552320 diff --git a/Mio-Qwen3-8B.i1-Q3_K_L.gguf b/Mio-Qwen3-8B.i1-Q3_K_L.gguf new file mode 100644 index 0000000..499242e --- /dev/null +++ b/Mio-Qwen3-8B.i1-Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:9151b67cb70f44847897a7c2058b64ee4aad4920bc4f7bfb383f6369fac8c2ff +size 4431394368 diff --git a/Mio-Qwen3-8B.i1-Q3_K_M.gguf b/Mio-Qwen3-8B.i1-Q3_K_M.gguf new file mode 100644 index 0000000..b02981d --- /dev/null +++ b/Mio-Qwen3-8B.i1-Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:59853babec4434b3a21636311d56fc67a9e8ec66e4eb7c63857cb927f3553b7f +size 4124161600 diff --git a/Mio-Qwen3-8B.i1-Q3_K_S.gguf b/Mio-Qwen3-8B.i1-Q3_K_S.gguf new file mode 100644 index 0000000..c855502 --- /dev/null +++ b/Mio-Qwen3-8B.i1-Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e1ca761e8153f93597a81b6a1330c1180cc9816342dc1de52a617c88446ebcb4 +size 3769611840 diff --git a/Mio-Qwen3-8B.i1-Q4_0.gguf b/Mio-Qwen3-8B.i1-Q4_0.gguf new file mode 100644 index 0000000..cf54643 --- /dev/null +++ b/Mio-Qwen3-8B.i1-Q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:972f1b179eb45f61179e5daf05640ff9f63d27d8d680cda5a1327ae01fc26e19 +size 4787332672 diff --git a/Mio-Qwen3-8B.i1-Q4_1.gguf b/Mio-Qwen3-8B.i1-Q4_1.gguf new file mode 100644 index 0000000..86c89d5 --- /dev/null +++ b/Mio-Qwen3-8B.i1-Q4_1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1654ba53b68783d526dde79b293b15c7fc68c9f8b1b4a34ebbbcf79ab77ba979 +size 5247755840 diff --git a/Mio-Qwen3-8B.i1-Q4_K_M.gguf b/Mio-Qwen3-8B.i1-Q4_K_M.gguf new file mode 100644 index 0000000..a5519e7 --- /dev/null +++ b/Mio-Qwen3-8B.i1-Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3c9510a44592912417231f4cf577fe86b62e2063e9229075453816de5229c331 +size 5027784256 diff --git a/Mio-Qwen3-8B.i1-Q4_K_S.gguf b/Mio-Qwen3-8B.i1-Q4_K_S.gguf new file mode 100644 index 0000000..c9b7683 --- /dev/null +++ b/Mio-Qwen3-8B.i1-Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f05ba6a6ca94bcf512222db0796fb8f9acd4635408dc69a3888c4f03a4aae5f6 +size 4802012736 diff --git a/Mio-Qwen3-8B.i1-Q5_K_M.gguf b/Mio-Qwen3-8B.i1-Q5_K_M.gguf new file mode 100644 index 0000000..afa4d57 --- /dev/null +++ b/Mio-Qwen3-8B.i1-Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:904aa963266392badfefcd21671a3462345d948befded29b796eb3f5d2d035e7 +size 5851113024 diff --git a/Mio-Qwen3-8B.i1-Q5_K_S.gguf b/Mio-Qwen3-8B.i1-Q5_K_S.gguf new file mode 100644 index 0000000..497a962 --- /dev/null +++ b/Mio-Qwen3-8B.i1-Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8fb6e21da08f5ee230331252c8fb6649e4759df26541e659222df98ea17616db +size 5720761920 diff --git a/Mio-Qwen3-8B.i1-Q6_K.gguf b/Mio-Qwen3-8B.i1-Q6_K.gguf new file mode 100644 index 0000000..871e63e --- /dev/null +++ b/Mio-Qwen3-8B.i1-Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e2f40eed17fa166c91295cd112db9f6015609de78a53fda57a2fb2424362dd57 +size 6725899840 diff --git a/Mio-Qwen3-8B.imatrix.gguf b/Mio-Qwen3-8B.imatrix.gguf new file mode 100644 index 0000000..8157902 --- /dev/null +++ b/Mio-Qwen3-8B.imatrix.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3ca79a485646989b57bb7573fbb75bdf4132df68c6df2057458c75d8d4525511 +size 5347200 diff --git a/README.md b/README.md new file mode 100644 index 0000000..8aef80f --- /dev/null +++ b/README.md @@ -0,0 +1,85 @@ +--- +base_model: RiiShin/Mio-Qwen3-8B +language: +- en +library_name: transformers +mradermacher: + readme_rev: 1 +quantized_by: mradermacher +tags: [] +--- +## About + + + + + + + + + +weighted/imatrix quants of https://huggingface.co/RiiShin/Mio-Qwen3-8B + + + +***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#Mio-Qwen3-8B-i1-GGUF).*** + +static quants are available at https://huggingface.co/mradermacher/Mio-Qwen3-8B-GGUF +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.imatrix.gguf) | imatrix | 0.1 | imatrix file (for creating your own quants) | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-IQ1_S.gguf) | i1-IQ1_S | 2.2 | for the desperate | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-IQ1_M.gguf) | i1-IQ1_M | 2.4 | mostly desperate | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 2.6 | | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-IQ2_XS.gguf) | i1-IQ2_XS | 2.8 | | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-IQ2_S.gguf) | i1-IQ2_S | 3.0 | | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-IQ2_M.gguf) | i1-IQ2_M | 3.2 | | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-Q2_K_S.gguf) | i1-Q2_K_S | 3.2 | very low quality | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-Q2_K.gguf) | i1-Q2_K | 3.4 | IQ3_XXS probably better | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 3.5 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-IQ3_XS.gguf) | i1-IQ3_XS | 3.7 | | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-Q3_K_S.gguf) | i1-Q3_K_S | 3.9 | IQ3_XS probably better | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-IQ3_S.gguf) | i1-IQ3_S | 3.9 | beats Q3_K* | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-IQ3_M.gguf) | i1-IQ3_M | 4.0 | | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-Q3_K_M.gguf) | i1-Q3_K_M | 4.2 | IQ3_S probably better | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-Q3_K_L.gguf) | i1-Q3_K_L | 4.5 | IQ3_M probably better | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-IQ4_XS.gguf) | i1-IQ4_XS | 4.7 | | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-Q4_0.gguf) | i1-Q4_0 | 4.9 | fast, low quality | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-IQ4_NL.gguf) | i1-IQ4_NL | 4.9 | prefer IQ4_XS | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-Q4_K_S.gguf) | i1-Q4_K_S | 4.9 | optimal size/speed/quality | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-Q4_K_M.gguf) | i1-Q4_K_M | 5.1 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-Q4_1.gguf) | i1-Q4_1 | 5.3 | | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-Q5_K_S.gguf) | i1-Q5_K_S | 5.8 | | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-Q5_K_M.gguf) | i1-Q5_K_M | 6.0 | | +| [GGUF](https://huggingface.co/mradermacher/Mio-Qwen3-8B-i1-GGUF/resolve/main/Mio-Qwen3-8B.i1-Q6_K.gguf) | i1-Q6_K | 6.8 | practically like static Q6_K | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to. + +