commit c99848990682b1c087e7a7e2197b48ca077780f7 Author: ModelHub XC Date: Mon Jun 15 03:05:17 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: mradermacher/Qwen3-0.6B-summ-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..84588b9 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,47 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +Qwen3-0.6B-summ.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-0.6B-summ.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-0.6B-summ.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-0.6B-summ.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-0.6B-summ.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-0.6B-summ.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-0.6B-summ.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-0.6B-summ.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-0.6B-summ.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-0.6B-summ.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-0.6B-summ.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +Qwen3-0.6B-summ.f16.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/Qwen3-0.6B-summ.IQ4_XS.gguf b/Qwen3-0.6B-summ.IQ4_XS.gguf new file mode 100644 index 0000000..61d8b98 --- /dev/null +++ b/Qwen3-0.6B-summ.IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8b918325aec70fb56484166a001573c8cdc1654c1348ce2e4944acebcb15977c +size 369278784 diff --git a/Qwen3-0.6B-summ.Q2_K.gguf b/Qwen3-0.6B-summ.Q2_K.gguf new file mode 100644 index 0000000..f8efa3b --- /dev/null +++ b/Qwen3-0.6B-summ.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5bb6cd7b4059a3c9ca299215ddad40b4cf70eebc0067034ddd76e5ffea625a8e +size 296238912 diff --git a/Qwen3-0.6B-summ.Q3_K_L.gguf b/Qwen3-0.6B-summ.Q3_K_L.gguf new file mode 100644 index 0000000..5406c29 --- /dev/null +++ b/Qwen3-0.6B-summ.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8863bc8656eb53ebae78d8aba42e2ba470b2ef688f44bbeea1d201aa822ed574 +size 368492352 diff --git a/Qwen3-0.6B-summ.Q3_K_M.gguf b/Qwen3-0.6B-summ.Q3_K_M.gguf new file mode 100644 index 0000000..19de0ea --- /dev/null +++ b/Qwen3-0.6B-summ.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0a6e01df95707653b368f03f1b6baff82e409fafe2672b51e152cf934e7a7fa1 +size 347127616 diff --git a/Qwen3-0.6B-summ.Q3_K_S.gguf b/Qwen3-0.6B-summ.Q3_K_S.gguf new file mode 100644 index 0000000..e37b244 --- /dev/null +++ b/Qwen3-0.6B-summ.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:9f81256d3a3cd799abf8b777579d44365f5b3624eaa1172a4f2f45b4d964504e +size 323075904 diff --git a/Qwen3-0.6B-summ.Q4_K_M.gguf b/Qwen3-0.6B-summ.Q4_K_M.gguf new file mode 100644 index 0000000..4498dec --- /dev/null +++ b/Qwen3-0.6B-summ.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a9492b12ac596f2f557f594ecfa1321166adc522bb82352cd9f0c9c3ccd2da57 +size 396705600 diff --git a/Qwen3-0.6B-summ.Q4_K_S.gguf b/Qwen3-0.6B-summ.Q4_K_S.gguf new file mode 100644 index 0000000..530cf0f --- /dev/null +++ b/Qwen3-0.6B-summ.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0edb72a6c246d853b11ad22ee3340921cacc58e46e700eaa23f3439ad06ad887 +size 383270720 diff --git a/Qwen3-0.6B-summ.Q5_K_M.gguf b/Qwen3-0.6B-summ.Q5_K_M.gguf new file mode 100644 index 0000000..2627604 --- /dev/null +++ b/Qwen3-0.6B-summ.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4ccc1cb8a41c88c9b0342525c3846ba02a2c3e2d41c9b46f88d7a46576aab823 +size 444415808 diff --git a/Qwen3-0.6B-summ.Q5_K_S.gguf b/Qwen3-0.6B-summ.Q5_K_S.gguf new file mode 100644 index 0000000..d6e52ac --- /dev/null +++ b/Qwen3-0.6B-summ.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:988ea074e8d1d2e74809565c52a5af1af443aa4a430f8ad6750d4fbb991252a8 +size 436617024 diff --git a/Qwen3-0.6B-summ.Q6_K.gguf b/Qwen3-0.6B-summ.Q6_K.gguf new file mode 100644 index 0000000..87abf9d --- /dev/null +++ b/Qwen3-0.6B-summ.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:87e095aad687e3aea25e69eca77f103d35dc6c56596b9ba61d2597e7e6a0dba0 +size 495107904 diff --git a/Qwen3-0.6B-summ.Q8_0.gguf b/Qwen3-0.6B-summ.Q8_0.gguf new file mode 100644 index 0000000..b7b8353 --- /dev/null +++ b/Qwen3-0.6B-summ.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:21fb4c6993928ae409008bf6e0320315d741514665e00e3e8c925a5e81351896 +size 639447872 diff --git a/Qwen3-0.6B-summ.f16.gguf b/Qwen3-0.6B-summ.f16.gguf new file mode 100644 index 0000000..6accf53 --- /dev/null +++ b/Qwen3-0.6B-summ.f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b34e58fad383607096e3da0ebbe4b0f030e2416013553cef45ccb9e7a7d177c6 +size 1198183232 diff --git a/README.md b/README.md new file mode 100644 index 0000000..c8303c2 --- /dev/null +++ b/README.md @@ -0,0 +1,71 @@ +--- +base_model: hadeseus/Qwen3-0.6B-summ +language: +- en +library_name: transformers +mradermacher: + readme_rev: 1 +quantized_by: mradermacher +--- +## About + + + + + + + + + +static quants of https://huggingface.co/hadeseus/Qwen3-0.6B-summ + + + +***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#Qwen3-0.6B-summ-GGUF).*** + +weighted/imatrix quants seem not to be available (by me) at this time. If they do not show up a week or so after the static ones, I have probably not planned for them. Feel free to request them by opening a Community Discussion. +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/Qwen3-0.6B-summ-GGUF/resolve/main/Qwen3-0.6B-summ.Q2_K.gguf) | Q2_K | 0.4 | | +| [GGUF](https://huggingface.co/mradermacher/Qwen3-0.6B-summ-GGUF/resolve/main/Qwen3-0.6B-summ.Q3_K_S.gguf) | Q3_K_S | 0.4 | | +| [GGUF](https://huggingface.co/mradermacher/Qwen3-0.6B-summ-GGUF/resolve/main/Qwen3-0.6B-summ.Q3_K_M.gguf) | Q3_K_M | 0.4 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/Qwen3-0.6B-summ-GGUF/resolve/main/Qwen3-0.6B-summ.Q3_K_L.gguf) | Q3_K_L | 0.5 | | +| [GGUF](https://huggingface.co/mradermacher/Qwen3-0.6B-summ-GGUF/resolve/main/Qwen3-0.6B-summ.IQ4_XS.gguf) | IQ4_XS | 0.5 | | +| [GGUF](https://huggingface.co/mradermacher/Qwen3-0.6B-summ-GGUF/resolve/main/Qwen3-0.6B-summ.Q4_K_S.gguf) | Q4_K_S | 0.5 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Qwen3-0.6B-summ-GGUF/resolve/main/Qwen3-0.6B-summ.Q4_K_M.gguf) | Q4_K_M | 0.5 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Qwen3-0.6B-summ-GGUF/resolve/main/Qwen3-0.6B-summ.Q5_K_S.gguf) | Q5_K_S | 0.5 | | +| [GGUF](https://huggingface.co/mradermacher/Qwen3-0.6B-summ-GGUF/resolve/main/Qwen3-0.6B-summ.Q5_K_M.gguf) | Q5_K_M | 0.5 | | +| [GGUF](https://huggingface.co/mradermacher/Qwen3-0.6B-summ-GGUF/resolve/main/Qwen3-0.6B-summ.Q6_K.gguf) | Q6_K | 0.6 | very good quality | +| [GGUF](https://huggingface.co/mradermacher/Qwen3-0.6B-summ-GGUF/resolve/main/Qwen3-0.6B-summ.Q8_0.gguf) | Q8_0 | 0.7 | fast, best quality | +| [GGUF](https://huggingface.co/mradermacher/Qwen3-0.6B-summ-GGUF/resolve/main/Qwen3-0.6B-summ.f16.gguf) | f16 | 1.3 | 16 bpw, overkill | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. + +