From 176bdf3e675bb49c893efebd05c800ad8940c35c Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Sat, 29 Aug 2026 00:10:21 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: Melvin56/Qwen3-4B-abliterated-GGUF Source: Original Platform --- .gitattributes | 44 +++++++++++++++++++++ README.md | 66 ++++++++++++++++++++++++++++++++ imatrix.dat | 3 ++ qwen3-4b-abliterated-BF16.gguf | 3 ++ qwen3-4b-abliterated-IQ4_XS.gguf | 3 ++ qwen3-4b-abliterated-Q2_K.gguf | 3 ++ qwen3-4b-abliterated-Q3_K_M.gguf | 3 ++ qwen3-4b-abliterated-Q4_K_M.gguf | 3 ++ qwen3-4b-abliterated-Q5_K_M.gguf | 3 ++ qwen3-4b-abliterated-Q6_K.gguf | 3 ++ qwen3-4b-abliterated-Q8_0.gguf | 3 ++ 11 files changed, 137 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 imatrix.dat create mode 100644 qwen3-4b-abliterated-BF16.gguf create mode 100644 qwen3-4b-abliterated-IQ4_XS.gguf create mode 100644 qwen3-4b-abliterated-Q2_K.gguf create mode 100644 qwen3-4b-abliterated-Q3_K_M.gguf create mode 100644 qwen3-4b-abliterated-Q4_K_M.gguf create mode 100644 qwen3-4b-abliterated-Q5_K_M.gguf create mode 100644 qwen3-4b-abliterated-Q6_K.gguf create mode 100644 qwen3-4b-abliterated-Q8_0.gguf diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..f76ebb4 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,44 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +qwen3-4b-abliterated-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +qwen3-4b-abliterated-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +qwen3-4b-abliterated-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +qwen3-4b-abliterated-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +qwen3-4b-abliterated-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +qwen3-4b-abliterated-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +qwen3-4b-abliterated-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text +imatrix.dat filter=lfs diff=lfs merge=lfs -text +qwen3-4b-abliterated-BF16.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..419a330 --- /dev/null +++ b/README.md @@ -0,0 +1,66 @@ +--- +license: apache-2.0 +license_link: https://huggingface.co/Qwen/Qwen3-4B/blob/main/LICENSE +pipeline_tag: text-generation +base_model: +- huihui-ai/Qwen3-4B-abliterated +tags: +- chat +- abliterated +- uncensored +extra_gated_prompt: >- + **Usage Warnings** + + + “**Risk of Sensitive or Controversial Outputs**“: This model’s safety + filtering has been significantly reduced, potentially generating sensitive, + controversial, or inappropriate content. Users should exercise caution and + rigorously review generated outputs. + + “**Not Suitable for All Audiences**:“ Due to limited content filtering, the + model’s outputs may be inappropriate for public settings, underage users, or + applications requiring high security. + + “**Legal and Ethical Responsibilities**“: Users must ensure their usage + complies with local laws and ethical standards. Generated content may carry + legal or ethical risks, and users are solely responsible for any consequences. + + “**Research and Experimental Use**“: It is recommended to use this model for + research, testing, or controlled environments, avoiding direct use in + production or public-facing commercial applications. + + “**Monitoring and Review Recommendations**“: Users are strongly advised to + monitor model outputs in real-time and conduct manual reviews when necessary + to prevent the dissemination of inappropriate content. + + “**No Default Safety Guarantees**“: Unlike standard models, this model has not + undergone rigorous safety optimization. huihui.ai bears no responsibility for + any consequences arising from its use. +--- + +# Melvin56/Qwen3-4B-abliterated-GGUF + +Original Model : [huihui-ai/Qwen3-4B-abliterated](https://huggingface.co/huihui-ai/Qwen3-4B-abliterated) + +Llama.cpp build: 0208355 (5342) + +I used imatrix to create all these quants using this [Dataset](https://gist.github.com/tristandruyen/9e207a95c7d75ddf37525d353e00659c/#file-calibration_data_v5_rc-txt). + +--- + +| | CPU (AVX2) | CPU (ARM NEON) | Metal | cuBLAS | rocBLAS | SYCL | CLBlast | Vulkan | Kompute | +| :------------ | :---------: | :------------: | :---: | :----: | :-----: | :---: | :------: | :----: | :------: | +| K-quants | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ 🐢5 | ✅ 🐢5 | ❌ | +| I-quants | ✅ 🐢4 | ✅ 🐢4 | ✅ 🐢4 | ✅ | ✅ | Partial¹ | ❌ | ❌ | ❌ | +``` +✅: feature works +🚫: feature does not work +❓: unknown, please contribute if you can test it youself +🐢: feature is slow +¹: IQ3_S and IQ1_S, see #5886 +²: Only with -ngl 0 +³: Inference is 50% slower +⁴: Slower than K-quants of comparable size +⁵: Slower than cuBLAS/rocBLAS on similar cards +⁶: Only q8_0 and iq4_nl +``` \ No newline at end of file diff --git a/imatrix.dat b/imatrix.dat new file mode 100644 index 0000000..59fd77a --- /dev/null +++ b/imatrix.dat @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4540cba9e2461c453d75d9903b24480bae960c8b57ad45d1f281b05fb94efdd3 +size 3842245 diff --git a/qwen3-4b-abliterated-BF16.gguf b/qwen3-4b-abliterated-BF16.gguf new file mode 100644 index 0000000..ad29677 --- /dev/null +++ b/qwen3-4b-abliterated-BF16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:938bf65e3c0f1cd7c605b1b5c17a9aa21651b89b8e240a8cdee55487a5fa66bb +size 8051281056 diff --git a/qwen3-4b-abliterated-IQ4_XS.gguf b/qwen3-4b-abliterated-IQ4_XS.gguf new file mode 100644 index 0000000..440fa07 --- /dev/null +++ b/qwen3-4b-abliterated-IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:30ca0b693a3f4089a63e537520f2645266de108a058d9ec801232e1b5d79c2ac +size 2270747584 diff --git a/qwen3-4b-abliterated-Q2_K.gguf b/qwen3-4b-abliterated-Q2_K.gguf new file mode 100644 index 0000000..5cb5271 --- /dev/null +++ b/qwen3-4b-abliterated-Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:93e04df0c69bb8224a3d0192bcd42a2ffa72a8dc9aad51efe8e3573d7497bed3 +size 1669495744 diff --git a/qwen3-4b-abliterated-Q3_K_M.gguf b/qwen3-4b-abliterated-Q3_K_M.gguf new file mode 100644 index 0000000..5ef3e00 --- /dev/null +++ b/qwen3-4b-abliterated-Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:23e2b02dfc4bdac9df18b4bb941b6dab9e6166c7873bac4e6f1324f33211201d +size 2075614144 diff --git a/qwen3-4b-abliterated-Q4_K_M.gguf b/qwen3-4b-abliterated-Q4_K_M.gguf new file mode 100644 index 0000000..0bba994 --- /dev/null +++ b/qwen3-4b-abliterated-Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:01801a997e996c1d9b41ba5bc6c2c2df2ecc1c7ea69f970d7df0fc59c222ea3f +size 2497276864 diff --git a/qwen3-4b-abliterated-Q5_K_M.gguf b/qwen3-4b-abliterated-Q5_K_M.gguf new file mode 100644 index 0000000..9454138 --- /dev/null +++ b/qwen3-4b-abliterated-Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:48dd06cd3cd94bc86d06d9aa3b4b4ba610069d24012baba1fc150ab02cb14dd9 +size 2889509824 diff --git a/qwen3-4b-abliterated-Q6_K.gguf b/qwen3-4b-abliterated-Q6_K.gguf new file mode 100644 index 0000000..891f397 --- /dev/null +++ b/qwen3-4b-abliterated-Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:37112503cb41b1458e2772edd45c703db61a814829e0188a1ac1f9afda27440c +size 3306257344 diff --git a/qwen3-4b-abliterated-Q8_0.gguf b/qwen3-4b-abliterated-Q8_0.gguf new file mode 100644 index 0000000..5680795 --- /dev/null +++ b/qwen3-4b-abliterated-Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:51f62894a5c0e7492bd0e2888765437c6b1638c3a2dd6f5c4700012cc8579952 +size 4280401344