From 0c85e04acb4fb5c443daafd2c1a435648a1bb563 Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Sun, 7 Jun 2026 13:42:24 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: mradermacher/Fusion3-14B-Instruct-i1-GGUF Source: Original Platform --- .gitattributes | 61 ++++++++++++++++++ Fusion3-14B-Instruct.i1-IQ1_M.gguf | 3 + Fusion3-14B-Instruct.i1-IQ1_S.gguf | 3 + Fusion3-14B-Instruct.i1-IQ2_M.gguf | 3 + Fusion3-14B-Instruct.i1-IQ2_S.gguf | 3 + Fusion3-14B-Instruct.i1-IQ2_XS.gguf | 3 + Fusion3-14B-Instruct.i1-IQ2_XXS.gguf | 3 + Fusion3-14B-Instruct.i1-IQ3_M.gguf | 3 + Fusion3-14B-Instruct.i1-IQ3_S.gguf | 3 + Fusion3-14B-Instruct.i1-IQ3_XS.gguf | 3 + Fusion3-14B-Instruct.i1-IQ3_XXS.gguf | 3 + Fusion3-14B-Instruct.i1-IQ4_XS.gguf | 3 + Fusion3-14B-Instruct.i1-Q2_K.gguf | 3 + Fusion3-14B-Instruct.i1-Q2_K_S.gguf | 3 + Fusion3-14B-Instruct.i1-Q3_K_L.gguf | 3 + Fusion3-14B-Instruct.i1-Q3_K_M.gguf | 3 + Fusion3-14B-Instruct.i1-Q3_K_S.gguf | 3 + Fusion3-14B-Instruct.i1-Q4_0.gguf | 3 + Fusion3-14B-Instruct.i1-Q4_0_4_4.gguf | 3 + Fusion3-14B-Instruct.i1-Q4_0_4_8.gguf | 3 + Fusion3-14B-Instruct.i1-Q4_0_8_8.gguf | 3 + Fusion3-14B-Instruct.i1-Q4_K_M.gguf | 3 + Fusion3-14B-Instruct.i1-Q4_K_S.gguf | 3 + Fusion3-14B-Instruct.i1-Q5_K_M.gguf | 3 + Fusion3-14B-Instruct.i1-Q5_K_S.gguf | 3 + Fusion3-14B-Instruct.i1-Q6_K.gguf | 3 + README.md | 91 +++++++++++++++++++++++++++ imatrix.dat | 3 + 28 files changed, 230 insertions(+) create mode 100644 .gitattributes create mode 100644 Fusion3-14B-Instruct.i1-IQ1_M.gguf create mode 100644 Fusion3-14B-Instruct.i1-IQ1_S.gguf create mode 100644 Fusion3-14B-Instruct.i1-IQ2_M.gguf create mode 100644 Fusion3-14B-Instruct.i1-IQ2_S.gguf create mode 100644 Fusion3-14B-Instruct.i1-IQ2_XS.gguf create mode 100644 Fusion3-14B-Instruct.i1-IQ2_XXS.gguf create mode 100644 Fusion3-14B-Instruct.i1-IQ3_M.gguf create mode 100644 Fusion3-14B-Instruct.i1-IQ3_S.gguf create mode 100644 Fusion3-14B-Instruct.i1-IQ3_XS.gguf create mode 100644 Fusion3-14B-Instruct.i1-IQ3_XXS.gguf create mode 100644 Fusion3-14B-Instruct.i1-IQ4_XS.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q2_K.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q2_K_S.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q3_K_L.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q3_K_M.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q3_K_S.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q4_0.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q4_0_4_4.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q4_0_4_8.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q4_0_8_8.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q4_K_M.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q4_K_S.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q5_K_M.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q5_K_S.gguf create mode 100644 Fusion3-14B-Instruct.i1-Q6_K.gguf create mode 100644 README.md create mode 100644 imatrix.dat diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..0e88517 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,61 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +imatrix.dat filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q4_0_4_4.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q4_0_4_8.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-Q4_0_8_8.gguf filter=lfs diff=lfs merge=lfs -text +Fusion3-14B-Instruct.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/Fusion3-14B-Instruct.i1-IQ1_M.gguf b/Fusion3-14B-Instruct.i1-IQ1_M.gguf new file mode 100644 index 0000000..17b4929 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-IQ1_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:78d3967787b503de9a417e3f114a649eced1dc40146f032614ffc18ed8fc8bf7 +size 3870226112 diff --git a/Fusion3-14B-Instruct.i1-IQ1_S.gguf b/Fusion3-14B-Instruct.i1-IQ1_S.gguf new file mode 100644 index 0000000..6f6fe8b --- /dev/null +++ b/Fusion3-14B-Instruct.i1-IQ1_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:52f9d98de6a464eaf846d8bf8f170191eaa8a4e6a783cff35b1d543f6d4e55a0 +size 3605911232 diff --git a/Fusion3-14B-Instruct.i1-IQ2_M.gguf b/Fusion3-14B-Instruct.i1-IQ2_M.gguf new file mode 100644 index 0000000..387707c --- /dev/null +++ b/Fusion3-14B-Instruct.i1-IQ2_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b3606c0e8cc77847e5b6be625bd5684ba6a2961988f6650da577aa2e92271ab0 +size 5353856064 diff --git a/Fusion3-14B-Instruct.i1-IQ2_S.gguf b/Fusion3-14B-Instruct.i1-IQ2_S.gguf new file mode 100644 index 0000000..25f026d --- /dev/null +++ b/Fusion3-14B-Instruct.i1-IQ2_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:dc449a667318ea956a62b45b5488357e69e5902da307e22de0b43610eac4e724 +size 5001436224 diff --git a/Fusion3-14B-Instruct.i1-IQ2_XS.gguf b/Fusion3-14B-Instruct.i1-IQ2_XS.gguf new file mode 100644 index 0000000..d668075 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-IQ2_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:89354bafa8fac0a863b8a575868c2e6f18263d07a0bddef3e810e00a448dd777 +size 4702492352 diff --git a/Fusion3-14B-Instruct.i1-IQ2_XXS.gguf b/Fusion3-14B-Instruct.i1-IQ2_XXS.gguf new file mode 100644 index 0000000..eff596f --- /dev/null +++ b/Fusion3-14B-Instruct.i1-IQ2_XXS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:fcbcd7d7aee6868425132538b5962f915c77c42f41663a42a29d5f0afa98dd92 +size 4310750912 diff --git a/Fusion3-14B-Instruct.i1-IQ3_M.gguf b/Fusion3-14B-Instruct.i1-IQ3_M.gguf new file mode 100644 index 0000000..13e307b --- /dev/null +++ b/Fusion3-14B-Instruct.i1-IQ3_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:50f48cd44cdc9bef48f1d6dbd8e47179506c00c5c940a75afdf088520ff14755 +size 6913976448 diff --git a/Fusion3-14B-Instruct.i1-IQ3_S.gguf b/Fusion3-14B-Instruct.i1-IQ3_S.gguf new file mode 100644 index 0000000..1f7f8c8 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-IQ3_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c6a3d11a35badf35aa8bcc50f79fd5da14c92054b8da5e9a52069482afd30d32 +size 6690457728 diff --git a/Fusion3-14B-Instruct.i1-IQ3_XS.gguf b/Fusion3-14B-Instruct.i1-IQ3_XS.gguf new file mode 100644 index 0000000..208340f --- /dev/null +++ b/Fusion3-14B-Instruct.i1-IQ3_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:70f68124e56f0b7acb3e88bbd3efb27f99fe32575208a8b97705b58f9a43b211 +size 6380800128 diff --git a/Fusion3-14B-Instruct.i1-IQ3_XXS.gguf b/Fusion3-14B-Instruct.i1-IQ3_XXS.gguf new file mode 100644 index 0000000..7ca922a --- /dev/null +++ b/Fusion3-14B-Instruct.i1-IQ3_XXS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4c1e7216563a12b441659adf13d800706c9ad8b3dc18208fef9919ae65dbb69c +size 5944417344 diff --git a/Fusion3-14B-Instruct.i1-IQ4_XS.gguf b/Fusion3-14B-Instruct.i1-IQ4_XS.gguf new file mode 100644 index 0000000..1671d21 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f24e2f8f307fc4438545c6b36ae4a81ab53022fc48f3bfddc5c2bf55cfd3420d +size 8117071360 diff --git a/Fusion3-14B-Instruct.i1-Q2_K.gguf b/Fusion3-14B-Instruct.i1-Q2_K.gguf new file mode 100644 index 0000000..9983167 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:716c42edb7c0f63ade4ecec018242247511ca23a8df4e3248ad4a6005222e73f +size 5768143616 diff --git a/Fusion3-14B-Instruct.i1-Q2_K_S.gguf b/Fusion3-14B-Instruct.i1-Q2_K_S.gguf new file mode 100644 index 0000000..da59833 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q2_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7872600d3c704947402461ae3a45580b4074fad266c4cf5cc8304cd5f8bc0b15 +size 5394834176 diff --git a/Fusion3-14B-Instruct.i1-Q3_K_L.gguf b/Fusion3-14B-Instruct.i1-Q3_K_L.gguf new file mode 100644 index 0000000..b46bcc0 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1dffefd825a8f47adb7cf7f20547771a9e998dee627a94531002843a5a9950b3 +size 7922206848 diff --git a/Fusion3-14B-Instruct.i1-Q3_K_M.gguf b/Fusion3-14B-Instruct.i1-Q3_K_M.gguf new file mode 100644 index 0000000..6976600 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:af2195defcd6aacb3fe60f00c53cd664f6b0bbaadf2f8eed9f37a93ac8103e97 +size 7336642688 diff --git a/Fusion3-14B-Instruct.i1-Q3_K_S.gguf b/Fusion3-14B-Instruct.i1-Q3_K_S.gguf new file mode 100644 index 0000000..a672cf4 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e0fb5bfde25b3bf3300509bbc83facd326df6873aea6e6fbee533628e5d2c631 +size 6657034368 diff --git a/Fusion3-14B-Instruct.i1-Q4_0.gguf b/Fusion3-14B-Instruct.i1-Q4_0.gguf new file mode 100644 index 0000000..8781a48 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3adfe37e3628e090ae12edd4bd86b55a1dfa4447a5d59fdd225d52a6a7927a5c +size 8541435040 diff --git a/Fusion3-14B-Instruct.i1-Q4_0_4_4.gguf b/Fusion3-14B-Instruct.i1-Q4_0_4_4.gguf new file mode 100644 index 0000000..d13741b --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q4_0_4_4.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:783193832ceefe405fdf544d0a5e3dc3d1b5207944766f2dd8c7d1e997c0424d +size 8514892960 diff --git a/Fusion3-14B-Instruct.i1-Q4_0_4_8.gguf b/Fusion3-14B-Instruct.i1-Q4_0_4_8.gguf new file mode 100644 index 0000000..a594cbb --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q4_0_4_8.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f21b73cdf9538faadf418afebc84c8f9289b37b0e1b28c46d2ae2395d96c5989 +size 8514892960 diff --git a/Fusion3-14B-Instruct.i1-Q4_0_8_8.gguf b/Fusion3-14B-Instruct.i1-Q4_0_8_8.gguf new file mode 100644 index 0000000..1c9e58f --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q4_0_8_8.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b8c3f6ce5d53b3c77a2659cb12630af1a8853d77246d408731cf6b9b22c13dc4 +size 8514892960 diff --git a/Fusion3-14B-Instruct.i1-Q4_K_M.gguf b/Fusion3-14B-Instruct.i1-Q4_K_M.gguf new file mode 100644 index 0000000..0215478 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d8b4d63915db7a95f9b3d6e2be5e990af44aac903fdc8f563421a8e56d7b7df4 +size 8985277600 diff --git a/Fusion3-14B-Instruct.i1-Q4_K_S.gguf b/Fusion3-14B-Instruct.i1-Q4_K_S.gguf new file mode 100644 index 0000000..29f8ff1 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ec5eecd9d12de9679bcaaa302b6515f6bac916c9107a4c5598178fde395ecd54 +size 8570598560 diff --git a/Fusion3-14B-Instruct.i1-Q5_K_M.gguf b/Fusion3-14B-Instruct.i1-Q5_K_M.gguf new file mode 100644 index 0000000..f1e6cab --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7b9d4dc63dc84fc6b6fca9aaa110a55742bce26b26bbd65338494c1f381b88ac +size 10505785120 diff --git a/Fusion3-14B-Instruct.i1-Q5_K_S.gguf b/Fusion3-14B-Instruct.i1-Q5_K_S.gguf new file mode 100644 index 0000000..9fc1ce7 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b70412128494351dc2417f064cda65b860f79d70fb266a7017abd86602f53ac0 +size 10263465760 diff --git a/Fusion3-14B-Instruct.i1-Q6_K.gguf b/Fusion3-14B-Instruct.i1-Q6_K.gguf new file mode 100644 index 0000000..6a28b34 --- /dev/null +++ b/Fusion3-14B-Instruct.i1-Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3d3a7979fa7381416895283ea9126f6130e6161246e8dccf230388bf2dc3d927 +size 12121324384 diff --git a/README.md b/README.md new file mode 100644 index 0000000..803cba1 --- /dev/null +++ b/README.md @@ -0,0 +1,91 @@ +--- +base_model: qingy2024/Fusion3-14B-Instruct +language: +- zho +- eng +- fra +- spa +- por +- deu +- ita +- rus +- jpn +- kor +- vie +- tha +- ara +library_name: transformers +quantized_by: mradermacher +tags: +- mergekit +- merge +--- +## About + + + + + + +weighted/imatrix quants of https://huggingface.co/qingy2024/Fusion3-14B-Instruct + + +static quants are available at https://huggingface.co/mradermacher/Fusion3-14B-Instruct-GGUF +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-IQ1_S.gguf) | i1-IQ1_S | 3.7 | for the desperate | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-IQ1_M.gguf) | i1-IQ1_M | 4.0 | mostly desperate | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 4.4 | | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-IQ2_XS.gguf) | i1-IQ2_XS | 4.8 | | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-IQ2_S.gguf) | i1-IQ2_S | 5.1 | | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-IQ2_M.gguf) | i1-IQ2_M | 5.5 | | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q2_K_S.gguf) | i1-Q2_K_S | 5.5 | very low quality | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q2_K.gguf) | i1-Q2_K | 5.9 | IQ3_XXS probably better | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 6.0 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-IQ3_XS.gguf) | i1-IQ3_XS | 6.5 | | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q3_K_S.gguf) | i1-Q3_K_S | 6.8 | IQ3_XS probably better | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-IQ3_S.gguf) | i1-IQ3_S | 6.8 | beats Q3_K* | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-IQ3_M.gguf) | i1-IQ3_M | 7.0 | | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q3_K_M.gguf) | i1-Q3_K_M | 7.4 | IQ3_S probably better | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q3_K_L.gguf) | i1-Q3_K_L | 8.0 | IQ3_M probably better | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-IQ4_XS.gguf) | i1-IQ4_XS | 8.2 | | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q4_0_4_4.gguf) | i1-Q4_0_4_4 | 8.6 | fast on arm, low quality | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q4_0_4_8.gguf) | i1-Q4_0_4_8 | 8.6 | fast on arm+i8mm, low quality | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q4_0_8_8.gguf) | i1-Q4_0_8_8 | 8.6 | fast on arm+sve, low quality | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q4_0.gguf) | i1-Q4_0 | 8.6 | fast, low quality | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q4_K_S.gguf) | i1-Q4_K_S | 8.7 | optimal size/speed/quality | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q4_K_M.gguf) | i1-Q4_K_M | 9.1 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q5_K_S.gguf) | i1-Q5_K_S | 10.4 | | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q5_K_M.gguf) | i1-Q5_K_M | 10.6 | | +| [GGUF](https://huggingface.co/mradermacher/Fusion3-14B-Instruct-i1-GGUF/resolve/main/Fusion3-14B-Instruct.i1-Q6_K.gguf) | i1-Q6_K | 12.2 | practically like static Q6_K | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to. + + diff --git a/imatrix.dat b/imatrix.dat new file mode 100644 index 0000000..5510802 --- /dev/null +++ b/imatrix.dat @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:cf6f1a0cda7ee1388ca3d500a4e648f3c86b34912659e8bbd3330e2ffe0480e7 +size 8563597