From c794823b0788a3f82462227b62e45ec9c597346a Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Thu, 1 Oct 2026 23:01:20 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: mradermacher/Llama-2-7b-samsum-i1-GGUF Source: Original Platform --- .gitattributes | 60 ++++++++++++++++++++++++ Llama-2-7b-samsum.i1-IQ1_M.gguf | 3 ++ Llama-2-7b-samsum.i1-IQ1_S.gguf | 3 ++ Llama-2-7b-samsum.i1-IQ2_M.gguf | 3 ++ Llama-2-7b-samsum.i1-IQ2_S.gguf | 3 ++ Llama-2-7b-samsum.i1-IQ2_XS.gguf | 3 ++ Llama-2-7b-samsum.i1-IQ2_XXS.gguf | 3 ++ Llama-2-7b-samsum.i1-IQ3_M.gguf | 3 ++ Llama-2-7b-samsum.i1-IQ3_S.gguf | 3 ++ Llama-2-7b-samsum.i1-IQ3_XS.gguf | 3 ++ Llama-2-7b-samsum.i1-IQ3_XXS.gguf | 3 ++ Llama-2-7b-samsum.i1-IQ4_NL.gguf | 3 ++ Llama-2-7b-samsum.i1-IQ4_XS.gguf | 3 ++ Llama-2-7b-samsum.i1-Q2_K.gguf | 3 ++ Llama-2-7b-samsum.i1-Q2_K_S.gguf | 3 ++ Llama-2-7b-samsum.i1-Q3_K_L.gguf | 3 ++ Llama-2-7b-samsum.i1-Q3_K_M.gguf | 3 ++ Llama-2-7b-samsum.i1-Q3_K_S.gguf | 3 ++ Llama-2-7b-samsum.i1-Q4_0.gguf | 3 ++ Llama-2-7b-samsum.i1-Q4_1.gguf | 3 ++ Llama-2-7b-samsum.i1-Q4_K_M.gguf | 3 ++ Llama-2-7b-samsum.i1-Q4_K_S.gguf | 3 ++ Llama-2-7b-samsum.i1-Q5_K_M.gguf | 3 ++ Llama-2-7b-samsum.i1-Q5_K_S.gguf | 3 ++ Llama-2-7b-samsum.i1-Q6_K.gguf | 3 ++ README.md | 78 +++++++++++++++++++++++++++++++ imatrix.dat | 3 ++ 27 files changed, 213 insertions(+) create mode 100644 .gitattributes create mode 100644 Llama-2-7b-samsum.i1-IQ1_M.gguf create mode 100644 Llama-2-7b-samsum.i1-IQ1_S.gguf create mode 100644 Llama-2-7b-samsum.i1-IQ2_M.gguf create mode 100644 Llama-2-7b-samsum.i1-IQ2_S.gguf create mode 100644 Llama-2-7b-samsum.i1-IQ2_XS.gguf create mode 100644 Llama-2-7b-samsum.i1-IQ2_XXS.gguf create mode 100644 Llama-2-7b-samsum.i1-IQ3_M.gguf create mode 100644 Llama-2-7b-samsum.i1-IQ3_S.gguf create mode 100644 Llama-2-7b-samsum.i1-IQ3_XS.gguf create mode 100644 Llama-2-7b-samsum.i1-IQ3_XXS.gguf create mode 100644 Llama-2-7b-samsum.i1-IQ4_NL.gguf create mode 100644 Llama-2-7b-samsum.i1-IQ4_XS.gguf create mode 100644 Llama-2-7b-samsum.i1-Q2_K.gguf create mode 100644 Llama-2-7b-samsum.i1-Q2_K_S.gguf create mode 100644 Llama-2-7b-samsum.i1-Q3_K_L.gguf create mode 100644 Llama-2-7b-samsum.i1-Q3_K_M.gguf create mode 100644 Llama-2-7b-samsum.i1-Q3_K_S.gguf create mode 100644 Llama-2-7b-samsum.i1-Q4_0.gguf create mode 100644 Llama-2-7b-samsum.i1-Q4_1.gguf create mode 100644 Llama-2-7b-samsum.i1-Q4_K_M.gguf create mode 100644 Llama-2-7b-samsum.i1-Q4_K_S.gguf create mode 100644 Llama-2-7b-samsum.i1-Q5_K_M.gguf create mode 100644 Llama-2-7b-samsum.i1-Q5_K_S.gguf create mode 100644 Llama-2-7b-samsum.i1-Q6_K.gguf create mode 100644 README.md create mode 100644 imatrix.dat diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..e0dc078 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,60 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +imatrix.dat filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-IQ4_NL.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text +Llama-2-7b-samsum.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/Llama-2-7b-samsum.i1-IQ1_M.gguf b/Llama-2-7b-samsum.i1-IQ1_M.gguf new file mode 100644 index 0000000..86d2304 --- /dev/null +++ b/Llama-2-7b-samsum.i1-IQ1_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:04ccac2541055047aafbf8258a10db8100b6f54014c1e5f2bacee1f3d3665c13 +size 1650971520 diff --git a/Llama-2-7b-samsum.i1-IQ1_S.gguf b/Llama-2-7b-samsum.i1-IQ1_S.gguf new file mode 100644 index 0000000..d1781a8 --- /dev/null +++ b/Llama-2-7b-samsum.i1-IQ1_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3ea9cd2f51ebf0ad0f48677cc612b330d8161577273d68374332a83d739b76b2 +size 1528583040 diff --git a/Llama-2-7b-samsum.i1-IQ2_M.gguf b/Llama-2-7b-samsum.i1-IQ2_M.gguf new file mode 100644 index 0000000..1922078 --- /dev/null +++ b/Llama-2-7b-samsum.i1-IQ2_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:bcdd66a816637b674a18c329a24a32c4e85ef1e980db1d45b804d19d7b1b1684 +size 2359751552 diff --git a/Llama-2-7b-samsum.i1-IQ2_S.gguf b/Llama-2-7b-samsum.i1-IQ2_S.gguf new file mode 100644 index 0000000..9eed9d0 --- /dev/null +++ b/Llama-2-7b-samsum.i1-IQ2_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2b8b8507e9a7f06094dc46dc8d3df40d33b6e49584fc55a515a3de23f4113302 +size 2196566912 diff --git a/Llama-2-7b-samsum.i1-IQ2_XS.gguf b/Llama-2-7b-samsum.i1-IQ2_XS.gguf new file mode 100644 index 0000000..5006c46 --- /dev/null +++ b/Llama-2-7b-samsum.i1-IQ2_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:20feb942a2b369df243a6cc403477b833267fa9722d1afc70265a3817c3bb0cd +size 2034914176 diff --git a/Llama-2-7b-samsum.i1-IQ2_XXS.gguf b/Llama-2-7b-samsum.i1-IQ2_XXS.gguf new file mode 100644 index 0000000..fdfd84c --- /dev/null +++ b/Llama-2-7b-samsum.i1-IQ2_XXS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a8c93082240db32073b7291b188963cb5f0cff56b608698096147a04e97aaf54 +size 1854952320 diff --git a/Llama-2-7b-samsum.i1-IQ3_M.gguf b/Llama-2-7b-samsum.i1-IQ3_M.gguf new file mode 100644 index 0000000..8be7e38 --- /dev/null +++ b/Llama-2-7b-samsum.i1-IQ3_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:45e2bd2b08de85b66945924ac4821e697e4f6537ed522385fc641666af723a70 +size 3114865536 diff --git a/Llama-2-7b-samsum.i1-IQ3_S.gguf b/Llama-2-7b-samsum.i1-IQ3_S.gguf new file mode 100644 index 0000000..ce7d171 --- /dev/null +++ b/Llama-2-7b-samsum.i1-IQ3_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c4e29ec138376fa2f77ee10e577d722d9f21ad3e1f6b6521938508de74262a99 +size 2948305792 diff --git a/Llama-2-7b-samsum.i1-IQ3_XS.gguf b/Llama-2-7b-samsum.i1-IQ3_XS.gguf new file mode 100644 index 0000000..43602bc --- /dev/null +++ b/Llama-2-7b-samsum.i1-IQ3_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ffc80a07031a13f5ee941f4f31599688ff844574ce04dec8d3f1aa1a745ca2e1 +size 2796524416 diff --git a/Llama-2-7b-samsum.i1-IQ3_XXS.gguf b/Llama-2-7b-samsum.i1-IQ3_XXS.gguf new file mode 100644 index 0000000..8711246 --- /dev/null +++ b/Llama-2-7b-samsum.i1-IQ3_XXS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c5fc5e9ba5958fb41319ac10c605f272162044c619b68b36fa42f07a3e16e389 +size 2585392000 diff --git a/Llama-2-7b-samsum.i1-IQ4_NL.gguf b/Llama-2-7b-samsum.i1-IQ4_NL.gguf new file mode 100644 index 0000000..895d9c1 --- /dev/null +++ b/Llama-2-7b-samsum.i1-IQ4_NL.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:181abbaee1fc32510c71ba61c77b2e3c9f343e30fe2f30e3b146d41c94bddc75 +size 3825808256 diff --git a/Llama-2-7b-samsum.i1-IQ4_XS.gguf b/Llama-2-7b-samsum.i1-IQ4_XS.gguf new file mode 100644 index 0000000..5b7496f --- /dev/null +++ b/Llama-2-7b-samsum.i1-IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:eb3531358bbb732bf27f2c90ab6cbdf677021a9d1ae2959e231b416963d8869b +size 3619337088 diff --git a/Llama-2-7b-samsum.i1-Q2_K.gguf b/Llama-2-7b-samsum.i1-Q2_K.gguf new file mode 100644 index 0000000..0f70446 --- /dev/null +++ b/Llama-2-7b-samsum.i1-Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:cce0cbf9e07b011d6e91166c3893fa7e51acaa91f6046cc732152c42390cd1e2 +size 2532864896 diff --git a/Llama-2-7b-samsum.i1-Q2_K_S.gguf b/Llama-2-7b-samsum.i1-Q2_K_S.gguf new file mode 100644 index 0000000..fe15396 --- /dev/null +++ b/Llama-2-7b-samsum.i1-Q2_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:027593b2fdcd213d4b4c031f3b8a1739230c2f00ca0cfe33a36d73d6a9b7086c +size 2319545216 diff --git a/Llama-2-7b-samsum.i1-Q3_K_L.gguf b/Llama-2-7b-samsum.i1-Q3_K_L.gguf new file mode 100644 index 0000000..aa84a08 --- /dev/null +++ b/Llama-2-7b-samsum.i1-Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:aa2c2768dfad3d4a56c076ab8261825a06a16b5b4ffc118302f402097aaefd70 +size 3597112192 diff --git a/Llama-2-7b-samsum.i1-Q3_K_M.gguf b/Llama-2-7b-samsum.i1-Q3_K_M.gguf new file mode 100644 index 0000000..70d7fae --- /dev/null +++ b/Llama-2-7b-samsum.i1-Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1a124ff640f2507acddc657018faca656d4bd7845da949fba320ee3426a586e6 +size 3298005888 diff --git a/Llama-2-7b-samsum.i1-Q3_K_S.gguf b/Llama-2-7b-samsum.i1-Q3_K_S.gguf new file mode 100644 index 0000000..d15395c --- /dev/null +++ b/Llama-2-7b-samsum.i1-Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:023edb52759e64a090ac21e713585a14a046fad7a98f991357b490f7d1485abb +size 2948305792 diff --git a/Llama-2-7b-samsum.i1-Q4_0.gguf b/Llama-2-7b-samsum.i1-Q4_0.gguf new file mode 100644 index 0000000..d1093cf --- /dev/null +++ b/Llama-2-7b-samsum.i1-Q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3e8b5459663e79fc2dad29cae90da36a0879b9b50316d7c45aeabd6063975482 +size 3837080448 diff --git a/Llama-2-7b-samsum.i1-Q4_1.gguf b/Llama-2-7b-samsum.i1-Q4_1.gguf new file mode 100644 index 0000000..812a619 --- /dev/null +++ b/Llama-2-7b-samsum.i1-Q4_1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:81485ce50a7fe6b15e7fbd946a172ba41eafb0e61794bd555ceec416f354be1e +size 4238750592 diff --git a/Llama-2-7b-samsum.i1-Q4_K_M.gguf b/Llama-2-7b-samsum.i1-Q4_K_M.gguf new file mode 100644 index 0000000..c70fbf3 --- /dev/null +++ b/Llama-2-7b-samsum.i1-Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:999b4d05223034cab56f4ceeb26604f3f6d5143aafaedc450848b8b49aa14313 +size 4081005440 diff --git a/Llama-2-7b-samsum.i1-Q4_K_S.gguf b/Llama-2-7b-samsum.i1-Q4_K_S.gguf new file mode 100644 index 0000000..7ee3e00 --- /dev/null +++ b/Llama-2-7b-samsum.i1-Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f091ccdbf7ec39c8aa30274ca7b757bdca5c21096d27b367b6018bf8fded7e99 +size 3856741248 diff --git a/Llama-2-7b-samsum.i1-Q5_K_M.gguf b/Llama-2-7b-samsum.i1-Q5_K_M.gguf new file mode 100644 index 0000000..d30faf6 --- /dev/null +++ b/Llama-2-7b-samsum.i1-Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e475d8feabc4e6739bde82f27e2d74248028337fa78efd8688a3c1319839efe5 +size 4783158144 diff --git a/Llama-2-7b-samsum.i1-Q5_K_S.gguf b/Llama-2-7b-samsum.i1-Q5_K_S.gguf new file mode 100644 index 0000000..6781383 --- /dev/null +++ b/Llama-2-7b-samsum.i1-Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:358266d6809f4230f4c06dc64da34530dea34d54e0a56695f3af2eb456ee5fe4 +size 4651692928 diff --git a/Llama-2-7b-samsum.i1-Q6_K.gguf b/Llama-2-7b-samsum.i1-Q6_K.gguf new file mode 100644 index 0000000..74a0445 --- /dev/null +++ b/Llama-2-7b-samsum.i1-Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f23019d4c02316221867caddf95dcd3e0e6c555f80cdf962fd7c4c64fd3ed051 +size 5529195392 diff --git a/README.md b/README.md new file mode 100644 index 0000000..6db14d5 --- /dev/null +++ b/README.md @@ -0,0 +1,78 @@ +--- +base_model: SalmanFaroz/Llama-2-7b-samsum +datasets: +- samsum +language: +- en +library_name: transformers +license: mit +quantized_by: mradermacher +--- +## About + + + + + + +weighted/imatrix quants of https://huggingface.co/SalmanFaroz/Llama-2-7b-samsum + + +static quants are available at https://huggingface.co/mradermacher/Llama-2-7b-samsum-GGUF +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-IQ1_S.gguf) | i1-IQ1_S | 1.6 | for the desperate | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-IQ1_M.gguf) | i1-IQ1_M | 1.8 | mostly desperate | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 2.0 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-IQ2_XS.gguf) | i1-IQ2_XS | 2.1 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-IQ2_S.gguf) | i1-IQ2_S | 2.3 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-Q2_K_S.gguf) | i1-Q2_K_S | 2.4 | very low quality | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-IQ2_M.gguf) | i1-IQ2_M | 2.5 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-Q2_K.gguf) | i1-Q2_K | 2.6 | IQ3_XXS probably better | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 2.7 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-IQ3_XS.gguf) | i1-IQ3_XS | 2.9 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-IQ3_S.gguf) | i1-IQ3_S | 3.0 | beats Q3_K* | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-Q3_K_S.gguf) | i1-Q3_K_S | 3.0 | IQ3_XS probably better | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-IQ3_M.gguf) | i1-IQ3_M | 3.2 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-Q3_K_M.gguf) | i1-Q3_K_M | 3.4 | IQ3_S probably better | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-Q3_K_L.gguf) | i1-Q3_K_L | 3.7 | IQ3_M probably better | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-IQ4_XS.gguf) | i1-IQ4_XS | 3.7 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-IQ4_NL.gguf) | i1-IQ4_NL | 3.9 | prefer IQ4_XS | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-Q4_0.gguf) | i1-Q4_0 | 3.9 | fast, low quality | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-Q4_K_S.gguf) | i1-Q4_K_S | 4.0 | optimal size/speed/quality | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-Q4_K_M.gguf) | i1-Q4_K_M | 4.2 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-Q4_1.gguf) | i1-Q4_1 | 4.3 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-Q5_K_S.gguf) | i1-Q5_K_S | 4.8 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-Q5_K_M.gguf) | i1-Q5_K_M | 4.9 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-2-7b-samsum-i1-GGUF/resolve/main/Llama-2-7b-samsum.i1-Q6_K.gguf) | i1-Q6_K | 5.6 | practically like static Q6_K | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to. + + diff --git a/imatrix.dat b/imatrix.dat new file mode 100644 index 0000000..b12d591 --- /dev/null +++ b/imatrix.dat @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4fce627115c1af3bcd05fdb1524c49cdf188aa0097b10343636d9c1eeb161129 +size 4562173