From 145683fa84ac7f9efb224ba7f88a17c13c8b7536 Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Tue, 7 Jul 2026 13:32:17 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: mradermacher/ELN-Llama-1B-base-i1-GGUF Source: Original Platform --- .gitattributes | 60 +++++++++++++++++++++ ELN-Llama-1B-base.i1-IQ1_M.gguf | 3 ++ ELN-Llama-1B-base.i1-IQ1_S.gguf | 3 ++ ELN-Llama-1B-base.i1-IQ2_M.gguf | 3 ++ ELN-Llama-1B-base.i1-IQ2_S.gguf | 3 ++ ELN-Llama-1B-base.i1-IQ2_XS.gguf | 3 ++ ELN-Llama-1B-base.i1-IQ2_XXS.gguf | 3 ++ ELN-Llama-1B-base.i1-IQ3_M.gguf | 3 ++ ELN-Llama-1B-base.i1-IQ3_S.gguf | 3 ++ ELN-Llama-1B-base.i1-IQ3_XS.gguf | 3 ++ ELN-Llama-1B-base.i1-IQ3_XXS.gguf | 3 ++ ELN-Llama-1B-base.i1-IQ4_NL.gguf | 3 ++ ELN-Llama-1B-base.i1-IQ4_XS.gguf | 3 ++ ELN-Llama-1B-base.i1-Q2_K.gguf | 3 ++ ELN-Llama-1B-base.i1-Q2_K_S.gguf | 3 ++ ELN-Llama-1B-base.i1-Q3_K_L.gguf | 3 ++ ELN-Llama-1B-base.i1-Q3_K_M.gguf | 3 ++ ELN-Llama-1B-base.i1-Q3_K_S.gguf | 3 ++ ELN-Llama-1B-base.i1-Q4_0.gguf | 3 ++ ELN-Llama-1B-base.i1-Q4_1.gguf | 3 ++ ELN-Llama-1B-base.i1-Q4_K_M.gguf | 3 ++ ELN-Llama-1B-base.i1-Q4_K_S.gguf | 3 ++ ELN-Llama-1B-base.i1-Q5_K_M.gguf | 3 ++ ELN-Llama-1B-base.i1-Q5_K_S.gguf | 3 ++ ELN-Llama-1B-base.i1-Q6_K.gguf | 3 ++ README.md | 89 +++++++++++++++++++++++++++++++ imatrix.dat | 3 ++ 27 files changed, 224 insertions(+) create mode 100644 .gitattributes create mode 100644 ELN-Llama-1B-base.i1-IQ1_M.gguf create mode 100644 ELN-Llama-1B-base.i1-IQ1_S.gguf create mode 100644 ELN-Llama-1B-base.i1-IQ2_M.gguf create mode 100644 ELN-Llama-1B-base.i1-IQ2_S.gguf create mode 100644 ELN-Llama-1B-base.i1-IQ2_XS.gguf create mode 100644 ELN-Llama-1B-base.i1-IQ2_XXS.gguf create mode 100644 ELN-Llama-1B-base.i1-IQ3_M.gguf create mode 100644 ELN-Llama-1B-base.i1-IQ3_S.gguf create mode 100644 ELN-Llama-1B-base.i1-IQ3_XS.gguf create mode 100644 ELN-Llama-1B-base.i1-IQ3_XXS.gguf create mode 100644 ELN-Llama-1B-base.i1-IQ4_NL.gguf create mode 100644 ELN-Llama-1B-base.i1-IQ4_XS.gguf create mode 100644 ELN-Llama-1B-base.i1-Q2_K.gguf create mode 100644 ELN-Llama-1B-base.i1-Q2_K_S.gguf create mode 100644 ELN-Llama-1B-base.i1-Q3_K_L.gguf create mode 100644 ELN-Llama-1B-base.i1-Q3_K_M.gguf create mode 100644 ELN-Llama-1B-base.i1-Q3_K_S.gguf create mode 100644 ELN-Llama-1B-base.i1-Q4_0.gguf create mode 100644 ELN-Llama-1B-base.i1-Q4_1.gguf create mode 100644 ELN-Llama-1B-base.i1-Q4_K_M.gguf create mode 100644 ELN-Llama-1B-base.i1-Q4_K_S.gguf create mode 100644 ELN-Llama-1B-base.i1-Q5_K_M.gguf create mode 100644 ELN-Llama-1B-base.i1-Q5_K_S.gguf create mode 100644 ELN-Llama-1B-base.i1-Q6_K.gguf create mode 100644 README.md create mode 100644 imatrix.dat diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..4823b19 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,60 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +imatrix.dat filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-IQ4_NL.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +ELN-Llama-1B-base.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/ELN-Llama-1B-base.i1-IQ1_M.gguf b/ELN-Llama-1B-base.i1-IQ1_M.gguf new file mode 100644 index 0000000..d3bd1c7 --- /dev/null +++ b/ELN-Llama-1B-base.i1-IQ1_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:167ce48832502c42119a38c2e0b3cc9e2aeab1cc231a61c46eda0a95e00fa9f5 +size 413602624 diff --git a/ELN-Llama-1B-base.i1-IQ1_S.gguf b/ELN-Llama-1B-base.i1-IQ1_S.gguf new file mode 100644 index 0000000..657af2d --- /dev/null +++ b/ELN-Llama-1B-base.i1-IQ1_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:409f27a9982283ecb9ce68b3e6d7c0327db25545de01fa1ddd2913d033b62b6d +size 393548608 diff --git a/ELN-Llama-1B-base.i1-IQ2_M.gguf b/ELN-Llama-1B-base.i1-IQ2_M.gguf new file mode 100644 index 0000000..500c319 --- /dev/null +++ b/ELN-Llama-1B-base.i1-IQ2_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a6e567906cd6d7d2cf96fff1ff913c1248827c21f305659e2bf3824b1e37717b +size 515445568 diff --git a/ELN-Llama-1B-base.i1-IQ2_S.gguf b/ELN-Llama-1B-base.i1-IQ2_S.gguf new file mode 100644 index 0000000..a5cd9fd --- /dev/null +++ b/ELN-Llama-1B-base.i1-IQ2_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:69fd428257b58ab4a89ab55ec40db0483d0969832f8c6d667421f07b801569ed +size 488706880 diff --git a/ELN-Llama-1B-base.i1-IQ2_XS.gguf b/ELN-Llama-1B-base.i1-IQ2_XS.gguf new file mode 100644 index 0000000..4d5d878 --- /dev/null +++ b/ELN-Llama-1B-base.i1-IQ2_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6ab8ef5213d4c7fd37b845f0da1cac98410aa7e0e6b60e4b8586eac2c10ab6cb +size 475861824 diff --git a/ELN-Llama-1B-base.i1-IQ2_XXS.gguf b/ELN-Llama-1B-base.i1-IQ2_XXS.gguf new file mode 100644 index 0000000..5e1dee3 --- /dev/null +++ b/ELN-Llama-1B-base.i1-IQ2_XXS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:29fd1b62704e129f839edf49e2e7760956eb3674484341f7f99a4078955aaf18 +size 447025984 diff --git a/ELN-Llama-1B-base.i1-IQ3_M.gguf b/ELN-Llama-1B-base.i1-IQ3_M.gguf new file mode 100644 index 0000000..234db35 --- /dev/null +++ b/ELN-Llama-1B-base.i1-IQ3_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:39b545cf9163b059841cb5f9b13328a4a0cad41a60b3731633a9922f9c493b3d +size 657285952 diff --git a/ELN-Llama-1B-base.i1-IQ3_S.gguf b/ELN-Llama-1B-base.i1-IQ3_S.gguf new file mode 100644 index 0000000..22174f2 --- /dev/null +++ b/ELN-Llama-1B-base.i1-IQ3_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2a50c319e2690027a3a9c6f955a28fe1a0851dd56472650f1b57d3b33eef82ac +size 643916608 diff --git a/ELN-Llama-1B-base.i1-IQ3_XS.gguf b/ELN-Llama-1B-base.i1-IQ3_XS.gguf new file mode 100644 index 0000000..7b37914 --- /dev/null +++ b/ELN-Llama-1B-base.i1-IQ3_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e9aac96c7096f05f739933665ee9b9ce83267838c1866ef7e749522e5d5a88e8 +size 621110080 diff --git a/ELN-Llama-1B-base.i1-IQ3_XXS.gguf b/ELN-Llama-1B-base.i1-IQ3_XXS.gguf new file mode 100644 index 0000000..9a5b902 --- /dev/null +++ b/ELN-Llama-1B-base.i1-IQ3_XXS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e717f06d8d743caf6a54f7204b021e09bf60fd2ecb52d19ed01e13b1a1407632 +size 562107200 diff --git a/ELN-Llama-1B-base.i1-IQ4_NL.gguf b/ELN-Llama-1B-base.i1-IQ4_NL.gguf new file mode 100644 index 0000000..29012f5 --- /dev/null +++ b/ELN-Llama-1B-base.i1-IQ4_NL.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:17a536e66c4376a67cee2ecd1697be181806184193d117c3a528c3004ef7726c +size 773022528 diff --git a/ELN-Llama-1B-base.i1-IQ4_XS.gguf b/ELN-Llama-1B-base.i1-IQ4_XS.gguf new file mode 100644 index 0000000..3f0de61 --- /dev/null +++ b/ELN-Llama-1B-base.i1-IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f5a9ca38ad7d94f75b8a1a9099f9bf28b264235c44b425e46d46299a29904238 +size 743138112 diff --git a/ELN-Llama-1B-base.i1-Q2_K.gguf b/ELN-Llama-1B-base.i1-Q2_K.gguf new file mode 100644 index 0000000..916f4eb --- /dev/null +++ b/ELN-Llama-1B-base.i1-Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a28437d7e378e33c26988d65c76acdaaea2bdb4c4b4c977aafab75a28caf91e0 +size 580870976 diff --git a/ELN-Llama-1B-base.i1-Q2_K_S.gguf b/ELN-Llama-1B-base.i1-Q2_K_S.gguf new file mode 100644 index 0000000..60a542d --- /dev/null +++ b/ELN-Llama-1B-base.i1-Q2_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a983d04ac087f6ad27aa5f4e69ed5e7647e65f4dfb2d8710ea44095b8104ade4 +size 554656576 diff --git a/ELN-Llama-1B-base.i1-Q3_K_L.gguf b/ELN-Llama-1B-base.i1-Q3_K_L.gguf new file mode 100644 index 0000000..416216d --- /dev/null +++ b/ELN-Llama-1B-base.i1-Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f53ddff464ede21823573cb1a9ceba87ddcd39a4f030f90a5e03f63379a9222c +size 732521280 diff --git a/ELN-Llama-1B-base.i1-Q3_K_M.gguf b/ELN-Llama-1B-base.i1-Q3_K_M.gguf new file mode 100644 index 0000000..6e2151b --- /dev/null +++ b/ELN-Llama-1B-base.i1-Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0722e4b5f7461ced73b8d55f0e20ad125141a51c63b89c3699a2609bfed969a3 +size 690840384 diff --git a/ELN-Llama-1B-base.i1-Q3_K_S.gguf b/ELN-Llama-1B-base.i1-Q3_K_S.gguf new file mode 100644 index 0000000..5cd75aa --- /dev/null +++ b/ELN-Llama-1B-base.i1-Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:fdf413ee1d2c603ff341b23652e49d7bf2e3971f706f7f8dabb3afc386e6c561 +size 641688384 diff --git a/ELN-Llama-1B-base.i1-Q4_0.gguf b/ELN-Llama-1B-base.i1-Q4_0.gguf new file mode 100644 index 0000000..5e2a8ea --- /dev/null +++ b/ELN-Llama-1B-base.i1-Q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:fc99f0ea70c7ee0e6e9b11b641aeb96fb82a4eaf9c9565c88dfc3da6f0b99ac7 +size 773022528 diff --git a/ELN-Llama-1B-base.i1-Q4_1.gguf b/ELN-Llama-1B-base.i1-Q4_1.gguf new file mode 100644 index 0000000..c2e9dc2 --- /dev/null +++ b/ELN-Llama-1B-base.i1-Q4_1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6c9bd8edfb39d5d43c45af33ae964e4b2ce5375f6cf07cbad6f0b97c4ec614ba +size 831742784 diff --git a/ELN-Llama-1B-base.i1-Q4_K_M.gguf b/ELN-Llama-1B-base.i1-Q4_K_M.gguf new file mode 100644 index 0000000..01d54ea --- /dev/null +++ b/ELN-Llama-1B-base.i1-Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4e5a55ac1d5d0a5d29c51f516dedb6b958908fa62b8f620dfe77728dd0375a1b +size 807691072 diff --git a/ELN-Llama-1B-base.i1-Q4_K_S.gguf b/ELN-Llama-1B-base.i1-Q4_K_S.gguf new file mode 100644 index 0000000..d31ab30 --- /dev/null +++ b/ELN-Llama-1B-base.i1-Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c3aa54525779d6ed6637f2d4d025cc3cc8be1b73051e5a5a51b7bb95de2b4022 +size 775643968 diff --git a/ELN-Llama-1B-base.i1-Q5_K_M.gguf b/ELN-Llama-1B-base.i1-Q5_K_M.gguf new file mode 100644 index 0000000..82ae417 --- /dev/null +++ b/ELN-Llama-1B-base.i1-Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a55343cdd09066a9067730385f674abf0bd8a9b80f63d203e03c4d29d838609f +size 911500096 diff --git a/ELN-Llama-1B-base.i1-Q5_K_S.gguf b/ELN-Llama-1B-base.i1-Q5_K_S.gguf new file mode 100644 index 0000000..3c176e8 --- /dev/null +++ b/ELN-Llama-1B-base.i1-Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:332043af1e927753483ee985ee402d980f908a6f47acc01629ab118467c3b704 +size 892560192 diff --git a/ELN-Llama-1B-base.i1-Q6_K.gguf b/ELN-Llama-1B-base.i1-Q6_K.gguf new file mode 100644 index 0000000..b7f1794 --- /dev/null +++ b/ELN-Llama-1B-base.i1-Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e0e2f120118654a8cde69629db297be1e30edcfd7e5abf18e2c89a574ce7fda2 +size 1021797184 diff --git a/README.md b/README.md new file mode 100644 index 0000000..e316eae --- /dev/null +++ b/README.md @@ -0,0 +1,89 @@ +--- +base_model: AIRRC/ELN-Llama-1B-base +language: +- en +- de +- fr +- it +- pt +- hi +- es +- th +library_name: transformers +license: llama3.2 +quantized_by: mradermacher +tags: +- facebook +- meta +- pytorch +- llama +- llama-3 +--- +## About + + + + + + +weighted/imatrix quants of https://huggingface.co/AIRRC/ELN-Llama-1B-base + + +static quants are available at https://huggingface.co/mradermacher/ELN-Llama-1B-base-GGUF +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-IQ1_S.gguf) | i1-IQ1_S | 0.5 | for the desperate | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-IQ1_M.gguf) | i1-IQ1_M | 0.5 | mostly desperate | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 0.5 | | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-IQ2_XS.gguf) | i1-IQ2_XS | 0.6 | | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-IQ2_S.gguf) | i1-IQ2_S | 0.6 | | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-IQ2_M.gguf) | i1-IQ2_M | 0.6 | | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-Q2_K_S.gguf) | i1-Q2_K_S | 0.7 | very low quality | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 0.7 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-Q2_K.gguf) | i1-Q2_K | 0.7 | IQ3_XXS probably better | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-IQ3_XS.gguf) | i1-IQ3_XS | 0.7 | | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-Q3_K_S.gguf) | i1-Q3_K_S | 0.7 | IQ3_XS probably better | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-IQ3_S.gguf) | i1-IQ3_S | 0.7 | beats Q3_K* | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-IQ3_M.gguf) | i1-IQ3_M | 0.8 | | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-Q3_K_M.gguf) | i1-Q3_K_M | 0.8 | IQ3_S probably better | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-Q3_K_L.gguf) | i1-Q3_K_L | 0.8 | IQ3_M probably better | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-IQ4_XS.gguf) | i1-IQ4_XS | 0.8 | | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-IQ4_NL.gguf) | i1-IQ4_NL | 0.9 | prefer IQ4_XS | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-Q4_0.gguf) | i1-Q4_0 | 0.9 | fast, low quality | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-Q4_K_S.gguf) | i1-Q4_K_S | 0.9 | optimal size/speed/quality | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-Q4_K_M.gguf) | i1-Q4_K_M | 0.9 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-Q4_1.gguf) | i1-Q4_1 | 0.9 | | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-Q5_K_S.gguf) | i1-Q5_K_S | 1.0 | | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-Q5_K_M.gguf) | i1-Q5_K_M | 1.0 | | +| [GGUF](https://huggingface.co/mradermacher/ELN-Llama-1B-base-i1-GGUF/resolve/main/ELN-Llama-1B-base.i1-Q6_K.gguf) | i1-Q6_K | 1.1 | practically like static Q6_K | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to. + + diff --git a/imatrix.dat b/imatrix.dat new file mode 100644 index 0000000..e9bff42 --- /dev/null +++ b/imatrix.dat @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:cae3136ae5991719a75c3dc866aa6a16a98b4fb1c08f6e1be4e0294475a0e190 +size 1314413