commit b407b2bb8e43e1ee7b5736841d8ea5ed48c54474 Author: ModelHub XC Date: Tue Aug 4 22:19:17 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..fb03650 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,60 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +imatrix.dat filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ4_NL.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..25ea125 --- /dev/null +++ b/README.md @@ -0,0 +1,85 @@ +--- +base_model: EpistemeAI/Reasoning-Llama-3.2-1B-Instruct-v1.2 +datasets: +- bespokelabs/Bespoke-Stratos-17k +- AI-MO/NuminaMath-TIR +language: +- en +library_name: transformers +license: apache-2.0 +quantized_by: mradermacher +tags: +- text-generation-inference +- transformers +- unsloth +- llama +- trl +--- +## About + + + + + + +weighted/imatrix quants of https://huggingface.co/EpistemeAI/Reasoning-Llama-3.2-1B-Instruct-v1.2 + + +static quants are available at https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-GGUF +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ1_S.gguf) | i1-IQ1_S | 0.5 | for the desperate | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ1_M.gguf) | i1-IQ1_M | 0.5 | mostly desperate | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 0.5 | | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_XS.gguf) | i1-IQ2_XS | 0.6 | | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_S.gguf) | i1-IQ2_S | 0.6 | | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_M.gguf) | i1-IQ2_M | 0.6 | | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q2_K_S.gguf) | i1-Q2_K_S | 0.7 | very low quality | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 0.7 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q2_K.gguf) | i1-Q2_K | 0.7 | IQ3_XXS probably better | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_XS.gguf) | i1-IQ3_XS | 0.7 | | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_S.gguf) | i1-Q3_K_S | 0.7 | IQ3_XS probably better | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_S.gguf) | i1-IQ3_S | 0.7 | beats Q3_K* | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_M.gguf) | i1-IQ3_M | 0.8 | | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_M.gguf) | i1-Q3_K_M | 0.8 | IQ3_S probably better | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_L.gguf) | i1-Q3_K_L | 0.8 | IQ3_M probably better | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ4_XS.gguf) | i1-IQ4_XS | 0.8 | | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ4_NL.gguf) | i1-IQ4_NL | 0.9 | prefer IQ4_XS | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_0.gguf) | i1-Q4_0 | 0.9 | fast, low quality | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_K_S.gguf) | i1-Q4_K_S | 0.9 | optimal size/speed/quality | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_K_M.gguf) | i1-Q4_K_M | 0.9 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_1.gguf) | i1-Q4_1 | 0.9 | | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q5_K_S.gguf) | i1-Q5_K_S | 1.0 | | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q5_K_M.gguf) | i1-Q5_K_M | 1.0 | | +| [GGUF](https://huggingface.co/mradermacher/Reasoning-Llama-3.2-1B-Instruct-v1.2-i1-GGUF/resolve/main/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q6_K.gguf) | i1-Q6_K | 1.1 | practically like static Q6_K | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to. + + diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ1_M.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ1_M.gguf new file mode 100644 index 0000000..ba15222 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ1_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:53427e062ac8b4a2c3626da6e6eb4dd0a1349c7eb589192eb83a8c5d6a175a86 +size 413608160 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ1_S.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ1_S.gguf new file mode 100644 index 0000000..b4cc6ba --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ1_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f538ae625b71307d11aa4cff0d03f472a64b91d9185428b4419f4943c27aad75 +size 393554144 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_M.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_M.gguf new file mode 100644 index 0000000..86caf33 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c2d92d0cd3e213290b8052a896cc1ef2103027108b6fb57aa456dccfbfbd16a1 +size 515451104 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_S.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_S.gguf new file mode 100644 index 0000000..aa85f99 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1d8e552e7d6bd4b872c81c430db367749a2dd0e9a3332fa09e1180de2231bb36 +size 488712416 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_XS.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_XS.gguf new file mode 100644 index 0000000..b93ca23 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e4d3e7618e6b0bd1e1bb27f11890da297f5697df4b21895c5781999ba1f29c92 +size 475867360 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_XXS.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_XXS.gguf new file mode 100644 index 0000000..59f4777 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ2_XXS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d8779389be52ef4792846edc21f922242af0741df82e1ef4b9898a29e423b705 +size 447031520 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_M.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_M.gguf new file mode 100644 index 0000000..5a80a92 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:fa629851817a6b299eb23ad828019476ecdac8d55f2bb32de818776fa76bf327 +size 657291488 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_S.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_S.gguf new file mode 100644 index 0000000..b6dcdd3 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:684a888717f472a5379292090fd6853bf1b013fa3dfbe97f763919fbb3bb7a15 +size 643922144 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_XS.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_XS.gguf new file mode 100644 index 0000000..c0d9f31 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b4c1b755829af77b51d39abb52f47a82b2430addfa8840709659dfb3c5b2db1a +size 621115616 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_XXS.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_XXS.gguf new file mode 100644 index 0000000..67e1a7c --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ3_XXS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6297031ef8ca57b50b3916d3857d60a49c039d1f8f48381e1606b0aa54a97a3b +size 562112736 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ4_NL.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ4_NL.gguf new file mode 100644 index 0000000..f44d77c --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ4_NL.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ce0ad27ddc2341660e38e5688c1b1f5f203a09e59bc1014c3f7907d59070a9ec +size 773028064 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ4_XS.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ4_XS.gguf new file mode 100644 index 0000000..d501182 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ea11956b0a0933386d67af51b1ca6ba5de9d4ebb0e0e508a5859fb6977dd01dd +size 743143648 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q2_K.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q2_K.gguf new file mode 100644 index 0000000..8d31634 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:90e6330acb300bbb2d9ebada0572f30ed5bee8f8a968a271e4ab41801da261d3 +size 580876512 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q2_K_S.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q2_K_S.gguf new file mode 100644 index 0000000..2621c1c --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q2_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:fbc905761453333e4ebdd15ca095204df9d6ad35a9e0ea8b899d3d254e537e20 +size 554662112 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_L.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_L.gguf new file mode 100644 index 0000000..1640e10 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:08eb7e01b399bd6f67746899950044002dbb4915cf8e470b00619d95383ca73b +size 732526816 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_M.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_M.gguf new file mode 100644 index 0000000..ee0dd5f --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a45903c857031b0d0408ae86212e1370b9fd59779e7bfda43455e5a9bd876353 +size 690845920 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_S.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_S.gguf new file mode 100644 index 0000000..2ab983a --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0288edbeb6f006e17b63738ce9caa45b2ab9d2616bc145c3020d6b0e8504c02b +size 641693920 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_0.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_0.gguf new file mode 100644 index 0000000..92cd2dc --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:124c61fd178198eb3c39009d245308cc2ecce4e2e9f4d1b36fc9a0625f1e2324 +size 773028064 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_1.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_1.gguf new file mode 100644 index 0000000..4c3fe1d --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d90accf8fa61c367f25b66cd2f335d92d15773fdc1127c3cf8b6de59c2fabbec +size 831748320 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_K_M.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_K_M.gguf new file mode 100644 index 0000000..159d865 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1f6e6fe38080fbd674e5f617b4aca2f45adb5aeccc77200b48d723d162f47106 +size 807696608 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_K_S.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_K_S.gguf new file mode 100644 index 0000000..7bd3814 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:bf33509882ffead70001a55decfa633b602ac4cc4b786b6cf7d85052f47ddb1e +size 775649504 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q5_K_M.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q5_K_M.gguf new file mode 100644 index 0000000..b667432 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:15b4726fe60a66f12c2c47ee024183e12e482affa664ea2299d89a9f58905974 +size 911505632 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q5_K_S.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q5_K_S.gguf new file mode 100644 index 0000000..e1f63a3 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:24094846275c94dc05d184358d5a9d9e8568affa5e38f2de5ae11bbebf7047a0 +size 892565728 diff --git a/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q6_K.gguf b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q6_K.gguf new file mode 100644 index 0000000..0a88915 --- /dev/null +++ b/Reasoning-Llama-3.2-1B-Instruct-v1.2.i1-Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5e8500b2f86123af4b028dd307615e68d875c26520c70394178b78b482e818a9 +size 1021802720 diff --git a/imatrix.dat b/imatrix.dat new file mode 100644 index 0000000..2c43b60 --- /dev/null +++ b/imatrix.dat @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3470b5befee9fbf56f72daa1c69b6bdecad9409b8f7fe3992c369f97e1864cc4 +size 1314413