From cc6c72950821048cf02e6cd62617c076bcbc0bd9 Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Tue, 7 Jul 2026 15:55:12 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: QuantFactory/FineLlama-3.1-8B-GGUF Source: Original Platform --- .gitattributes | 49 ++++++++++++++++++++++ FineLlama-3.1-8B.Q2_K.gguf | 3 ++ FineLlama-3.1-8B.Q3_K_L.gguf | 3 ++ FineLlama-3.1-8B.Q3_K_M.gguf | 3 ++ FineLlama-3.1-8B.Q3_K_S.gguf | 3 ++ FineLlama-3.1-8B.Q4_0.gguf | 3 ++ FineLlama-3.1-8B.Q4_1.gguf | 3 ++ FineLlama-3.1-8B.Q4_K_M.gguf | 3 ++ FineLlama-3.1-8B.Q4_K_S.gguf | 3 ++ FineLlama-3.1-8B.Q5_0.gguf | 3 ++ FineLlama-3.1-8B.Q5_1.gguf | 3 ++ FineLlama-3.1-8B.Q5_K_M.gguf | 3 ++ FineLlama-3.1-8B.Q5_K_S.gguf | 3 ++ FineLlama-3.1-8B.Q6_K.gguf | 3 ++ FineLlama-3.1-8B.Q8_0.gguf | 3 ++ README.md | 79 ++++++++++++++++++++++++++++++++++++ configuration.json | 1 + 17 files changed, 171 insertions(+) create mode 100644 .gitattributes create mode 100644 FineLlama-3.1-8B.Q2_K.gguf create mode 100644 FineLlama-3.1-8B.Q3_K_L.gguf create mode 100644 FineLlama-3.1-8B.Q3_K_M.gguf create mode 100644 FineLlama-3.1-8B.Q3_K_S.gguf create mode 100644 FineLlama-3.1-8B.Q4_0.gguf create mode 100644 FineLlama-3.1-8B.Q4_1.gguf create mode 100644 FineLlama-3.1-8B.Q4_K_M.gguf create mode 100644 FineLlama-3.1-8B.Q4_K_S.gguf create mode 100644 FineLlama-3.1-8B.Q5_0.gguf create mode 100644 FineLlama-3.1-8B.Q5_1.gguf create mode 100644 FineLlama-3.1-8B.Q5_K_M.gguf create mode 100644 FineLlama-3.1-8B.Q5_K_S.gguf create mode 100644 FineLlama-3.1-8B.Q6_K.gguf create mode 100644 FineLlama-3.1-8B.Q8_0.gguf create mode 100644 README.md create mode 100644 configuration.json diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..a57a989 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,49 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q4_1.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q4_0.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q5_0.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q5_1.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +FineLlama-3.1-8B.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/FineLlama-3.1-8B.Q2_K.gguf b/FineLlama-3.1-8B.Q2_K.gguf new file mode 100644 index 0000000..db53a58 --- /dev/null +++ b/FineLlama-3.1-8B.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e8fd2dbac3989507c83607603966a4593abb3c77aaa80d3b9f89d8c61b1b2698 +size 3179132256 diff --git a/FineLlama-3.1-8B.Q3_K_L.gguf b/FineLlama-3.1-8B.Q3_K_L.gguf new file mode 100644 index 0000000..5c0664a --- /dev/null +++ b/FineLlama-3.1-8B.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:050f32d13e5fc39a6921cb7ba2b195c69c03fac30daecceade09628dfec5ef16 +size 4321957216 diff --git a/FineLlama-3.1-8B.Q3_K_M.gguf b/FineLlama-3.1-8B.Q3_K_M.gguf new file mode 100644 index 0000000..5cecaad --- /dev/null +++ b/FineLlama-3.1-8B.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a169284872502378c9cdbd7683964a621eeaaa8fa0e760fbf4817e717718ee67 +size 4018918752 diff --git a/FineLlama-3.1-8B.Q3_K_S.gguf b/FineLlama-3.1-8B.Q3_K_S.gguf new file mode 100644 index 0000000..a49d30d --- /dev/null +++ b/FineLlama-3.1-8B.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2e1ec9584c181e8363e28227b5e30233e3324880edec566e389dba996852585e +size 3664500064 diff --git a/FineLlama-3.1-8B.Q4_0.gguf b/FineLlama-3.1-8B.Q4_0.gguf new file mode 100644 index 0000000..3b426a2 --- /dev/null +++ b/FineLlama-3.1-8B.Q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d89c8a9954ce32b46125ecc870418c70155174e70dbb084e2fbedef7843ce14e +size 4661212512 diff --git a/FineLlama-3.1-8B.Q4_1.gguf b/FineLlama-3.1-8B.Q4_1.gguf new file mode 100644 index 0000000..3a4078d --- /dev/null +++ b/FineLlama-3.1-8B.Q4_1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5e31e271debbc655dc85cd06e82be332b2f2c0270bed75c03e48a512bacaab07 +size 5130253664 diff --git a/FineLlama-3.1-8B.Q4_K_M.gguf b/FineLlama-3.1-8B.Q4_K_M.gguf new file mode 100644 index 0000000..39a60db --- /dev/null +++ b/FineLlama-3.1-8B.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:99222cbb91fadfea105d04d46964472e63d683441b645599e7f077179b3d482e +size 4920735072 diff --git a/FineLlama-3.1-8B.Q4_K_S.gguf b/FineLlama-3.1-8B.Q4_K_S.gguf new file mode 100644 index 0000000..26fd908 --- /dev/null +++ b/FineLlama-3.1-8B.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ba53ce53aebb66c9d0dc59f8c7c538881c13c1a0c3bbc767296faf3fe091f526 +size 4692669792 diff --git a/FineLlama-3.1-8B.Q5_0.gguf b/FineLlama-3.1-8B.Q5_0.gguf new file mode 100644 index 0000000..eb8aa8a --- /dev/null +++ b/FineLlama-3.1-8B.Q5_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:15ef87dc6f6234f48386c536045c51e4f43410ce21e0da31545b8fa3643f0678 +size 5599294816 diff --git a/FineLlama-3.1-8B.Q5_1.gguf b/FineLlama-3.1-8B.Q5_1.gguf new file mode 100644 index 0000000..7213744 --- /dev/null +++ b/FineLlama-3.1-8B.Q5_1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ca432ea3ff8b879a8087854fc89eda4c6855f8cacaa7a8792a40b4538c525c9e +size 6068335968 diff --git a/FineLlama-3.1-8B.Q5_K_M.gguf b/FineLlama-3.1-8B.Q5_K_M.gguf new file mode 100644 index 0000000..bf87918 --- /dev/null +++ b/FineLlama-3.1-8B.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:87c25cbf8893a9b10b5bef7a3997b7a5bfdc2fdf67ef78c5882d25e8a0f30683 +size 5732988256 diff --git a/FineLlama-3.1-8B.Q5_K_S.gguf b/FineLlama-3.1-8B.Q5_K_S.gguf new file mode 100644 index 0000000..06cc269 --- /dev/null +++ b/FineLlama-3.1-8B.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3c17eadea5fbd10d08f90b5adbe14d22e3bbea553733fa85782f3322729997f4 +size 5599294816 diff --git a/FineLlama-3.1-8B.Q6_K.gguf b/FineLlama-3.1-8B.Q6_K.gguf new file mode 100644 index 0000000..dbe1928 --- /dev/null +++ b/FineLlama-3.1-8B.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1da9dcfc1ae789dfbae6c12870f362f127db68e28d95f15d4983f39f9ccb2e70 +size 6596007264 diff --git a/FineLlama-3.1-8B.Q8_0.gguf b/FineLlama-3.1-8B.Q8_0.gguf new file mode 100644 index 0000000..ab58a30 --- /dev/null +++ b/FineLlama-3.1-8B.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:02554b14bc128aff651540a1f5a502f2f6b113fe7bbfcf2020d9a12acde76b08 +size 8540771680 diff --git a/README.md b/README.md new file mode 100644 index 0000000..4d6398d --- /dev/null +++ b/README.md @@ -0,0 +1,79 @@ + +--- + +base_model: unsloth/Meta-Llama-3.1-8B-bnb-4bit +language: +- en +license: apache-2.0 +tags: +- text-generation-inference +- transformers +- unsloth +- llama +- trl +- sft +datasets: +- mlabonne/FineTome-100k + +--- + +![](https://lh7-rt.googleusercontent.com/docsz/AD_4nXeiuCm7c8lEwEJuRey9kiVZsRn2W-b4pWlu3-X534V3YmVuVc2ZL-NXg2RkzSOOS2JXGHutDuyyNAUtdJI65jGTo8jT9Y99tMi4H4MqL44Uc5QKG77B0d6-JfIkZHFaUA71-RtjyYZWVIhqsNZcx8-OMaA?key=xt3VSDoCbmTY7o-cwwOFwQ) + +# QuantFactory/FineLlama-3.1-8B-GGUF +This is quantized version of [mlabonne/FineLlama-3.1-8B](https://huggingface.co/mlabonne/FineLlama-3.1-8B) created using llama.cpp + +# Original Model Card + + +# 🍷 FineLlama-3.1-8B + +![](https://i.imgur.com/jUDo6ID.jpeg) + +This is a finetune of [meta-llama/Meta-Llama-3.1-8B](https://huggingface.co/meta-llama/Meta-Llama-3.1-8B) made for my article ["Fine-tune Llama 3.1 Ultra-Efficiently with Unsloth"](https://huggingface.co/blog/mlabonne/sft-llama3). + +It was trained on 100k super high-quality samples from the [mlabonne/FineTome-100k](https://huggingface.co/datasets/mlabonne/FineTome-100k) dataset. + +**Try the demo**: https://huggingface.co/spaces/mlabonne/FineLlama-3.1-8B + +## 🔎 Applications + +This model was made for educational purposes. I recommend using Meta's instruct model for real applications. + +## ⚡ Quantization + +* **GGUF**: https://huggingface.co/mlabonne/FineLlama-3.1-8B-GGUF + +## 🏆 Evaluation + +TBD. + +## 💻 Usage + +```python +!pip install -qU transformers accelerate + +from transformers import AutoTokenizer +import transformers +import torch + +model = "mlabonne/FineLlama-3.1-8B" +messages = [{"role": "user", "content": "What is a large language model?"}] + +tokenizer = AutoTokenizer.from_pretrained(model) +prompt = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True) +pipeline = transformers.pipeline( + "text-generation", + model=model, + torch_dtype=torch.float16, + device_map="auto", +) + +outputs = pipeline(prompt, max_new_tokens=256, do_sample=True, temperature=0.7, top_k=50, top_p=0.95) +print(outputs[0]["generated_text"]) +``` + +--- + +This llama model was trained 2x faster with [Unsloth](https://github.com/unslothai/unsloth) and Huggingface's TRL library. + +[](https://github.com/unslothai/unsloth) diff --git a/configuration.json b/configuration.json new file mode 100644 index 0000000..9e26dfe --- /dev/null +++ b/configuration.json @@ -0,0 +1 @@ +{} \ No newline at end of file