From 0d724d6d6bdc993ae84f792b224402ac182b81ba Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Sun, 19 Jul 2026 15:01:09 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: afrideva/TinyMistral-248M-GGUF Source: Original Platform --- .gitattributes | 42 ++++++++++++++++++++++++ README.md | 62 ++++++++++++++++++++++++++++++++++++ tinymistral-248m.fp16.gguf | 3 ++ tinymistral-248m.q2_k.gguf | 3 ++ tinymistral-248m.q3_k_m.gguf | 3 ++ tinymistral-248m.q4_k_m.gguf | 3 ++ tinymistral-248m.q5_k_m.gguf | 3 ++ tinymistral-248m.q6_k.gguf | 3 ++ tinymistral-248m.q8_0.gguf | 3 ++ 9 files changed, 125 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 tinymistral-248m.fp16.gguf create mode 100644 tinymistral-248m.q2_k.gguf create mode 100644 tinymistral-248m.q3_k_m.gguf create mode 100644 tinymistral-248m.q4_k_m.gguf create mode 100644 tinymistral-248m.q5_k_m.gguf create mode 100644 tinymistral-248m.q6_k.gguf create mode 100644 tinymistral-248m.q8_0.gguf diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..715e160 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,42 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +tinymistral-248m.q2_k.gguf filter=lfs diff=lfs merge=lfs -text +tinymistral-248m.q3_k_m.gguf filter=lfs diff=lfs merge=lfs -text +tinymistral-248m.q4_k_m.gguf filter=lfs diff=lfs merge=lfs -text +tinymistral-248m.q5_k_m.gguf filter=lfs diff=lfs merge=lfs -text +tinymistral-248m.q6_k.gguf filter=lfs diff=lfs merge=lfs -text +tinymistral-248m.q8_0.gguf filter=lfs diff=lfs merge=lfs -text +tinymistral-248m.fp16.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..333fe56 --- /dev/null +++ b/README.md @@ -0,0 +1,62 @@ +--- +base_model: Locutusque/TinyMistral-248M +datasets: +- Skylion007/openwebtext +- JeanKaddour/minipile +inference: false +language: +- en +license: apache-2.0 +model_creator: Locutusque +model_name: TinyMistral-248M +pipeline_tag: text-generation +quantized_by: afrideva +tags: +- gguf +- ggml +- quantized +- q2_k +- q3_k_m +- q4_k_m +- q5_k_m +- q6_k +- q8_0 +--- +# Locutusque/TinyMistral-248M-GGUF + +Quantized GGUF model files for [TinyMistral-248M](https://huggingface.co/Locutusque/TinyMistral-248M) from [Locutusque](https://huggingface.co/Locutusque) + + +| Name | Quant method | Size | +| ---- | ---- | ---- | +| [tinymistral-248m.fp16.gguf](https://huggingface.co/afrideva/TinyMistral-248M-GGUF/resolve/main/tinymistral-248m.fp16.gguf) | fp16 | 497.76 MB | +| [tinymistral-248m.q2_k.gguf](https://huggingface.co/afrideva/TinyMistral-248M-GGUF/resolve/main/tinymistral-248m.q2_k.gguf) | q2_k | 116.20 MB | +| [tinymistral-248m.q3_k_m.gguf](https://huggingface.co/afrideva/TinyMistral-248M-GGUF/resolve/main/tinymistral-248m.q3_k_m.gguf) | q3_k_m | 131.01 MB | +| [tinymistral-248m.q4_k_m.gguf](https://huggingface.co/afrideva/TinyMistral-248M-GGUF/resolve/main/tinymistral-248m.q4_k_m.gguf) | q4_k_m | 156.61 MB | +| [tinymistral-248m.q5_k_m.gguf](https://huggingface.co/afrideva/TinyMistral-248M-GGUF/resolve/main/tinymistral-248m.q5_k_m.gguf) | q5_k_m | 180.17 MB | +| [tinymistral-248m.q6_k.gguf](https://huggingface.co/afrideva/TinyMistral-248M-GGUF/resolve/main/tinymistral-248m.q6_k.gguf) | q6_k | 205.20 MB | +| [tinymistral-248m.q8_0.gguf](https://huggingface.co/afrideva/TinyMistral-248M-GGUF/resolve/main/tinymistral-248m.q8_0.gguf) | q8_0 | 265.26 MB | + + + +## Original Model Card: +A pre-trained language model, based on the Mistral 7B model, has been scaled down to approximately 248 million parameters. This model has been trained on 7,488,000 examples. This model isn't intended for direct use but for fine-tuning on a downstream task. +This model should have a context length of around 32,768 tokens. Safe serialization has been removed due to issues saving model weights. + +During evaluation on InstructMix, this model achieved an average perplexity score of 6.3. More epochs are planned for this model on different datasets. +# [Open LLM Leaderboard Evaluation Results (outdated)](https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard) +Detailed results can be found [here](https://huggingface.co/datasets/open-llm-leaderboard/details_Locutusque__TinyMistral-248m) + +| Metric | Value | +|-----------------------|---------------------------| +| Avg. | 24.18 | +| ARC (25-shot) | 20.82 | +| HellaSwag (10-shot) | 26.98 | +| MMLU (5-shot) | 23.11 | +| TruthfulQA (0-shot) | 46.89 | +| Winogrande (5-shot) | 50.75 | +| GSM8K (5-shot) | 0.0 | +| DROP (3-shot) | 0.74 | + + +The purpose of this model is to prove that trillion-scale datasets are not needed to pretrain a language model. As a result of needing small datasets, this model was pretrained on a single GPU (Titan V). \ No newline at end of file diff --git a/tinymistral-248m.fp16.gguf b/tinymistral-248m.fp16.gguf new file mode 100644 index 0000000..657a386 --- /dev/null +++ b/tinymistral-248m.fp16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:49ccd89bd76627d6ea5a7eedd0fe1ebf8fd20ef292aab7e3b5f10a9fb2ef005a +size 497759872 diff --git a/tinymistral-248m.q2_k.gguf b/tinymistral-248m.q2_k.gguf new file mode 100644 index 0000000..eab4130 --- /dev/null +++ b/tinymistral-248m.q2_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d0d7381c3bce28054eb9f631e817de78074759b41c1512d412387da9f7c746cf +size 116200896 diff --git a/tinymistral-248m.q3_k_m.gguf b/tinymistral-248m.q3_k_m.gguf new file mode 100644 index 0000000..a45476c --- /dev/null +++ b/tinymistral-248m.q3_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:65b3a7527290693734ac5a6ecf508eb33c24f9e6769b2dca2141a13578990f09 +size 131014592 diff --git a/tinymistral-248m.q4_k_m.gguf b/tinymistral-248m.q4_k_m.gguf new file mode 100644 index 0000000..dcc4190 --- /dev/null +++ b/tinymistral-248m.q4_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2926fe77127e55a8031173813085e35a9e3d29db2dc71075aeaeb01692dab342 +size 156605024 diff --git a/tinymistral-248m.q5_k_m.gguf b/tinymistral-248m.q5_k_m.gguf new file mode 100644 index 0000000..3f8f04f --- /dev/null +++ b/tinymistral-248m.q5_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7fc289d47a86eeb42ffa728c5635929c28c896214c16d2b9375a2206e031976a +size 180165856 diff --git a/tinymistral-248m.q6_k.gguf b/tinymistral-248m.q6_k.gguf new file mode 100644 index 0000000..fba4c0b --- /dev/null +++ b/tinymistral-248m.q6_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:09652bbc23d03636ab6bfbdf8d7d607641651398322f0a172397792327e9d7d8 +size 205199264 diff --git a/tinymistral-248m.q8_0.gguf b/tinymistral-248m.q8_0.gguf new file mode 100644 index 0000000..4969b28 --- /dev/null +++ b/tinymistral-248m.q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:dc363a8e84cd930b4ab25265ae147a2b9724381fc51d055fa05366565275ebd0 +size 265261344