From 7bda5a05499a88173f6b6ed3ed369a3afe0b0138 Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Wed, 23 Sep 2026 18:44:14 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: cortexso/smollm2 Source: Original Platform --- .gitattributes | 47 ++++++++++++++++++++++++++++ README.md | 47 ++++++++++++++++++++++++++++ configuration.json | 1 + metadata.yml | 4 +++ model.yml | 51 +++++++++++++++++++++++++++++++ smollm2-1.7b-instruct-q2_k.gguf | 3 ++ smollm2-1.7b-instruct-q3_k_l.gguf | 3 ++ smollm2-1.7b-instruct-q3_k_m.gguf | 3 ++ smollm2-1.7b-instruct-q3_k_s.gguf | 3 ++ smollm2-1.7b-instruct-q4_k_m.gguf | 3 ++ smollm2-1.7b-instruct-q4_k_s.gguf | 3 ++ smollm2-1.7b-instruct-q5_k_m.gguf | 3 ++ smollm2-1.7b-instruct-q5_k_s.gguf | 3 ++ smollm2-1.7b-instruct-q6_k.gguf | 3 ++ smollm2-1.7b-instruct-q8_0.gguf | 3 ++ 15 files changed, 180 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 configuration.json create mode 100644 metadata.yml create mode 100644 model.yml create mode 100644 smollm2-1.7b-instruct-q2_k.gguf create mode 100644 smollm2-1.7b-instruct-q3_k_l.gguf create mode 100644 smollm2-1.7b-instruct-q3_k_m.gguf create mode 100644 smollm2-1.7b-instruct-q3_k_s.gguf create mode 100644 smollm2-1.7b-instruct-q4_k_m.gguf create mode 100644 smollm2-1.7b-instruct-q4_k_s.gguf create mode 100644 smollm2-1.7b-instruct-q5_k_m.gguf create mode 100644 smollm2-1.7b-instruct-q5_k_s.gguf create mode 100644 smollm2-1.7b-instruct-q6_k.gguf create mode 100644 smollm2-1.7b-instruct-q8_0.gguf diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..53d7257 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,47 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bin.* filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zstandard filter=lfs diff=lfs merge=lfs -text +*.tfevents* filter=lfs diff=lfs merge=lfs -text +*.db* filter=lfs diff=lfs merge=lfs -text +*.ark* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.gguf* filter=lfs diff=lfs merge=lfs -text +*.ggml filter=lfs diff=lfs merge=lfs -text +*.llamafile* filter=lfs diff=lfs merge=lfs -text +*.pt2 filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text \ No newline at end of file diff --git a/README.md b/README.md new file mode 100644 index 0000000..ef3c62f --- /dev/null +++ b/README.md @@ -0,0 +1,47 @@ +--- +license: apache-2.0 +pipeline_tag: text-generation +tags: +- cortex.cpp +--- + +## Overview + +SmolLM2 is a family of compact language models available in three sizes: 135M, 360M, and 1.7B parameters. These models are designed to solve a wide range of tasks while being lightweight enough for on-device deployment. More details can be found in the [SmolLM2 paper](https://arxiv.org/abs/2502.02737v1). + +The **1.7B variant** demonstrates significant improvements over its predecessor, SmolLM1-1.7B, especially in instruction following, knowledge retention, reasoning, and mathematical problem-solving. It was trained on **11 trillion tokens** using a diverse dataset combination, including **FineWeb-Edu, DCLM, The Stack**, and newly curated mathematics and coding datasets that will be released soon. + +The **instruct version** of SmolLM2 was developed through **supervised fine-tuning (SFT)** using a mix of public datasets and curated proprietary datasets. It further benefits from **Direct Preference Optimization (DPO)** using **UltraFeedback**. + +Additionally, the instruct model supports tasks such as **text rewriting, summarization, and function calling**, enabled by datasets from **Argilla**, including **Synth-APIGen-v0.1**. The SFT dataset is available at: [SmolTalk SFT Dataset](https://huggingface.co/datasets/HuggingFaceTB/smoltalk). + +For further details, visit the [SmolLM2 GitHub repository](https://github.com/huggingface/smollm), where you will find resources for **pre-training, post-training, evaluation, and local inference**. + +## Variants + +| No | Variant | Cortex CLI command | +| -- | ------------------------------------------------------ | ---------------------- | +| 1 | [Smollm2-1.7b](https://huggingface.co/cortexso/smollm2/tree/1.7b) | `cortex run smollm2:1.7b` | + +## Use it with Jan (UI) + +1. Install **Jan** using [Quickstart](https://jan.ai/docs/quickstart) +2. Use in Jan model Hub: + ```bash + cortexhub/smollm2 + ``` + +## Use it with Cortex (CLI) + +1. Install **Cortex** using [Quickstart](https://cortex.jan.ai/docs/quickstart) +2. Run the model with command: + ```bash + cortex run smollm2 + ``` + +## Credits + +- **Author:** SmolLM2 Team +- **Converter:** [Homebrew](https://www.homebrew.ltd/) +- **Original License:** [Apache 2.0](https://choosealicense.com/licenses/apache-2.0/) +- **Papers:** [SmolLM2 Research](https://arxiv.org/abs/2502.02737v1) \ No newline at end of file diff --git a/configuration.json b/configuration.json new file mode 100644 index 0000000..bbeeda1 --- /dev/null +++ b/configuration.json @@ -0,0 +1 @@ +{"framework": "pytorch", "task": "text-generation", "allow_remote": true} \ No newline at end of file diff --git a/metadata.yml b/metadata.yml new file mode 100644 index 0000000..6b0c591 --- /dev/null +++ b/metadata.yml @@ -0,0 +1,4 @@ +version: 1 +name: smollm2 +default: 1.7b +author: "HuggingFaceTB" diff --git a/model.yml b/model.yml new file mode 100644 index 0000000..53ddb56 --- /dev/null +++ b/model.yml @@ -0,0 +1,51 @@ +# BEGIN GENERAL GGUF METADATA +id: smollm2 +model: smollm2 +name: smollm2 +version: 1 +# END GENERAL GGUF METADATA + +# BEGIN INFERENCE PARAMETERS +# BEGIN REQUIRED +stop: +- <|im_end|> +# END REQUIRED + +# BEGIN OPTIONAL +stream: true +top_p: 0.9 +temperature: 0.7 +frequency_penalty: 0 +presence_penalty: 0 +max_tokens: 4096 +seed: -1 +dynatemp_range: 0 +dynatemp_exponent: 1 +top_k: 40 +min_p: 0.05 +tfs_z: 1 +typ_p: 1 +repeat_last_n: 64 +repeat_penalty: 1 +mirostat: false +mirostat_tau: 5 +mirostat_eta: 0.100000001 +penalize_nl: false +ignore_eos: false +n_probs: 0 +min_keep: 0 +# END OPTIONAL +# END INFERENCE PARAMETERS + +# BEGIN MODEL LOAD PARAMETERS +# BEGIN REQUIRED +engine: llama-cpp +ctx_len: 4096 +ngl: 34 +prompt_template: "<|im_start|>system +{system_message}<|im_end|> +<|im_start|>user +{prompt}<|im_end|> +<|im_start|>assistant" +# END REQUIRED +# END MODEL LOAD PARAMETERS diff --git a/smollm2-1.7b-instruct-q2_k.gguf b/smollm2-1.7b-instruct-q2_k.gguf new file mode 100644 index 0000000..c2062f0 --- /dev/null +++ b/smollm2-1.7b-instruct-q2_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:184810695208433d2cf209039e39c6a4da00d9279683a5638a7b893f9aa69962 +size 674583424 diff --git a/smollm2-1.7b-instruct-q3_k_l.gguf b/smollm2-1.7b-instruct-q3_k_l.gguf new file mode 100644 index 0000000..3ec1d8a --- /dev/null +++ b/smollm2-1.7b-instruct-q3_k_l.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1046e4b0f20abf9c6c6750bb6055d5faa9b510d453ffa1d435639ba5bb756e1a +size 932533120 diff --git a/smollm2-1.7b-instruct-q3_k_m.gguf b/smollm2-1.7b-instruct-q3_k_m.gguf new file mode 100644 index 0000000..121b0d6 --- /dev/null +++ b/smollm2-1.7b-instruct-q3_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6612e3de83185610c3c746a3f033c08f84a72fbc550a7a01eb8e180226141d83 +size 860181376 diff --git a/smollm2-1.7b-instruct-q3_k_s.gguf b/smollm2-1.7b-instruct-q3_k_s.gguf new file mode 100644 index 0000000..4f0ba60 --- /dev/null +++ b/smollm2-1.7b-instruct-q3_k_s.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:edaebd816e408489025d417c83d2174fea5b542a856afe97cfb3ce6b1ed20f75 +size 776819584 diff --git a/smollm2-1.7b-instruct-q4_k_m.gguf b/smollm2-1.7b-instruct-q4_k_m.gguf new file mode 100644 index 0000000..d308115 --- /dev/null +++ b/smollm2-1.7b-instruct-q4_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:24ebb0c8bf212c78f2c9b8ca8670b6a5d70512e04ee392136c70ecf51f9d3e5b +size 1055609728 diff --git a/smollm2-1.7b-instruct-q4_k_s.gguf b/smollm2-1.7b-instruct-q4_k_s.gguf new file mode 100644 index 0000000..9e9bb06 --- /dev/null +++ b/smollm2-1.7b-instruct-q4_k_s.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:74723704691d20a9b3d1e65d1de8618a2b4d0b035e562fa00b464ec056369414 +size 999117696 diff --git a/smollm2-1.7b-instruct-q5_k_m.gguf b/smollm2-1.7b-instruct-q5_k_m.gguf new file mode 100644 index 0000000..2184868 --- /dev/null +++ b/smollm2-1.7b-instruct-q5_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:081d9e73c502ce2592f79670607990526082e27d30c4839cb95a2350ee4023ae +size 1225479040 diff --git a/smollm2-1.7b-instruct-q5_k_s.gguf b/smollm2-1.7b-instruct-q5_k_s.gguf new file mode 100644 index 0000000..7ae654c --- /dev/null +++ b/smollm2-1.7b-instruct-q5_k_s.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:743e9721dc97fa88fc0cf01ed00e5455b78af2423a5d0131669cd10f45d7b903 +size 1192055680 diff --git a/smollm2-1.7b-instruct-q6_k.gguf b/smollm2-1.7b-instruct-q6_k.gguf new file mode 100644 index 0000000..128148f --- /dev/null +++ b/smollm2-1.7b-instruct-q6_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8bb4ed272ae362e4394727a3f22c25cac1fd4f27ffafad540337866d992b7895 +size 1405965184 diff --git a/smollm2-1.7b-instruct-q8_0.gguf b/smollm2-1.7b-instruct-q8_0.gguf new file mode 100644 index 0000000..f6f8b33 --- /dev/null +++ b/smollm2-1.7b-instruct-q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d2d6f674132f434c3c309741148e923955e65f063bc6c20ac918e95b3afcfbc2 +size 1820414848