初始化项目,由ModelHub XC社区提供模型
Model: cortexso/smollm2 Source: Original Platform
This commit is contained in:
47
.gitattributes
vendored
Normal file
47
.gitattributes
vendored
Normal file
@@ -0,0 +1,47 @@
|
|||||||
|
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bin.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.model filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||||
|
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zstandard filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.db* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ark* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text
|
||||||
|
**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.gguf* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ggml filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.llamafile* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pt2 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||||
47
README.md
Normal file
47
README.md
Normal file
@@ -0,0 +1,47 @@
|
|||||||
|
---
|
||||||
|
license: apache-2.0
|
||||||
|
pipeline_tag: text-generation
|
||||||
|
tags:
|
||||||
|
- cortex.cpp
|
||||||
|
---
|
||||||
|
|
||||||
|
## Overview
|
||||||
|
|
||||||
|
SmolLM2 is a family of compact language models available in three sizes: 135M, 360M, and 1.7B parameters. These models are designed to solve a wide range of tasks while being lightweight enough for on-device deployment. More details can be found in the [SmolLM2 paper](https://arxiv.org/abs/2502.02737v1).
|
||||||
|
|
||||||
|
The **1.7B variant** demonstrates significant improvements over its predecessor, SmolLM1-1.7B, especially in instruction following, knowledge retention, reasoning, and mathematical problem-solving. It was trained on **11 trillion tokens** using a diverse dataset combination, including **FineWeb-Edu, DCLM, The Stack**, and newly curated mathematics and coding datasets that will be released soon.
|
||||||
|
|
||||||
|
The **instruct version** of SmolLM2 was developed through **supervised fine-tuning (SFT)** using a mix of public datasets and curated proprietary datasets. It further benefits from **Direct Preference Optimization (DPO)** using **UltraFeedback**.
|
||||||
|
|
||||||
|
Additionally, the instruct model supports tasks such as **text rewriting, summarization, and function calling**, enabled by datasets from **Argilla**, including **Synth-APIGen-v0.1**. The SFT dataset is available at: [SmolTalk SFT Dataset](https://huggingface.co/datasets/HuggingFaceTB/smoltalk).
|
||||||
|
|
||||||
|
For further details, visit the [SmolLM2 GitHub repository](https://github.com/huggingface/smollm), where you will find resources for **pre-training, post-training, evaluation, and local inference**.
|
||||||
|
|
||||||
|
## Variants
|
||||||
|
|
||||||
|
| No | Variant | Cortex CLI command |
|
||||||
|
| -- | ------------------------------------------------------ | ---------------------- |
|
||||||
|
| 1 | [Smollm2-1.7b](https://huggingface.co/cortexso/smollm2/tree/1.7b) | `cortex run smollm2:1.7b` |
|
||||||
|
|
||||||
|
## Use it with Jan (UI)
|
||||||
|
|
||||||
|
1. Install **Jan** using [Quickstart](https://jan.ai/docs/quickstart)
|
||||||
|
2. Use in Jan model Hub:
|
||||||
|
```bash
|
||||||
|
cortexhub/smollm2
|
||||||
|
```
|
||||||
|
|
||||||
|
## Use it with Cortex (CLI)
|
||||||
|
|
||||||
|
1. Install **Cortex** using [Quickstart](https://cortex.jan.ai/docs/quickstart)
|
||||||
|
2. Run the model with command:
|
||||||
|
```bash
|
||||||
|
cortex run smollm2
|
||||||
|
```
|
||||||
|
|
||||||
|
## Credits
|
||||||
|
|
||||||
|
- **Author:** SmolLM2 Team
|
||||||
|
- **Converter:** [Homebrew](https://www.homebrew.ltd/)
|
||||||
|
- **Original License:** [Apache 2.0](https://choosealicense.com/licenses/apache-2.0/)
|
||||||
|
- **Papers:** [SmolLM2 Research](https://arxiv.org/abs/2502.02737v1)
|
||||||
1
configuration.json
Normal file
1
configuration.json
Normal file
@@ -0,0 +1 @@
|
|||||||
|
{"framework": "pytorch", "task": "text-generation", "allow_remote": true}
|
||||||
4
metadata.yml
Normal file
4
metadata.yml
Normal file
@@ -0,0 +1,4 @@
|
|||||||
|
version: 1
|
||||||
|
name: smollm2
|
||||||
|
default: 1.7b
|
||||||
|
author: "HuggingFaceTB"
|
||||||
51
model.yml
Normal file
51
model.yml
Normal file
@@ -0,0 +1,51 @@
|
|||||||
|
# BEGIN GENERAL GGUF METADATA
|
||||||
|
id: smollm2
|
||||||
|
model: smollm2
|
||||||
|
name: smollm2
|
||||||
|
version: 1
|
||||||
|
# END GENERAL GGUF METADATA
|
||||||
|
|
||||||
|
# BEGIN INFERENCE PARAMETERS
|
||||||
|
# BEGIN REQUIRED
|
||||||
|
stop:
|
||||||
|
- <|im_end|>
|
||||||
|
# END REQUIRED
|
||||||
|
|
||||||
|
# BEGIN OPTIONAL
|
||||||
|
stream: true
|
||||||
|
top_p: 0.9
|
||||||
|
temperature: 0.7
|
||||||
|
frequency_penalty: 0
|
||||||
|
presence_penalty: 0
|
||||||
|
max_tokens: 4096
|
||||||
|
seed: -1
|
||||||
|
dynatemp_range: 0
|
||||||
|
dynatemp_exponent: 1
|
||||||
|
top_k: 40
|
||||||
|
min_p: 0.05
|
||||||
|
tfs_z: 1
|
||||||
|
typ_p: 1
|
||||||
|
repeat_last_n: 64
|
||||||
|
repeat_penalty: 1
|
||||||
|
mirostat: false
|
||||||
|
mirostat_tau: 5
|
||||||
|
mirostat_eta: 0.100000001
|
||||||
|
penalize_nl: false
|
||||||
|
ignore_eos: false
|
||||||
|
n_probs: 0
|
||||||
|
min_keep: 0
|
||||||
|
# END OPTIONAL
|
||||||
|
# END INFERENCE PARAMETERS
|
||||||
|
|
||||||
|
# BEGIN MODEL LOAD PARAMETERS
|
||||||
|
# BEGIN REQUIRED
|
||||||
|
engine: llama-cpp
|
||||||
|
ctx_len: 4096
|
||||||
|
ngl: 34
|
||||||
|
prompt_template: "<|im_start|>system
|
||||||
|
{system_message}<|im_end|>
|
||||||
|
<|im_start|>user
|
||||||
|
{prompt}<|im_end|>
|
||||||
|
<|im_start|>assistant"
|
||||||
|
# END REQUIRED
|
||||||
|
# END MODEL LOAD PARAMETERS
|
||||||
3
smollm2-1.7b-instruct-q2_k.gguf
Normal file
3
smollm2-1.7b-instruct-q2_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:184810695208433d2cf209039e39c6a4da00d9279683a5638a7b893f9aa69962
|
||||||
|
size 674583424
|
||||||
3
smollm2-1.7b-instruct-q3_k_l.gguf
Normal file
3
smollm2-1.7b-instruct-q3_k_l.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:1046e4b0f20abf9c6c6750bb6055d5faa9b510d453ffa1d435639ba5bb756e1a
|
||||||
|
size 932533120
|
||||||
3
smollm2-1.7b-instruct-q3_k_m.gguf
Normal file
3
smollm2-1.7b-instruct-q3_k_m.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:6612e3de83185610c3c746a3f033c08f84a72fbc550a7a01eb8e180226141d83
|
||||||
|
size 860181376
|
||||||
3
smollm2-1.7b-instruct-q3_k_s.gguf
Normal file
3
smollm2-1.7b-instruct-q3_k_s.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:edaebd816e408489025d417c83d2174fea5b542a856afe97cfb3ce6b1ed20f75
|
||||||
|
size 776819584
|
||||||
3
smollm2-1.7b-instruct-q4_k_m.gguf
Normal file
3
smollm2-1.7b-instruct-q4_k_m.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:24ebb0c8bf212c78f2c9b8ca8670b6a5d70512e04ee392136c70ecf51f9d3e5b
|
||||||
|
size 1055609728
|
||||||
3
smollm2-1.7b-instruct-q4_k_s.gguf
Normal file
3
smollm2-1.7b-instruct-q4_k_s.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:74723704691d20a9b3d1e65d1de8618a2b4d0b035e562fa00b464ec056369414
|
||||||
|
size 999117696
|
||||||
3
smollm2-1.7b-instruct-q5_k_m.gguf
Normal file
3
smollm2-1.7b-instruct-q5_k_m.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:081d9e73c502ce2592f79670607990526082e27d30c4839cb95a2350ee4023ae
|
||||||
|
size 1225479040
|
||||||
3
smollm2-1.7b-instruct-q5_k_s.gguf
Normal file
3
smollm2-1.7b-instruct-q5_k_s.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:743e9721dc97fa88fc0cf01ed00e5455b78af2423a5d0131669cd10f45d7b903
|
||||||
|
size 1192055680
|
||||||
3
smollm2-1.7b-instruct-q6_k.gguf
Normal file
3
smollm2-1.7b-instruct-q6_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:8bb4ed272ae362e4394727a3f22c25cac1fd4f27ffafad540337866d992b7895
|
||||||
|
size 1405965184
|
||||||
3
smollm2-1.7b-instruct-q8_0.gguf
Normal file
3
smollm2-1.7b-instruct-q8_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:d2d6f674132f434c3c309741148e923955e65f063bc6c20ac918e95b3afcfbc2
|
||||||
|
size 1820414848
|
||||||
Reference in New Issue
Block a user