初始化项目,由ModelHub XC社区提供模型
Model: usermma/Quark-270m-Instruct-GGUF Source: Original Platform
This commit is contained in:
50
.gitattributes
vendored
Normal file
50
.gitattributes
vendored
Normal file
@@ -0,0 +1,50 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-q2_k.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-q3_k_s.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-q3_k_m.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-q3_k_l.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-q4_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-q4_k_s.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-q4_k_m.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-q5_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-q5_k_s.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-q5_k_m.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-q6_k.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-q8_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-f16.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-f32.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
quark-270m-instruct-bf16.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
67
README.md
Normal file
67
README.md
Normal file
@@ -0,0 +1,67 @@
|
||||
---
|
||||
language:
|
||||
- it
|
||||
- en
|
||||
license: apache-2.0
|
||||
tags:
|
||||
- text-generation
|
||||
- causal-lm
|
||||
- bilingual
|
||||
- italian
|
||||
- english
|
||||
- small-language-model
|
||||
- trained-from-scratch
|
||||
- quark
|
||||
- instruct
|
||||
- sft
|
||||
- chat
|
||||
- llama-cpp
|
||||
- gguf-my-repo
|
||||
library_name: transformers
|
||||
pipeline_tag: text-generation
|
||||
base_model: ThingAI/Quark-270m-Instruct
|
||||
---
|
||||
|
||||
# usermma/Quark-270m-Instruct-GGUF
|
||||
This model was converted to GGUF format from [`ThingAI/Quark-270m-Instruct`](https://huggingface.co/ThingAI/Quark-270m-Instruct) using llama.cpp.
|
||||
Refer to the [original model card](https://huggingface.co/ThingAI/Quark-270m-Instruct) for more details on the model.
|
||||
|
||||
## Use with llama.cpp
|
||||
Install llama.cpp through brew (works on Mac and Linux)
|
||||
|
||||
```bash
|
||||
brew install llama.cpp
|
||||
|
||||
```
|
||||
Invoke the llama.cpp server or the CLI.
|
||||
|
||||
### CLI:
|
||||
```bash
|
||||
llama-cli --hf-repo usermma/Quark-270m-Instruct-GGUF --hf-file quark-270m-instruct-q2_k.gguf -p "The meaning to life and the universe is"
|
||||
```
|
||||
|
||||
### Server:
|
||||
```bash
|
||||
llama-server --hf-repo usermma/Quark-270m-Instruct-GGUF --hf-file quark-270m-instruct-q2_k.gguf -c 2048
|
||||
```
|
||||
|
||||
Note: You can also use this checkpoint directly through the [usage steps](https://github.com/ggerganov/llama.cpp?tab=readme-ov-file#usage) listed in the Llama.cpp repo as well.
|
||||
|
||||
Step 1: Clone llama.cpp from GitHub.
|
||||
```
|
||||
git clone https://github.com/ggerganov/llama.cpp
|
||||
```
|
||||
|
||||
Step 2: Move into the llama.cpp folder and build it with `LLAMA_CURL=1` flag along with other hardware-specific flags (for ex: LLAMA_CUDA=1 for Nvidia GPUs on Linux).
|
||||
```
|
||||
cd llama.cpp && LLAMA_CURL=1 make
|
||||
```
|
||||
|
||||
Step 3: Run inference through the main binary.
|
||||
```
|
||||
./llama-cli --hf-repo usermma/Quark-270m-Instruct-GGUF --hf-file quark-270m-instruct-q2_k.gguf -p "The meaning to life and the universe is"
|
||||
```
|
||||
or
|
||||
```
|
||||
./llama-server --hf-repo usermma/Quark-270m-Instruct-GGUF --hf-file quark-270m-instruct-q2_k.gguf -c 2048
|
||||
```
|
||||
3
quark-270m-instruct-bf16.gguf
Normal file
3
quark-270m-instruct-bf16.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:01abdef496b4fc941eac5a5e230113e5a45abb6f23be14f78976f10c9cee79fa
|
||||
size 506075968
|
||||
3
quark-270m-instruct-f16.gguf
Normal file
3
quark-270m-instruct-f16.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:9c6082dea6f2cfae6868d6f884bd2bf4032e9f675d2c07115b62c56e0bceb4d4
|
||||
size 506075968
|
||||
3
quark-270m-instruct-f32.gguf
Normal file
3
quark-270m-instruct-f32.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:5bf87f68ffad9a4c5b00134fb248077fbdbe2104be25ba7488737b4ccb0ffb60
|
||||
size 1009393984
|
||||
3
quark-270m-instruct-q2_k.gguf
Normal file
3
quark-270m-instruct-q2_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:16278e3992fcc12c9a334be36d1bf73e960674ecb60309b1900f15b1a627faa9
|
||||
size 117774272
|
||||
3
quark-270m-instruct-q3_k_l.gguf
Normal file
3
quark-270m-instruct-q3_k_l.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:3acab2f22007cf3a018ca379c8144a0ae3076fa2e928c67dc834daf658732676
|
||||
size 150017984
|
||||
3
quark-270m-instruct-q3_k_m.gguf
Normal file
3
quark-270m-instruct-q3_k_m.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:504d9e53d1174e5c3b6ca81bb772c959410718c8751ed18f665add8557417c6a
|
||||
size 141023168
|
||||
3
quark-270m-instruct-q3_k_s.gguf
Normal file
3
quark-270m-instruct-q3_k_s.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:7b1c9f842e00764d77e4c657791ba8843edc558ead8c209c879a978a71afc599
|
||||
size 130553792
|
||||
3
quark-270m-instruct-q4_0.gguf
Normal file
3
quark-270m-instruct-q4_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:a512f14010ebe8bdab3647f97947703c8da67c855aa91735389d4909fc4ec695
|
||||
size 157292480
|
||||
3
quark-270m-instruct-q4_k_m.gguf
Normal file
3
quark-270m-instruct-q4_k_m.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:3637a5ca7d7b0712d12b4fc3a8b73a401568d20a2c33df5d2283a3dcfe2cdd3b
|
||||
size 164591552
|
||||
3
quark-270m-instruct-q4_k_s.gguf
Normal file
3
quark-270m-instruct-q4_k_s.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:f0916f865e03969b1929ed6878e8c31ad89f85d9749e68271eaf32489bb7e729
|
||||
size 158177216
|
||||
3
quark-270m-instruct-q5_0.gguf
Normal file
3
quark-270m-instruct-q5_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:d8a4bdbeed59f7546ef006fee403ade4cc5f74e4187dd5c018e303c178681620
|
||||
size 182458304
|
||||
3
quark-270m-instruct-q5_k_m.gguf
Normal file
3
quark-270m-instruct-q5_k_m.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:f779593b2783fff003d00a0ab5e6ba5b68dec9529299d8770bd4dc1fa1d5e63a
|
||||
size 186218432
|
||||
3
quark-270m-instruct-q5_k_s.gguf
Normal file
3
quark-270m-instruct-q5_k_s.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:2d844303079705050ac3a256e0d47c1a1bcde0863e52a738bf978129106101af
|
||||
size 182458304
|
||||
3
quark-270m-instruct-q6_k.gguf
Normal file
3
quark-270m-instruct-q6_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:12aaf1332c56daf391f9907886a576918745aa650bd51a0c26508f76a2723b0f
|
||||
size 209196992
|
||||
3
quark-270m-instruct-q8_0.gguf
Normal file
3
quark-270m-instruct-q8_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:a57d537fd321bfe3533432e786f60b03f97ecd4bafb85e31465c368c5eb1eb8e
|
||||
size 270145664
|
||||
Reference in New Issue
Block a user