初始化项目,由ModelHub XC社区提供模型
Model: mradermacher/dagger-4B_SFT-GGUF Source: Original Platform
This commit is contained in:
49
.gitattributes
vendored
Normal file
49
.gitattributes
vendored
Normal file
@@ -0,0 +1,49 @@
|
|||||||
|
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.model filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||||
|
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.mmproj-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.mmproj-f16.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
dagger-4B_SFT.f16.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
88
README.md
Normal file
88
README.md
Normal file
@@ -0,0 +1,88 @@
|
|||||||
|
---
|
||||||
|
base_model: dipta007/dagger-4B_SFT
|
||||||
|
datasets:
|
||||||
|
- dipta007/dagger
|
||||||
|
- dipta007/DistractMath-Bn
|
||||||
|
language:
|
||||||
|
- bn
|
||||||
|
- en
|
||||||
|
library_name: transformers
|
||||||
|
license: gemma
|
||||||
|
license_link: https://ai.google.dev/gemma/terms
|
||||||
|
mradermacher:
|
||||||
|
readme_rev: 1
|
||||||
|
quantized_by: mradermacher
|
||||||
|
tags:
|
||||||
|
- math
|
||||||
|
- reasoning
|
||||||
|
- computational-graph
|
||||||
|
- bangla
|
||||||
|
- low-resource
|
||||||
|
- distractor-aware
|
||||||
|
- sft
|
||||||
|
- small-model
|
||||||
|
---
|
||||||
|
## About
|
||||||
|
|
||||||
|
<!-- ### quantize_version: 2 -->
|
||||||
|
<!-- ### output_tensor_quantised: 1 -->
|
||||||
|
<!-- ### convert_type: hf -->
|
||||||
|
<!-- ### vocab_type: -->
|
||||||
|
<!-- ### tags: -->
|
||||||
|
<!-- ### quants: x-f16 Q4_K_S Q2_K Q8_0 Q6_K Q3_K_M Q3_K_S Q3_K_L Q4_K_M Q5_K_S Q5_K_M IQ4_XS -->
|
||||||
|
<!-- ### quants_skip: -->
|
||||||
|
<!-- ### skip_mmproj: -->
|
||||||
|
static quants of https://huggingface.co/dipta007/dagger-4B_SFT
|
||||||
|
|
||||||
|
<!-- provided-files -->
|
||||||
|
|
||||||
|
***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#dagger-4B_SFT-GGUF).***
|
||||||
|
|
||||||
|
weighted/imatrix quants seem not to be available (by me) at this time. If they do not show up a week or so after the static ones, I have probably not planned for them. Feel free to request them by opening a Community Discussion.
|
||||||
|
## Usage
|
||||||
|
|
||||||
|
If you are unsure how to use GGUF files, refer to one of [TheBloke's
|
||||||
|
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
|
||||||
|
more details, including on how to concatenate multi-part files.
|
||||||
|
|
||||||
|
## Provided Quants
|
||||||
|
|
||||||
|
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
|
||||||
|
|
||||||
|
| Link | Type | Size/GB | Notes |
|
||||||
|
|:-----|:-----|--------:|:------|
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.mmproj-Q8_0.gguf) | mmproj-Q8_0 | 0.7 | multi-modal supplement |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.mmproj-f16.gguf) | mmproj-f16 | 1.0 | multi-modal supplement |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.Q2_K.gguf) | Q2_K | 1.8 | |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.Q3_K_S.gguf) | Q3_K_S | 2.0 | |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.Q3_K_M.gguf) | Q3_K_M | 2.2 | lower quality |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.Q3_K_L.gguf) | Q3_K_L | 2.3 | |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.IQ4_XS.gguf) | IQ4_XS | 2.4 | |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.Q4_K_S.gguf) | Q4_K_S | 2.5 | fast, recommended |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.Q4_K_M.gguf) | Q4_K_M | 2.6 | fast, recommended |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.Q5_K_S.gguf) | Q5_K_S | 2.9 | |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.Q5_K_M.gguf) | Q5_K_M | 2.9 | |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.Q6_K.gguf) | Q6_K | 3.3 | very good quality |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.Q8_0.gguf) | Q8_0 | 4.2 | fast, best quality |
|
||||||
|
| [GGUF](https://huggingface.co/mradermacher/dagger-4B_SFT-GGUF/resolve/main/dagger-4B_SFT.f16.gguf) | f16 | 7.9 | 16 bpw, overkill |
|
||||||
|
|
||||||
|
Here is a handy graph by ikawrakow comparing some lower-quality quant
|
||||||
|
types (lower is better):
|
||||||
|
|
||||||
|

|
||||||
|
|
||||||
|
And here are Artefact2's thoughts on the matter:
|
||||||
|
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
|
||||||
|
|
||||||
|
## FAQ / Model Request
|
||||||
|
|
||||||
|
See https://huggingface.co/mradermacher/model_requests for some answers to
|
||||||
|
questions you might have and/or if you want some other model quantized.
|
||||||
|
|
||||||
|
## Thanks
|
||||||
|
|
||||||
|
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
|
||||||
|
me use its servers and providing upgrades to my workstation to enable
|
||||||
|
this work in my free time.
|
||||||
|
|
||||||
|
<!-- end -->
|
||||||
3
dagger-4B_SFT.IQ4_XS.gguf
Normal file
3
dagger-4B_SFT.IQ4_XS.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:62eb847830874c9316cd0f61e513be7557c1d4db9f42dd81018beecff672d4ec
|
||||||
|
size 2279627040
|
||||||
3
dagger-4B_SFT.Q2_K.gguf
Normal file
3
dagger-4B_SFT.Q2_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:37232e019e8f7de3128564ad681f9834cb2e3e972f1edb2dcdcf96e45029fbf3
|
||||||
|
size 1729165600
|
||||||
3
dagger-4B_SFT.Q3_K_L.gguf
Normal file
3
dagger-4B_SFT.Q3_K_L.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:8dc1444d03849ef92d6f4a57a8ea353dcf6e483198ea048cd2d0bb6b75a95c74
|
||||||
|
size 2236086560
|
||||||
3
dagger-4B_SFT.Q3_K_M.gguf
Normal file
3
dagger-4B_SFT.Q3_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:550c9d5b6dde671ec212c2b1ff5e8b5ad9d2de7296e7a3e1274c9d1b4e5a1d3b
|
||||||
|
size 2098460960
|
||||||
3
dagger-4B_SFT.Q3_K_S.gguf
Normal file
3
dagger-4B_SFT.Q3_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:3e90d7c16b6033d6b14fd6c4ffe879a9e27dc2c4d4a247c3d08a3bb4bf58d921
|
||||||
|
size 1937365280
|
||||||
3
dagger-4B_SFT.Q4_K_M.gguf
Normal file
3
dagger-4B_SFT.Q4_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:72d5d35d75119165e7fda0d211ea5bf6eb61a71f5e2d0f71fb69662d28bc87a5
|
||||||
|
size 2489895200
|
||||||
3
dagger-4B_SFT.Q4_K_S.gguf
Normal file
3
dagger-4B_SFT.Q4_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:3d1c74ddb095aec32a248faffed7633b86148580502f037579b5dd90c3046742
|
||||||
|
size 2377931040
|
||||||
3
dagger-4B_SFT.Q5_K_M.gguf
Normal file
3
dagger-4B_SFT.Q5_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:e00208f4d9e7f4c9e2160663432833965f2dfee040434ace67eb30a75ed622f5
|
||||||
|
size 2829699360
|
||||||
3
dagger-4B_SFT.Q5_K_S.gguf
Normal file
3
dagger-4B_SFT.Q5_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:eda82bc3df1a7d2c403c370636115663e28e538e8eae8d453702ac42fd5a733e
|
||||||
|
size 2764593440
|
||||||
3
dagger-4B_SFT.Q6_K.gguf
Normal file
3
dagger-4B_SFT.Q6_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:7ec82c92babca9fef1d3faf6dfd5917214c9c60757b22f79a048c41a7ed16beb
|
||||||
|
size 3190741280
|
||||||
3
dagger-4B_SFT.Q8_0.gguf
Normal file
3
dagger-4B_SFT.Q8_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:f513173039af044f67feaff0ef63d57b4374235086c7202b949bd022aa1fcc51
|
||||||
|
size 4130403360
|
||||||
3
dagger-4B_SFT.f16.gguf
Normal file
3
dagger-4B_SFT.f16.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:20b0250883efa7654b34266bebd12d5a8a31074f10e395b93377c1e55ab2038e
|
||||||
|
size 7767804960
|
||||||
3
dagger-4B_SFT.mmproj-Q8_0.gguf
Normal file
3
dagger-4B_SFT.mmproj-Q8_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:9ad63e90d1daa4a1b1fd0369a4addd897416fbc420fe47ec854900b77c5a8d71
|
||||||
|
size 591378464
|
||||||
3
dagger-4B_SFT.mmproj-f16.gguf
Normal file
3
dagger-4B_SFT.mmproj-f16.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:09c5204a78aa055e4eebe8e94b569241e7efb94cebf6a4a77aee8290abeea357
|
||||||
|
size 851252384
|
||||||
Reference in New Issue
Block a user