初始化项目,由ModelHub XC社区提供模型

Model: mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-06-04 05:20:15 +08:00
commit dbb1eb9cfa
27 changed files with 227 additions and 0 deletions

60
.gitattributes vendored Normal file
View File

@@ -0,0 +1,60 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.imatrix.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-IQ4_NL.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text
SinLlama-Llama-3-8B-Merged.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text

92
README.md Normal file
View File

@@ -0,0 +1,92 @@
---
base_model: SAWithanage/SinLlama-Llama-3-8B-Merged
language:
- si
- en
library_name: transformers
license: llama3
mradermacher:
readme_rev: 1
quantized_by: mradermacher
tags:
- llama-3
- sinhala
- nlp
- text-generation
- merged
---
## About
<!-- ### quantize_version: 2 -->
<!-- ### output_tensor_quantised: 1 -->
<!-- ### convert_type: hf -->
<!-- ### vocab_type: -->
<!-- ### tags: nicoboss -->
<!-- ### quants: Q2_K IQ3_M Q4_K_S IQ3_XXS Q3_K_M small-IQ4_NL Q4_K_M IQ2_M Q6_K IQ4_XS Q2_K_S IQ1_M Q3_K_S IQ2_XXS Q3_K_L IQ2_XS Q5_K_S IQ2_S IQ1_S Q5_K_M Q4_0 IQ3_XS Q4_1 IQ3_S -->
<!-- ### quants_skip: -->
<!-- ### skip_mmproj: -->
weighted/imatrix quants of https://huggingface.co/SAWithanage/SinLlama-Llama-3-8B-Merged
<!-- provided-files -->
***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#SinLlama-Llama-3-8B-Merged-i1-GGUF).***
static quants are available at https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-GGUF
## Usage
If you are unsure how to use GGUF files, refer to one of [TheBloke's
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
more details, including on how to concatenate multi-part files.
## Provided Quants
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
| Link | Type | Size/GB | Notes |
|:-----|:-----|--------:|:------|
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.imatrix.gguf) | imatrix | 0.1 | imatrix file (for creating your own quants) |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-IQ1_S.gguf) | i1-IQ1_S | 2.2 | for the desperate |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-IQ1_M.gguf) | i1-IQ1_M | 2.3 | mostly desperate |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 2.5 | |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-IQ2_XS.gguf) | i1-IQ2_XS | 2.8 | |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-IQ2_S.gguf) | i1-IQ2_S | 2.9 | |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-IQ2_M.gguf) | i1-IQ2_M | 3.1 | |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-Q2_K_S.gguf) | i1-Q2_K_S | 3.1 | very low quality |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-Q2_K.gguf) | i1-Q2_K | 3.3 | IQ3_XXS probably better |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 3.4 | lower quality |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-IQ3_XS.gguf) | i1-IQ3_XS | 3.7 | |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-Q3_K_S.gguf) | i1-Q3_K_S | 3.8 | IQ3_XS probably better |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-IQ3_S.gguf) | i1-IQ3_S | 3.8 | beats Q3_K* |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-IQ3_M.gguf) | i1-IQ3_M | 3.9 | |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-Q3_K_M.gguf) | i1-Q3_K_M | 4.2 | IQ3_S probably better |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-Q3_K_L.gguf) | i1-Q3_K_L | 4.5 | IQ3_M probably better |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-IQ4_XS.gguf) | i1-IQ4_XS | 4.6 | |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-Q4_0.gguf) | i1-Q4_0 | 4.8 | fast, low quality |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-IQ4_NL.gguf) | i1-IQ4_NL | 4.8 | prefer IQ4_XS |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-Q4_K_S.gguf) | i1-Q4_K_S | 4.9 | optimal size/speed/quality |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-Q4_K_M.gguf) | i1-Q4_K_M | 5.1 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-Q4_1.gguf) | i1-Q4_1 | 5.3 | |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-Q5_K_S.gguf) | i1-Q5_K_S | 5.8 | |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-Q5_K_M.gguf) | i1-Q5_K_M | 5.9 | |
| [GGUF](https://huggingface.co/mradermacher/SinLlama-Llama-3-8B-Merged-i1-GGUF/resolve/main/SinLlama-Llama-3-8B-Merged.i1-Q6_K.gguf) | i1-Q6_K | 6.8 | practically like static Q6_K |
Here is a handy graph by ikawrakow comparing some lower-quality quant
types (lower is better):
![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png)
And here are Artefact2's thoughts on the matter:
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
## FAQ / Model Request
See https://huggingface.co/mradermacher/model_requests for some answers to
questions you might have and/or if you want some other model quantized.
## Thanks
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
me use its servers and providing upgrades to my workstation to enable
this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to.
<!-- end -->

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9e1f99ed49df09e7ff132b200630d1a7772df185e8424e1adeb3f5eaad2ece95
size 2208365440

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9ba32fb9c6736fc071f79ed2b100b683f6790bc56fded314f983752b2eb6f0c0
size 2066021248

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f3f5c0b26faf5aecf35d4f6789c15abfe513bd5f28afb454eb13fcd04d787917
size 2999283840

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:278f080916916f6e7bc93ff331bbcd4e9755742563e0e25fb457eac8787c7d46
size 2809491584

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:923bd7fe6a2678ccaf1fbb9019f4d2460bdb12ca9e7718d1bc7a6851dcc45c86
size 2652175232

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:361bb7fb6566b987963c650ab9182e66b95f5f015761f86292edace91dd7c028
size 2445605760

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d8f32bab2ecead0af1fa4ef5a53d4280b99f83d599c939e464e53ab3fb6b7e48
size 3841853824

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4328e64fb9341c1efc14596f4ca8cf3504781778f7b63e390014d7f2bddd08d5
size 3739355520

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:68bab869d27701e666d689d83a8f9caf19ef3d52370bed9ede4df551d51df446
size 3575777664

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:774bf89037e5a18a248816b882f9c7631d9051dcd057e1110940c23727ab5f9c
size 3325915264

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a32c4e8982c6b7e4a84a0ada15a3000013c7b5f0ca2399331579abb89f865d95
size 4741046912

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:43cf2262e79e38553f85250046e834f07f60ff805d8583502f01b49b88085182
size 4509302400

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e951d38014433865225da7bc2e322f2d4424a134462ad545887ee5eaf4f0f8f7
size 3231552640

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9e30ad16a0e6789ee4696628123d03af4c20ed41833e069fc61f15d05ca4d1c8
size 3041236096

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:5a6ee399743f49b4d062e5babb70ad3620f5027bf52e930247cf448f51ce6130
size 4378986880

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4769fc0e8a0aa22b2ab1438042308c6ebac5687fd2d4f302a73a00fd531c6cc3
size 4075948416

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f4e619ad968bc5c959b18b86f0957323edb19c4e6ad34b8d7ed92baaec68aa71
size 3721529728

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6babb23f1325236217c4aacdcc5cfb92c3205ad84b9665b67fe75362df30c0c4
size 4738949760

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9eaaa960e9de7cccd6a4ae96561cfd26a8ff41d0f50cd3d7c01a0c78ee5efe1c
size 5196147328

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9d26bcdced9b40c2bf2cd5ccabb435169f439bba421b0d4ed48f41a0e4f0142f
size 4983792256

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9559c14c7f7894e68c8fd563880667d84bf14ec940f6bcb133e1268021396a47
size 4755726976

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7e1f9064cf82c07376a859cec6973ceadc831902791fd27ce1f604b3a9043355
size 5801718400

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:cccf48f76da3cf9facf3fed4ccf658a55b2f0844d5034432cde0e6a67c9b87c5
size 5668024960

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9c7076c0c0c64ce8d3c7aeeda89c3d1f887dbf857f4a6e0ccc3e636352e5fae4
size 6670764928

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:2baf576ed6a8f2bd8886ec909bcb53012a50385d86f795c0eddf99ce5df9d8e7
size 5015200