初始化项目,由ModelHub XC社区提供模型

Model: mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-07-11 05:02:09 +08:00
commit 617ff23cc8
27 changed files with 224 additions and 0 deletions

59
.gitattributes vendored Normal file
View File

@@ -0,0 +1,59 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.imatrix.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-IQ4_NL.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text
ThaiLLM-8B-SFT-IQ.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text

90
README.md Normal file
View File

@@ -0,0 +1,90 @@
---
base_model: ThaiLLM/ThaiLLM-8B-SFT-IQ
language:
- th
library_name: transformers
mradermacher:
readme_rev: 1
quantized_by: mradermacher
tags:
- medical
- rag
- citation
- question-answering
- thai
---
## About
<!-- ### quantize_version: 2 -->
<!-- ### output_tensor_quantised: 1 -->
<!-- ### convert_type: hf -->
<!-- ### vocab_type: -->
<!-- ### tags: nicoboss -->
<!-- ### quants: Q2_K IQ3_M Q4_K_S IQ3_XXS Q3_K_M small-IQ4_NL Q4_K_M IQ2_M Q6_K IQ4_XS Q2_K_S IQ1_M Q3_K_S IQ2_XXS Q3_K_L IQ2_XS Q5_K_S IQ2_S IQ1_S Q5_K_M Q4_0 IQ3_XS Q4_1 IQ3_S -->
<!-- ### quants_skip: -->
<!-- ### skip_mmproj: -->
weighted/imatrix quants of https://huggingface.co/ThaiLLM/ThaiLLM-8B-SFT-IQ
<!-- provided-files -->
***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#ThaiLLM-8B-SFT-IQ-i1-GGUF).***
static quants are available at https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-GGUF
## Usage
If you are unsure how to use GGUF files, refer to one of [TheBloke's
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
more details, including on how to concatenate multi-part files.
## Provided Quants
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
| Link | Type | Size/GB | Notes |
|:-----|:-----|--------:|:------|
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.imatrix.gguf) | imatrix | 0.1 | imatrix file (for creating your own quants) |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-IQ1_S.gguf) | i1-IQ1_S | 2.2 | for the desperate |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-IQ1_M.gguf) | i1-IQ1_M | 2.4 | mostly desperate |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 2.6 | |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-IQ2_XS.gguf) | i1-IQ2_XS | 2.8 | |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-IQ2_S.gguf) | i1-IQ2_S | 3.0 | |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-IQ2_M.gguf) | i1-IQ2_M | 3.2 | |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-Q2_K_S.gguf) | i1-Q2_K_S | 3.2 | very low quality |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-Q2_K.gguf) | i1-Q2_K | 3.4 | IQ3_XXS probably better |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 3.5 | lower quality |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-IQ3_XS.gguf) | i1-IQ3_XS | 3.7 | |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-Q3_K_S.gguf) | i1-Q3_K_S | 3.9 | IQ3_XS probably better |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-IQ3_S.gguf) | i1-IQ3_S | 3.9 | beats Q3_K* |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-IQ3_M.gguf) | i1-IQ3_M | 4.0 | |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-Q3_K_M.gguf) | i1-Q3_K_M | 4.2 | IQ3_S probably better |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-Q3_K_L.gguf) | i1-Q3_K_L | 4.5 | IQ3_M probably better |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-IQ4_XS.gguf) | i1-IQ4_XS | 4.7 | |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-Q4_0.gguf) | i1-Q4_0 | 4.9 | fast, low quality |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-IQ4_NL.gguf) | i1-IQ4_NL | 4.9 | prefer IQ4_XS |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-Q4_K_S.gguf) | i1-Q4_K_S | 4.9 | optimal size/speed/quality |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-Q4_K_M.gguf) | i1-Q4_K_M | 5.1 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-Q4_1.gguf) | i1-Q4_1 | 5.3 | |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-Q5_K_S.gguf) | i1-Q5_K_S | 5.8 | |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-Q5_K_M.gguf) | i1-Q5_K_M | 6.0 | |
| [GGUF](https://huggingface.co/mradermacher/ThaiLLM-8B-SFT-IQ-i1-GGUF/resolve/main/ThaiLLM-8B-SFT-IQ.i1-Q6_K.gguf) | i1-Q6_K | 6.8 | practically like static Q6_K |
Here is a handy graph by ikawrakow comparing some lower-quality quant
types (lower is better):
![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png)
And here are Artefact2's thoughts on the matter:
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
## FAQ / Model Request
See https://huggingface.co/mradermacher/model_requests for some answers to
questions you might have and/or if you want some other model quantized.
## Thanks
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
me use its servers and providing upgrades to my workstation to enable
this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to.
<!-- end -->

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:2b4a897722a42db15d8a8aa0ceddf5544297864628d8fc3a22d64dcfbb4133b7
size 2256148224

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:57a2fe62febbb6333b810f82c03fff45f064aff21923da9326dbe260022be3d7
size 2115770112

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:46d0460d5e67aabf47525886223f5b7f59a4fbb5599465b77178ece664b2fc0c
size 3051915008

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:3c675e93db1ab1794218f464c0c40adc90a97339259ba076be1c6910316fb697
size 2864744192

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4b4c11a1b8dffdf7bec580b2e27e40aba271bc16a33c480b8cb9a242b9b444fd
size 2696156928

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:dd4b5974b895a63a1368a8f4635292a83ae3b10f02b396e2d453e46985fb6564
size 2490111744

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1018df16a13d5893e6f4c755edf134caa27ba60cecd3ff7e074258888c0c84e2
size 3896620800

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:492ad890c01454cbe6fdbbc05023996afb03afe2c31818aff2295dda7bb3ebed
size 3789666048

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c0951eca00f98512335772bdd3fd62bf4a9ed9030a0c1b977537452b50706240
size 3626874624

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7eabe218f7b3437b1bb92757f48ec834b72de9ce9d51991ae862e107519938da
size 3369633536

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:3b612993ff3355152c5aca6759e91247ca4a9b59005261d6f4aa523e11b74295
size 4793624320

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:27b568770db4c2ade94c1e80db033373da656224c47f531affbda30b92d07fa5
size 4561839872

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:03a376303d4aa3503c9add5e5c15d18dce9414c238950007c79959da9879c114
size 3281733376

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d2c6c7932b021a54087703418b9853c42e3ffbe65e4041205892228634395f92
size 3083552512

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a8b6eaa3128c7a0210d2fd79a3186cde745e26c3870e9fe8c29ff46e5bcee50c
size 4431394560

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8fa70c481f5792268e136d5a4c9f298c52d2f6afc94807cc3c565f7740beeb26
size 4124161792

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:5d579ccf0eb0398b84cef56630dc6b5fa34d1bd92e29062b73ee4a5a678275a2
size 3769612032

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:efdc1130a19b5125e393cb7292845c5a647a252006e95615fe5ffe03ce9f9f44
size 4787332864

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:73daa507ca88caa95e515f68f03e82920cb85a8b5b63bf4bd8490d8e7b9900b9
size 5247756032

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6f752e26c8bf5f98466ae119a9865370121f0d72f96fdd0992a3acdac9bd2211
size 5027784448

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:3aca33737a7ea42a5b48c81351c9b7a65bc8010329a353db530be83c1e6830aa
size 4802012928

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7646820d0931de9a977073ccc0ba201a8d1ac3a1b4514822c839832f9c57c7ed
size 5851113216

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:12aad86bcb7b4d3906e7b53f8576e2c80772acdfa10c61182ce38657ad58dbe6
size 5720762112

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4a770082e459804991c9a986620754b8d0c0cb8f66135bc9e51d7b574897f744
size 6725900032

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7d30af2c466d39e92091f9e4b279d7b1755f6ac48a14430d8211acb6937c3d03
size 5347200