From bc5f610da840b40364d7748a201822a8f2796853 Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Fri, 10 Jul 2026 18:28:11 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF Source: Original Platform --- .gitattributes | 47 ++++++++++++++ Qwen2.5-0.5B-Instruct-Viet-SFT.IQ4_XS.gguf | 3 + Qwen2.5-0.5B-Instruct-Viet-SFT.Q2_K.gguf | 3 + Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_L.gguf | 3 + Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_M.gguf | 3 + Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_S.gguf | 3 + Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_0_4_4.gguf | 3 + Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_M.gguf | 3 + Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_S.gguf | 3 + Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_M.gguf | 3 + Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_S.gguf | 3 + Qwen2.5-0.5B-Instruct-Viet-SFT.Q6_K.gguf | 3 + Qwen2.5-0.5B-Instruct-Viet-SFT.Q8_0.gguf | 3 + Qwen2.5-0.5B-Instruct-Viet-SFT.f16.gguf | 3 + README.md | 66 ++++++++++++++++++++ 15 files changed, 152 insertions(+) create mode 100644 .gitattributes create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.IQ4_XS.gguf create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.Q2_K.gguf create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_L.gguf create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_M.gguf create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_S.gguf create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_0_4_4.gguf create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_M.gguf create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_S.gguf create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_M.gguf create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_S.gguf create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.Q6_K.gguf create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.Q8_0.gguf create mode 100644 Qwen2.5-0.5B-Instruct-Viet-SFT.f16.gguf create mode 100644 README.md diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..cde6972 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,47 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2.5-0.5B-Instruct-Viet-SFT.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2.5-0.5B-Instruct-Viet-SFT.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2.5-0.5B-Instruct-Viet-SFT.f16.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2.5-0.5B-Instruct-Viet-SFT.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2.5-0.5B-Instruct-Viet-SFT.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_0_4_4.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.IQ4_XS.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.IQ4_XS.gguf new file mode 100644 index 0000000..2befa17 --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d9c6c1a3a5256619259b51f20ebeeacad8d8fe8482e77e59839dd735c40b60f4 +size 351445632 diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.Q2_K.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q2_K.gguf new file mode 100644 index 0000000..0596f0e --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f5da9fd1a747f350561b4e812fc8803196514f56eccb00a46437006e853cabb4 +size 338607744 diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_L.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_L.gguf new file mode 100644 index 0000000..aefb566 --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:9b8e72b2d1614529abc97942b7f569c5dd77621654d9b46495915810344c7e6e +size 369358464 diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_M.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_M.gguf new file mode 100644 index 0000000..d35bde8 --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:bbfe9224447d8cb2741ab1292d922ff2e06e40d70c75735f5f1d50819323d834 +size 355466880 diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_S.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_S.gguf new file mode 100644 index 0000000..b9304bd --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:dda2a67109b5f753097b45e7275da2f6a2434062892899dd812eb89e21bbb47b +size 338263680 diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_0_4_4.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_0_4_4.gguf new file mode 100644 index 0000000..b6d8024 --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_0_4_4.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:89fd62c1d315b644248202f752963a88e69234e149f2bf3e85db493cb8bfad6b +size 352155264 diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_M.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_M.gguf new file mode 100644 index 0000000..8e29a97 --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:51bb28ddc90af109298f85cf2028e30c51f4342ddfdccc723648bdb592f60014 +size 397808256 diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_S.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_S.gguf new file mode 100644 index 0000000..f62cd0d --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e24779b82d8e2ec72848293266d42548afeaa2da409d706efcea43ca2a61a3bd +size 385472128 diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_M.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_M.gguf new file mode 100644 index 0000000..fe0eae6 --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b143fd51dc713a2f311c4df6ba145b77f6042fc95b1e16320d340c6dafd1b64c +size 420086400 diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_S.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_S.gguf new file mode 100644 index 0000000..05381ea --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6afb2deb99564f8ba7b34500a7d64490170023c498482e3667b618563f2d954d +size 412710528 diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.Q6_K.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q6_K.gguf new file mode 100644 index 0000000..3c4b9bb --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f77407924e2b189c741aadbda1e3669e058424c82075e9fa3e2aa7a6a86b0096 +size 505736832 diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.Q8_0.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q8_0.gguf new file mode 100644 index 0000000..45e8cd7 --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1763b20fd1a25a77c5f5d631b4a1dd4b9aa4ad247f2dfecdef6565fbfd4fc16a +size 531068544 diff --git a/Qwen2.5-0.5B-Instruct-Viet-SFT.f16.gguf b/Qwen2.5-0.5B-Instruct-Viet-SFT.f16.gguf new file mode 100644 index 0000000..c52e14b --- /dev/null +++ b/Qwen2.5-0.5B-Instruct-Viet-SFT.f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2f16e9cf5603a589a0b2374b320beb6369579086f991e360604080b9f8570dea +size 994157184 diff --git a/README.md b/README.md new file mode 100644 index 0000000..1245606 --- /dev/null +++ b/README.md @@ -0,0 +1,66 @@ +--- +base_model: jaeyong2/Qwen2.5-0.5B-Instruct-Viet-SFT +language: +- vi +- en +library_name: transformers +license: apache-2.0 +quantized_by: mradermacher +--- +## About + + + + + + +static quants of https://huggingface.co/jaeyong2/Qwen2.5-0.5B-Instruct-Viet-SFT + + +weighted/imatrix quants are available at https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-i1-GGUF +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_S.gguf) | Q3_K_S | 0.4 | | +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.Q2_K.gguf) | Q2_K | 0.4 | | +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.IQ4_XS.gguf) | IQ4_XS | 0.5 | | +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_0_4_4.gguf) | Q4_0_4_4 | 0.5 | fast on arm, low quality | +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_M.gguf) | Q3_K_M | 0.5 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.Q3_K_L.gguf) | Q3_K_L | 0.5 | | +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_S.gguf) | Q4_K_S | 0.5 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.Q4_K_M.gguf) | Q4_K_M | 0.5 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_S.gguf) | Q5_K_S | 0.5 | | +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.Q5_K_M.gguf) | Q5_K_M | 0.5 | | +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.Q6_K.gguf) | Q6_K | 0.6 | very good quality | +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.Q8_0.gguf) | Q8_0 | 0.6 | fast, best quality | +| [GGUF](https://huggingface.co/mradermacher/Qwen2.5-0.5B-Instruct-Viet-SFT-GGUF/resolve/main/Qwen2.5-0.5B-Instruct-Viet-SFT.f16.gguf) | f16 | 1.1 | 16 bpw, overkill | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. + +