初始化项目,由ModelHub XC社区提供模型
Model: Alcoft/Qwen_Qwen3-0.6B-GGUF Source: Original Platform
This commit is contained in:
58
.gitattributes
vendored
Normal file
58
.gitattributes
vendored
Normal file
@@ -0,0 +1,58 @@
|
|||||||
|
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.model filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||||
|
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_F16.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q2_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q2_K_XL.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q3_K_XL.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q3_K_XXL.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q4_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q4_K_XL.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q5_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q5_K_XL.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q6_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q6_K_XL.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
Qwen_Qwen3-0.6B_Q8_K_XL.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
3
Qwen_Qwen3-0.6B.gguf
Normal file
3
Qwen_Qwen3-0.6B.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:2fd1c164759a35634bb7b3be2bdfd85fd1c119405ae7ea853b9c575ddb4de52e
|
||||||
|
size 1509347488
|
||||||
3
Qwen_Qwen3-0.6B_F16.gguf
Normal file
3
Qwen_Qwen3-0.6B_F16.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:b67d81fccfdb4ec2a8aacabd9600630f59faf66893bf83e1c75e2ceef9d34b6d
|
||||||
|
size 1509347488
|
||||||
3
Qwen_Qwen3-0.6B_Q2_K.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q2_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:8517b7381751311aeb77f6f814ce6c1e0c8c5902fac12315fb6705ce019172df
|
||||||
|
size 347288736
|
||||||
3
Qwen_Qwen3-0.6B_Q2_K_L.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q2_K_L.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:e0a0f4cfe97d0347359fbf2aa72386e4762e779facb8f48050604e754467dd37
|
||||||
|
size 499224736
|
||||||
3
Qwen_Qwen3-0.6B_Q2_K_XL.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q2_K_XL.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:15d495794da8a86d04625bedd0628df5367e446edd21d8951082881ab053f961
|
||||||
|
size 790941856
|
||||||
3
Qwen_Qwen3-0.6B_Q3_K_L.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q3_K_L.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:a49ac297bcd9409b65f204583f774449d96d02b0a117d6105691e4c48d2972de
|
||||||
|
size 435343520
|
||||||
3
Qwen_Qwen3-0.6B_Q3_K_M.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q3_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:98ad24efae82415cffdc98fdc0c2d5b1470ea4c47fbad050c5872d359fef79bb
|
||||||
|
size 413978784
|
||||||
3
Qwen_Qwen3-0.6B_Q3_K_S.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q3_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:195f50a6b92c48567272a2a44e080138c1076286bcd29c0ca2e6c61a76a9d8fd
|
||||||
|
size 389927072
|
||||||
3
Qwen_Qwen3-0.6B_Q3_K_XL.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q3_K_XL.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:1387745920ab2f7de90e8dc5e7544719614963c7b574a6491e93cc687391da3b
|
||||||
|
size 571478176
|
||||||
3
Qwen_Qwen3-0.6B_Q3_K_XXL.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q3_K_XXL.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:dcbddb0986bb66182cc67a381ad6829474b244fb6d9b1e0ebe1158b6bd48bc84
|
||||||
|
size 863195296
|
||||||
3
Qwen_Qwen3-0.6B_Q4_K_L.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q4_K_L.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:d0e04a8664fc2a0d403cac73ec12afbe81e8b0b0f683521da8d91c682d6a4a52
|
||||||
|
size 599691424
|
||||||
3
Qwen_Qwen3-0.6B_Q4_K_M.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q4_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:ba9f396cea37cf7795e9b77d9344a1bcb612c56d58637d2b767cb60506a9e638
|
||||||
|
size 484220064
|
||||||
3
Qwen_Qwen3-0.6B_Q4_K_S.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q4_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:d71378c2604e20119b14b5ada972f15a6530ac3b2e7d429437389d6ece2548be
|
||||||
|
size 470785184
|
||||||
3
Qwen_Qwen3-0.6B_Q4_K_XL.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q4_K_XL.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:08f99c228e7f528effdfab5140efbc243cd1278a74986f0ba6de2ea3fbe31197
|
||||||
|
size 891408544
|
||||||
3
Qwen_Qwen3-0.6B_Q5_K_L.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q5_K_L.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:ae36516e1ac69c5fa19c27ed2d2658255f6038c420897dadaddd02445cc47141
|
||||||
|
size 647401632
|
||||||
3
Qwen_Qwen3-0.6B_Q5_K_M.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q5_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:3ee8d4aab79e90cba25c4735e8f1a8205a1dfccf1c2f9aad8dd8ede05324c6c3
|
||||||
|
size 551378080
|
||||||
3
Qwen_Qwen3-0.6B_Q5_K_S.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q5_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:01acacaa2cbdf1d1b94a3a424f72af1f727b69e685d47ee2ee77a84ae12449c1
|
||||||
|
size 543579296
|
||||||
3
Qwen_Qwen3-0.6B_Q5_K_XL.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q5_K_XL.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:8981b813e4a6e836946272745f836bc7e6fa5d1502dae647123a761f28761e7d
|
||||||
|
size 939118752
|
||||||
3
Qwen_Qwen3-0.6B_Q6_K.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q6_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:767d26707ef4aadb3bd336c675bc3299af26a54f6eca52a17b10e0ae23a76931
|
||||||
|
size 622733472
|
||||||
3
Qwen_Qwen3-0.6B_Q6_K_L.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q6_K_L.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:d9ea48dd26aed4659d6528d0febf46ead4184927c55a1e774e318997855f40a4
|
||||||
|
size 698093728
|
||||||
3
Qwen_Qwen3-0.6B_Q6_K_XL.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q6_K_XL.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:b4c98c4d1146d3fa236deb2efd110aae137ed08031faf1f2f6647d7ca47de305
|
||||||
|
size 989810848
|
||||||
3
Qwen_Qwen3-0.6B_Q8_0.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q8_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:ade156197bba5a2983ce2473de048b87c8e92144cf8103c4e76405ea66fd70b5
|
||||||
|
size 804753568
|
||||||
3
Qwen_Qwen3-0.6B_Q8_K_XL.gguf
Normal file
3
Qwen_Qwen3-0.6B_Q8_K_XL.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:e8f6d51e78b2b835336ac702073ca5e0785e212ae97bbd575fb82527459031ef
|
||||||
|
size 1096470688
|
||||||
37
README.md
Normal file
37
README.md
Normal file
@@ -0,0 +1,37 @@
|
|||||||
|
---
|
||||||
|
base_model:
|
||||||
|
- Qwen/Qwen3-0.6B
|
||||||
|
pipeline_tag: text-generation
|
||||||
|
license: apache-2.0
|
||||||
|
---
|
||||||
|
|
||||||
|
|Quant|Size|Description|
|
||||||
|
|---|---|---|
|
||||||
|
|[Q2_K](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q2_K.gguf)|331.2 MB|Not recommended for most people. Very low quality.|
|
||||||
|
|[Q2_K_L](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q2_K_L.gguf)|476.1 MB|Not recommended for most people. Uses Q8_0 for output and embedding, and Q2_K for everything else. Very low quality.|
|
||||||
|
|[Q2_K_XL](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q2_K_XL.gguf)|754.3 MB|Not recommended for most people. Uses F16 for output and embedding, and Q2_K for everything else. Very low quality.|
|
||||||
|
|[Q3_K_S](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q3_K_S.gguf)|371.86 MB|Not recommended for most people. Prefer any bigger Q3_K quantization. Low quality.|
|
||||||
|
|[Q3_K_M](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q3_K_M.gguf)|394.8 MB|Not recommended for most people. Low quality.|
|
||||||
|
|[Q3_K_L](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q3_K_L.gguf)|415.18 MB|Not recommended for most people. Low quality.|
|
||||||
|
|[Q3_K_XL](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q3_K_XL.gguf)|545.0 MB|Not recommended for most people. Uses Q8_0 for output and embedding, and Q3_K_L for everything else. Low quality.|
|
||||||
|
|[Q3_K_XXL](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q3_K_XXL.gguf)|823.21 MB|Not recommended for most people. Uses F16 for output and embedding, and Q3_K_L for everything else. Low quality.|
|
||||||
|
|[Q4_K_S](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q4_K_S.gguf)|448.98 MB|Recommended. Slightly low quality.|
|
||||||
|
|[Q4_K_M](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q4_K_M.gguf)|461.79 MB|Recommended. Decent quality for most use cases.|
|
||||||
|
|[Q4_K_L](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q4_K_L.gguf)|571.91 MB|Recommended. Uses Q8_0 for output and embedding, and Q4_K_M for everything else. Decent quality.|
|
||||||
|
|[Q4_K_XL](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q4_K_XL.gguf)|850.11 MB|Recommended. Uses F16 for output and embedding, and Q4_K_M for everything else. Decent quality.|
|
||||||
|
|[Q5_K_S](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q5_K_S.gguf)|518.4 MB|Recommended. High quality.|
|
||||||
|
|[Q5_K_M](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q5_K_M.gguf)|525.84 MB|Recommended. High quality.|
|
||||||
|
|[Q5_K_L](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q5_K_L.gguf)|617.41 MB|Recommended. Uses Q8_0 for output and embedding, and Q5_K_M for everything else. High quality.|
|
||||||
|
|[Q5_K_XL](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q5_K_XL.gguf)|895.61 MB|Recommended. Uses F16 for output and embedding, and Q5_K_M for everything else. High quality.|
|
||||||
|
|[Q6_K](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q6_K.gguf)|593.88 MB|Recommended. Very high quality.|
|
||||||
|
|[Q6_K_L](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q6_K_L.gguf)|665.75 MB|Recommended. Uses Q8_0 for output and embedding, and Q6_K for everything else. Very high quality.|
|
||||||
|
|[Q6_K_XL](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q6_K_XL.gguf)|943.96 MB|Recommended. Uses F16 for output and embedding, and Q6_K for everything else. Very high quality.|
|
||||||
|
|[Q8_0](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q8_0.gguf)|767.47 MB|Recommended. Quality almost like F16.|
|
||||||
|
|[Q8_K_XL](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_Q8_K_XL.gguf)|1.02 GB|Recommended. Uses F16 for output and embedding, and Q8_0 for everything else. Quality almost like F16.|
|
||||||
|
|[F16](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B_F16.gguf)|1.41 GB|Not recommended. Overkill. Prefer Q8_0.|
|
||||||
|
|[ORIGINAL (BF16)](https://huggingface.co/Alcoft/Qwen_Qwen3-0.6B-GGUF/resolve/main/Qwen_Qwen3-0.6B.gguf)|1.41 GB|Not recommended. Overkill. Prefer Q8_0.|
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
Quantized using [TAO71-AI AutoQuantizer](https://github.com/TAO71-AI/AutoQuantizer).
|
||||||
|
You can check out the original model card [here](https://huggingface.co/Qwen/Qwen3-0.6B).
|
||||||
Reference in New Issue
Block a user