From dba05885275658373f6a9bd492ebf1df4f48419c Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Wed, 8 Jul 2026 09:33:05 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: MaziyarPanahi/Qwen2-1.5B-Instruct-GGUF Source: Original Platform --- .gitattributes | 64 +++++++++++++++++++++++++++++++++ Qwen2-1.5B-Instruct.IQ1_M.gguf | 3 ++ Qwen2-1.5B-Instruct.IQ1_S.gguf | 3 ++ Qwen2-1.5B-Instruct.IQ2_XS.gguf | 3 ++ Qwen2-1.5B-Instruct.IQ3_XS.gguf | 3 ++ Qwen2-1.5B-Instruct.IQ4_XS.gguf | 3 ++ Qwen2-1.5B-Instruct.Q2_K.gguf | 3 ++ Qwen2-1.5B-Instruct.Q3_K_L.gguf | 3 ++ Qwen2-1.5B-Instruct.Q3_K_M.gguf | 3 ++ Qwen2-1.5B-Instruct.Q3_K_S.gguf | 3 ++ Qwen2-1.5B-Instruct.Q4_K_M.gguf | 3 ++ Qwen2-1.5B-Instruct.Q4_K_S.gguf | 3 ++ Qwen2-1.5B-Instruct.Q5_K_M.gguf | 3 ++ Qwen2-1.5B-Instruct.Q5_K_S.gguf | 3 ++ Qwen2-1.5B-Instruct.Q6_K.gguf | 3 ++ Qwen2-1.5B-Instruct.Q8_0.gguf | 3 ++ Qwen2-1.5B-Instruct.fp16.gguf | 3 ++ README.md | 48 +++++++++++++++++++++++++ config.json | 3 ++ configuration.json | 1 + 20 files changed, 164 insertions(+) create mode 100644 .gitattributes create mode 100644 Qwen2-1.5B-Instruct.IQ1_M.gguf create mode 100644 Qwen2-1.5B-Instruct.IQ1_S.gguf create mode 100644 Qwen2-1.5B-Instruct.IQ2_XS.gguf create mode 100644 Qwen2-1.5B-Instruct.IQ3_XS.gguf create mode 100644 Qwen2-1.5B-Instruct.IQ4_XS.gguf create mode 100644 Qwen2-1.5B-Instruct.Q2_K.gguf create mode 100644 Qwen2-1.5B-Instruct.Q3_K_L.gguf create mode 100644 Qwen2-1.5B-Instruct.Q3_K_M.gguf create mode 100644 Qwen2-1.5B-Instruct.Q3_K_S.gguf create mode 100644 Qwen2-1.5B-Instruct.Q4_K_M.gguf create mode 100644 Qwen2-1.5B-Instruct.Q4_K_S.gguf create mode 100644 Qwen2-1.5B-Instruct.Q5_K_M.gguf create mode 100644 Qwen2-1.5B-Instruct.Q5_K_S.gguf create mode 100644 Qwen2-1.5B-Instruct.Q6_K.gguf create mode 100644 Qwen2-1.5B-Instruct.Q8_0.gguf create mode 100644 Qwen2-1.5B-Instruct.fp16.gguf create mode 100644 README.md create mode 100644 config.json create mode 100644 configuration.json diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..508c4a1 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,64 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bin.* filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zstandard filter=lfs diff=lfs merge=lfs -text +*.tfevents* filter=lfs diff=lfs merge=lfs -text +*.db* filter=lfs diff=lfs merge=lfs -text +*.ark* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text + +*.ggml filter=lfs diff=lfs merge=lfs -text +*.llamafile* filter=lfs diff=lfs merge=lfs -text +*.pt2 filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text + +Qwen2-1.5B-Instruct.IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.fp16.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Qwen2-1.5B-Instruct.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text \ No newline at end of file diff --git a/Qwen2-1.5B-Instruct.IQ1_M.gguf b/Qwen2-1.5B-Instruct.IQ1_M.gguf new file mode 100644 index 0000000..fd802c3 --- /dev/null +++ b/Qwen2-1.5B-Instruct.IQ1_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:27224aae192d19dc7986fc394b5bd25f5ea71cb572b7207ce478c32e54808b01 +size 464458560 diff --git a/Qwen2-1.5B-Instruct.IQ1_S.gguf b/Qwen2-1.5B-Instruct.IQ1_S.gguf new file mode 100644 index 0000000..12b342b --- /dev/null +++ b/Qwen2-1.5B-Instruct.IQ1_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c37a3e4c8d255a01b3a14147eddb443ac0088cf74bf27fb47c33ebcf6022c855 +size 436524864 diff --git a/Qwen2-1.5B-Instruct.IQ2_XS.gguf b/Qwen2-1.5B-Instruct.IQ2_XS.gguf new file mode 100644 index 0000000..3ec3328 --- /dev/null +++ b/Qwen2-1.5B-Instruct.IQ2_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:bc1147c719e6db32a245997262cc6b2b1c458b77c199322728851fe649f2c8ba +size 550324032 diff --git a/Qwen2-1.5B-Instruct.IQ3_XS.gguf b/Qwen2-1.5B-Instruct.IQ3_XS.gguf new file mode 100644 index 0000000..ad59ddb --- /dev/null +++ b/Qwen2-1.5B-Instruct.IQ3_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2a0edd87ee3def35ec883bd58d10245b196031de5d4ceed962ba9af1490f8f63 +size 731696448 diff --git a/Qwen2-1.5B-Instruct.IQ4_XS.gguf b/Qwen2-1.5B-Instruct.IQ4_XS.gguf new file mode 100644 index 0000000..bdac41b --- /dev/null +++ b/Qwen2-1.5B-Instruct.IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:99cacf0d9ad427fcf4665bad0d4457a9284e295d91abc6e5dd1eb3400bc3fbf2 +size 895728960 diff --git a/Qwen2-1.5B-Instruct.Q2_K.gguf b/Qwen2-1.5B-Instruct.Q2_K.gguf new file mode 100644 index 0000000..aad7d1e --- /dev/null +++ b/Qwen2-1.5B-Instruct.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:9a3eb79f27019bce952eb2dd37b9cdd27ed5926ca561bf646f0c5ed1f9edc5d9 +size 676302144 diff --git a/Qwen2-1.5B-Instruct.Q3_K_L.gguf b/Qwen2-1.5B-Instruct.Q3_K_L.gguf new file mode 100644 index 0000000..247f5d4 --- /dev/null +++ b/Qwen2-1.5B-Instruct.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:79b443d96abb17023b5639fd07296a42beed1e11acb5236327878acb477994f7 +size 880160064 diff --git a/Qwen2-1.5B-Instruct.Q3_K_M.gguf b/Qwen2-1.5B-Instruct.Q3_K_M.gguf new file mode 100644 index 0000000..905c1f0 --- /dev/null +++ b/Qwen2-1.5B-Instruct.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:60d68aa2583aff811457ef01fe765c8b144a973af16e409b41a66294daf6ab8b +size 824175936 diff --git a/Qwen2-1.5B-Instruct.Q3_K_S.gguf b/Qwen2-1.5B-Instruct.Q3_K_S.gguf new file mode 100644 index 0000000..230ce58 --- /dev/null +++ b/Qwen2-1.5B-Instruct.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2939c6adcfc28ff949e0a93526b2f8845abcf29631bfe1e5eafb81e97efa67a4 +size 760941888 diff --git a/Qwen2-1.5B-Instruct.Q4_K_M.gguf b/Qwen2-1.5B-Instruct.Q4_K_M.gguf new file mode 100644 index 0000000..1b08591 --- /dev/null +++ b/Qwen2-1.5B-Instruct.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5788f185a8c051df30193a157c6b18439d97d8584633eb87ffc086c53d3e465b +size 986045760 diff --git a/Qwen2-1.5B-Instruct.Q4_K_S.gguf b/Qwen2-1.5B-Instruct.Q4_K_S.gguf new file mode 100644 index 0000000..ea656e9 --- /dev/null +++ b/Qwen2-1.5B-Instruct.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:68dd25b418640b7b219fbdec41e6f22958177f455145b3c16b03f2c0a7be30d6 +size 940309824 diff --git a/Qwen2-1.5B-Instruct.Q5_K_M.gguf b/Qwen2-1.5B-Instruct.Q5_K_M.gguf new file mode 100644 index 0000000..d3a2054 --- /dev/null +++ b/Qwen2-1.5B-Instruct.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:63007bde10afc7174f3606c05ce69213b843b7fd06e873f2ffe29ab93d824f2f +size 1125047616 diff --git a/Qwen2-1.5B-Instruct.Q5_K_S.gguf b/Qwen2-1.5B-Instruct.Q5_K_S.gguf new file mode 100644 index 0000000..20e8c10 --- /dev/null +++ b/Qwen2-1.5B-Instruct.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:602d6e35d89c895cd086b04cb7edb836e1974e863cc392041725067e54d61759 +size 1098726720 diff --git a/Qwen2-1.5B-Instruct.Q6_K.gguf b/Qwen2-1.5B-Instruct.Q6_K.gguf new file mode 100644 index 0000000..2924981 --- /dev/null +++ b/Qwen2-1.5B-Instruct.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:58148c0e3025b575e546f9b58d1bd0e451c5ae9533c1ff15a94145061cd02538 +size 1272737088 diff --git a/Qwen2-1.5B-Instruct.Q8_0.gguf b/Qwen2-1.5B-Instruct.Q8_0.gguf new file mode 100644 index 0000000..a023295 --- /dev/null +++ b/Qwen2-1.5B-Instruct.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b381ed02d573baa98aed3ffcf1e14cede136d19cdbbcfafb58b9225dc8307533 +size 1646570304 diff --git a/Qwen2-1.5B-Instruct.fp16.gguf b/Qwen2-1.5B-Instruct.fp16.gguf new file mode 100644 index 0000000..d73854e --- /dev/null +++ b/Qwen2-1.5B-Instruct.fp16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0fee06aea3b9278f0f170291208f56d0647450a5763d8ca1b4d9cc25610fa038 +size 3093666432 diff --git a/README.md b/README.md new file mode 100644 index 0000000..8513aee --- /dev/null +++ b/README.md @@ -0,0 +1,48 @@ +--- +tags: +- quantized +- 2-bit +- 3-bit +- 4-bit +- 5-bit +- 6-bit +- 8-bit +- GGUF +- text-generation +- llama-3 +- llama +- text-generation +model_name: Qwen2-1.5B-Instruct-GGUF +base_model: Qwen/Qwen2-1.5B-Instruct +inference: false +model_creator: Qwen +pipeline_tag: text-generation +quantized_by: MaziyarPanahi +--- +# [MaziyarPanahi/Qwen2-1.5B-Instruct-GGUF](https://huggingface.co/MaziyarPanahi/Qwen2-1.5B-Instruct-GGUF) +- Model creator: [Qwen](https://huggingface.co/Qwen) +- Original model: [Qwen/Qwen2-1.5B-Instruct](https://huggingface.co/Qwen/Qwen2-1.5B-Instruct) + +## Description +[MaziyarPanahi/Qwen2-1.5B-Instruct-GGUF](https://huggingface.co/MaziyarPanahi/Qwen2-1.5B-Instruct-GGUF) contains GGUF format model files for [Qwen/Qwen2-1.5B-Instruct](https://huggingface.co/Qwen/Qwen2-1.5B-Instruct). + +### About GGUF + +GGUF is a new format introduced by the llama.cpp team on August 21st 2023. It is a replacement for GGML, which is no longer supported by llama.cpp. + +Here is an incomplete list of clients and libraries that are known to support GGUF: + +* [llama.cpp](https://github.com/ggerganov/llama.cpp). The source project for GGUF. Offers a CLI and a server option. +* [llama-cpp-python](https://github.com/abetlen/llama-cpp-python), a Python library with GPU accel, LangChain support, and OpenAI-compatible API server. +* [LM Studio](https://lmstudio.ai/), an easy-to-use and powerful local GUI for Windows and macOS (Silicon), with GPU acceleration. Linux available, in beta as of 27/11/2023. +* [text-generation-webui](https://github.com/oobabooga/text-generation-webui), the most widely used web UI, with many features and powerful extensions. Supports GPU acceleration. +* [KoboldCpp](https://github.com/LostRuins/koboldcpp), a fully featured web UI, with GPU accel across all platforms and GPU architectures. Especially good for story telling. +* [GPT4All](https://gpt4all.io/index.html), a free and open source local running GUI, supporting Windows, Linux and macOS with full GPU accel. +* [LoLLMS Web UI](https://github.com/ParisNeo/lollms-webui), a great web UI with many interesting and unique features, including a full model library for easy model selection. +* [Faraday.dev](https://faraday.dev/), an attractive and easy to use character-based chat GUI for Windows and macOS (both Silicon and Intel), with GPU acceleration. +* [candle](https://github.com/huggingface/candle), a Rust ML framework with a focus on performance, including GPU support, and ease of use. +* [ctransformers](https://github.com/marella/ctransformers), a Python library with GPU accel, LangChain support, and OpenAI-compatible AI server. Note, as of time of writing (November 27th 2023), ctransformers has not been updated in a long time and does not support many recent models. + +## Special thanks + +🙏 Special thanks to [Georgi Gerganov](https://github.com/ggerganov) and the whole team working on [llama.cpp](https://github.com/ggerganov/llama.cpp/) for making all of this possible. \ No newline at end of file diff --git a/config.json b/config.json new file mode 100644 index 0000000..9f0f76f --- /dev/null +++ b/config.json @@ -0,0 +1,3 @@ +{ + "model_type": "mistral" +} \ No newline at end of file diff --git a/configuration.json b/configuration.json new file mode 100644 index 0000000..bbeeda1 --- /dev/null +++ b/configuration.json @@ -0,0 +1 @@ +{"framework": "pytorch", "task": "text-generation", "allow_remote": true} \ No newline at end of file