From 0ab0912d7c15a7f327074cf6d6e922f39b74ab8b Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Sun, 13 Sep 2026 01:28:12 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: alamios/DeepSeek-R1-DRAFT-Qwen2.5-0.5B-GGUF Source: Original Platform --- .gitattributes | 47 ++++++++++++++++++++++ DeepSeek-R1-DRAFT-Qwen2.5-0.5B-Q4_K_M.gguf | 3 ++ DeepSeek-R1-DRAFT-Qwen2.5-0.5B-Q8_0.gguf | 3 ++ DeepSeek-R1-DRAFT-Qwen2.5-0.5B-f16.gguf | 3 ++ README.md | 29 +++++++++++++ configuration.json | 1 + 6 files changed, 86 insertions(+) create mode 100644 .gitattributes create mode 100644 DeepSeek-R1-DRAFT-Qwen2.5-0.5B-Q4_K_M.gguf create mode 100644 DeepSeek-R1-DRAFT-Qwen2.5-0.5B-Q8_0.gguf create mode 100644 DeepSeek-R1-DRAFT-Qwen2.5-0.5B-f16.gguf create mode 100644 README.md create mode 100644 configuration.json diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..53d7257 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,47 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bin.* filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zstandard filter=lfs diff=lfs merge=lfs -text +*.tfevents* filter=lfs diff=lfs merge=lfs -text +*.db* filter=lfs diff=lfs merge=lfs -text +*.ark* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.gguf* filter=lfs diff=lfs merge=lfs -text +*.ggml filter=lfs diff=lfs merge=lfs -text +*.llamafile* filter=lfs diff=lfs merge=lfs -text +*.pt2 filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text \ No newline at end of file diff --git a/DeepSeek-R1-DRAFT-Qwen2.5-0.5B-Q4_K_M.gguf b/DeepSeek-R1-DRAFT-Qwen2.5-0.5B-Q4_K_M.gguf new file mode 100644 index 0000000..db78ef3 --- /dev/null +++ b/DeepSeek-R1-DRAFT-Qwen2.5-0.5B-Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7020f4b2d3f6341a306249df8781ffc961a2fb2b6fdbd747c8280979515ad39c +size 397932352 diff --git a/DeepSeek-R1-DRAFT-Qwen2.5-0.5B-Q8_0.gguf b/DeepSeek-R1-DRAFT-Qwen2.5-0.5B-Q8_0.gguf new file mode 100644 index 0000000..baf4a15 --- /dev/null +++ b/DeepSeek-R1-DRAFT-Qwen2.5-0.5B-Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0d39077a3dbd174f4c025a3dadd57fe956890f94e520e6edea6cc2ed7bda51bd +size 531192640 diff --git a/DeepSeek-R1-DRAFT-Qwen2.5-0.5B-f16.gguf b/DeepSeek-R1-DRAFT-Qwen2.5-0.5B-f16.gguf new file mode 100644 index 0000000..dd3cfd1 --- /dev/null +++ b/DeepSeek-R1-DRAFT-Qwen2.5-0.5B-f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f422534809a9363b2caa4c9cfbe1bb23c9499c82a6129a1a9fd739b5ea1a0238 +size 994388800 diff --git a/README.md b/README.md new file mode 100644 index 0000000..0f28e0f --- /dev/null +++ b/README.md @@ -0,0 +1,29 @@ +--- +license: apache-2.0 +language: +- en +base_model: +- alamios/DeepSeek-R1-DRAFT-Qwen2.5-0.5B +datasets: +- alamios/DeepSeek-R1-Distill-Qwen-32B-Conversations +pipeline_tag: text-generation +library_name: transformers +tags: +- qwen +- qwen2.5 +- deepseek +--- + +# DeepSeek-R1-DRAFT-Qwen2.5-0.5B-GGUF + +**Updated to v1** + +This model is trained on outputs of deepseek-ai/DeepSeek-R1-Distill-Qwen-32B and is meant to be used only as draft model for speculative decoding. + +It's specifically intended for users of 3090/4090, allowing you to run the DeepSeek-R1-Distill-Qwen-32B-Q4_K_M GGUF version with 16k context and speeding up generation without sacrificing more context length or model quality. + +# Data info + +The data consists of code, math, reasoning and general knowledge tasks collected from various datasets. It has been trained for 2 epochs on 7k unique examples, for a total of 26 million tokens per epoch. + +Since data generation was done using spare GPU time, I may publish a further trained version later. \ No newline at end of file diff --git a/configuration.json b/configuration.json new file mode 100644 index 0000000..bbeeda1 --- /dev/null +++ b/configuration.json @@ -0,0 +1 @@ +{"framework": "pytorch", "task": "text-generation", "allow_remote": true} \ No newline at end of file