mradermacher/UniReason-Qwen3-14B-no-think-SFT-i1-GGUF: Model synced from source: mradermacher/UniReason-Qwen3-14B-no-think-SFT-i1-GGUF - UniReason-Qwen3-14B-no-think-SFT-i1-GGUF - Gitea: Git with a cup of tea

mradermacher/UniReason-Qwen3-14B-no-think-SFT-i1-GGUF

Go to file

team mradermacher b079b91313 auto-patch README.md

2025-07-08 14:57:56 +00:00

.gitattributes

uploaded from marco

2025-07-08 14:42:19 +00:00

imatrix.dat

uploaded from marco

2025-07-08 12:48:04 +00:00

README.md

auto-patch README.md

2025-07-08 14:57:56 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-IQ1_M.gguf

uploaded from marco

2025-07-08 13:42:40 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-IQ1_S.gguf

uploaded from marco

2025-07-08 14:19:36 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-IQ2_M.gguf

uploaded from marco

2025-07-08 13:24:16 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-IQ2_S.gguf

uploaded from marco

2025-07-08 14:16:38 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-IQ2_XS.gguf

uploaded from marco

2025-07-08 14:03:03 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-IQ2_XXS.gguf

uploaded from marco

2025-07-08 13:50:45 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-IQ3_M.gguf

uploaded from marco

2025-07-08 13:00:48 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-IQ3_S.gguf

uploaded from marco

2025-07-08 14:42:19 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-IQ3_XS.gguf

uploaded from marco

2025-07-08 14:33:22 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-IQ3_XXS.gguf

uploaded from marco

2025-07-08 13:09:42 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-IQ4_NL.gguf

uploaded from marco

2025-07-08 13:18:13 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-IQ4_XS.gguf

uploaded from marco

2025-07-08 13:34:02 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-Q2_K_S.gguf

uploaded from marco

2025-07-08 13:35:29 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-Q2_K.gguf

uploaded from marco

2025-07-08 12:55:16 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-Q3_K_L.gguf

uploaded from marco

2025-07-08 13:55:29 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-Q3_K_M.gguf

uploaded from marco

2025-07-08 13:12:29 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-Q3_K_S.gguf

uploaded from marco

2025-07-08 13:45:38 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-Q4_0.gguf

uploaded from marco

2025-07-08 14:29:32 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-Q4_1.gguf

uploaded from marco

2025-07-08 14:38:46 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-Q4_K_M.gguf

uploaded from marco

2025-07-08 13:21:42 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-Q4_K_S.gguf

uploaded from marco

2025-07-08 13:04:42 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-Q5_K_M.gguf

uploaded from marco

2025-07-08 14:27:55 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-Q5_K_S.gguf

uploaded from marco

2025-07-08 14:09:53 +00:00

UniReason-Qwen3-14B-no-think-SFT.i1-Q6_K.gguf

uploaded from marco

2025-07-08 13:31:29 +00:00

README.md

arxiv, base_model, datasets, language, library_name, license, quantized_by, tags

arxiv

base_model

datasets

language

library_name

license

quantized_by

tags

2507.00432

ReasoningTransferability/UniReason-Qwen3-14B-no-think-SFT

math

reasoning

en

transformers

apache-2.0

mradermacher

text-generation

math-reasoning

transferability

Distill from Qwen3-32B-Instruct (non-thinking mode) through Reject Sampling

research-paper

qwen3

About

weighted/imatrix quants of https://huggingface.co/ReasoningTransferability/UniReason-Qwen3-14B-no-think-SFT

static quants are available at https://huggingface.co/mradermacher/UniReason-Qwen3-14B-no-think-SFT-GGUF

Usage

If you are unsure how to use GGUF files, refer to one of TheBloke's READMEs for more details, including on how to concatenate multi-part files.

Provided Quants

(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)

Link	Type	Size/GB	Notes
GGUF	i1-IQ1_S	3.7	for the desperate
GGUF	i1-IQ1_M	3.9	mostly desperate
GGUF	i1-IQ2_XXS	4.4
GGUF	i1-IQ2_XS	4.8
GGUF	i1-IQ2_S	5.1
GGUF	i1-IQ2_M	5.4
GGUF	i1-Q2_K_S	5.5	very low quality
GGUF	i1-Q2_K	5.9	IQ3_XXS probably better
GGUF	i1-IQ3_XXS	6.0	lower quality
GGUF	i1-IQ3_XS	6.5
GGUF	i1-Q3_K_S	6.8	IQ3_XS probably better
GGUF	i1-IQ3_S	6.8	beats Q3_K*
GGUF	i1-IQ3_M	7.0
GGUF	i1-Q3_K_M	7.4	IQ3_S probably better
GGUF	i1-Q3_K_L	8.0	IQ3_M probably better
GGUF	i1-IQ4_XS	8.2
GGUF	i1-IQ4_NL	8.6	prefer IQ4_XS
GGUF	i1-Q4_0	8.6	fast, low quality
GGUF	i1-Q4_K_S	8.7	optimal size/speed/quality
GGUF	i1-Q4_K_M	9.1	fast, recommended
GGUF	i1-Q4_1	9.5
GGUF	i1-Q5_K_S	10.4
GGUF	i1-Q5_K_M	10.6
GGUF	i1-Q6_K	12.2	practically like static Q6_K

Here is a handy graph by ikawrakow comparing some lower-quality quant types (lower is better):

And here are Artefact2's thoughts on the matter: https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9

FAQ / Model Request

See https://huggingface.co/mradermacher/model_requests for some answers to questions you might have and/or if you want some other model quantized.

Thanks

I thank my company, nethype GmbH, for letting me use its servers and providing upgrades to my workstation to enable this work in my free time. Additional thanks to @nicoboss for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to.